首页/资讯/模型动态

模型动态

模型动态
Gemini Omni 1.1 Flash 谷歌推出的 AI 视频生成模型
Gemini Omni 1.1 Flash 是谷歌推出的 AI 视频生成模型,面向开发者和专业创作者,支持从 360p 快速预览到 4K 超高清的多档位输出。
2026-08-28
模型动态
Hy4 preview 腾讯混元开源的新一代旗舰大模型
Hy4 preview 是腾讯混元推出的开源旗舰大模型,总参数 770B、激活参数 49B、上下文长度达 1M。模型通过与腾讯内部软工、游戏、金融、安全等领域专家深度共建,模型在代码开发、办公分析、游戏制作、科学研究等真实生产力任务上表现卓越。
2026-08-28
模型动态
Hy-MT2-1.8B 腾讯混元推出的端侧翻译大模型
Hy-MT2-1.8B 是腾讯混元推出的端侧翻译大模型,仅 1.8B 参数却支持 33 个语种互译,翻译质量在 FLORES-200 等基准上超越微软、豆包等商业 API。
2026-08-27
模型动态
Gemini 3.5 Transcribe 谷歌推出的最新语音转文本模型
Gemini 3.5 Transcribe 是 Google 推出的最新语音转文本模型,支持实时流式和预录音频处理两种模式,前者通过 Live API 实现亚秒级延迟,后者支持说话人归属与词级时间戳。
2026-08-27
模型动态
Qwen3.8-Flash 阿里通义推出的多模态 MoE 模型
Qwen3.8-Flash 是阿里云通义千问推出的多模态 MoE 模型,总参数量 125B,每 token 仅激活 6B,原生支持 262K 上下文。
2026-08-27
模型动态
GLM-5.3-Flash 智谱开源的原生多模态模型
GLM-5.3-Flash 是智谱最新推出的开源大模型,总参数三百二十亿,激活参数仅十八亿,为 GLM-5 系列首个原生多模态模型。模型综合智能指数达五十七分,与 Claude Opus 4.8 持平,定价仅为其四十分之一。
2026-08-27
模型动态
Breeze TTS 2 BreezeBlue 推出的新一代语音合成模型
Breeze TTS 2 是 BreezeBlue 推出的新一代语音合成模型,支持通过自然语言零样本设计角色音色,用自然语言指令精准控制情绪、语速、口音等表演细节。
2026-08-26
模型动态
PixVerse R2 爱诗科技推出的实时全模态世界模型
PixVerse R2 是爱诗科技推出的实时全模态世界模型,为PixVerse R1 的升级版本。模型支持文字、图像、音频及动作信号等多模态输入,能在运行中持续接收用户控制、实时更新世界状态并连续输出同步音视频。
2026-08-26
模型动态
Agnes 2.5 Pro Alpha Agnes AI 开源的多模态推理模型
Agnes 2.5 Pro Alpha 是 Agnes AI 开源的多模态推理模型,采用 Apache 2.0 协议,权重托管于 Hugging Face。模型支持文本与图像输入,上下文窗口达 1M tokens,擅长复杂代码生成、科学推理、长文档分析与 Agent 工作流。
2026-08-25
模型动态
FireRedTTS3 小红书开源的统一语音生成与编辑模型
FireRedTTS3 是小红书 FireRed 团队开源的统一语音生成与编辑模型。模型基于 RedAE 语义增强连续表示与 LLM-DiT 架构,单一模型可实现24 种语言 + 21 种中文方言的零样本音色克隆、自然语言描述的声音设计,以及指定区域的精准语音编辑。
2026-08-25
模型动态
Qwen3.8-27B-DFlash2 Inco AI 开源的投机解码草稿模型
Qwen3.8-27B-DFlash2 是 Inco AI 开源的投机解码草稿模型,专为 Qwen3.8-27B 设计。模型仅 1.92B 参数,通过块级并行预测、轻量路径选择器和双抽头动态卷积,在单次前向传播中并行生成整块 token 草稿。
2026-08-25
模型动态
FreeToken 开源端侧 MoE 大模型推理系统,支持满血运行
FreeToken 是 UC Berkeley 与 MIT 等机构联合开源的端侧 MoE 大模型推理系统。系统通过全层双缓冲、带宽自适应混合调度、Agent 状态复用及弹性显存热扩缩容等技术,将个人电脑的 CPU、内存、PCIe 与 GPU 统一为弹性计算平台。
2026-08-24
上一页 1 / 2 下一页
AI 智能推荐 ×
输入关键词,AI 从 1000+ 工具中精准匹配推荐