模型动态
模型动态
Mage 微软开源的 4B 参数多模态模型家族
Mage 是微软开源的 4B 参数多模态模型家族,包含流式视频/图像理解模型 Mage-VL 与图像生成与编辑模型 Mage-Flow。Mage-VL 通过 Codec-Native 编码将视觉 Token 减少 75%,推理提速 3.5 倍,支持实时视频理解。
2026-08-22
模型动态
LLM-as-a-Verifier 斯坦福联合英伟达等开源的通用验证框架
LLM-as-a-Verifier 是斯坦福、UC 伯克利与 NVIDIA 研究院联合开源的通用验证框架。框架无需额外训练,通过用 LLM 评分 Token 的完整 logits 分布生成连续细粒度分数,替代传统离散评分。
2026-08-22
模型动态
Qwen-UI-Agent 阿里通义推出的 GUI 智能体基座模型
Qwen-UI-Agent 是阿里巴巴通义团队推出的 GUI 智能体基座模型,能在手机、电脑和网页端像真人一样操作界面。模型基于 100+ 台真机、150+ 应用训练,支持 GUI 与命令行混合执行,可完成跨应用长程任务。
2026-08-21 AI资讯
模型动态
SenseNova U1.5 Lite 商汤科技开源的原生统一多模态大模型
SenseNova U1.5 Lite 是商汤科技开源的轻量级原生统一多模态大模型,专为真实视觉创作流程设计。模型原生支持 3-4k 字符超长指令遵循,具备高质量视觉生成、可靠的图像编辑、精准文字排版、精细视觉控制及原生 4K 输出能力。
2026-08-21 AI资讯
模型动态
DeepSeek-V4-Flash-Vision-Exp DeepSeek 推出的多模态视觉理解模型
DeepSeek-V4-Flash-Vision-Exp 是 DeepSeek 推出的实验性多模态视觉理解模型。模型在保持 DeepSeek-V4-Flash 文本能力的基础上新增视觉输入,多模态 Agent 表现接近 Opus-4.8。
2026-08-21 AI资讯
模型动态
ChatGPT 5 发布,多模态能力再升级
OpenAI 发布新一代模型,推理与图像理解显著提升,免费额度同步上调。
2026-08-08 AI
模型动态
国产大模型进入万亿参数时代
多家厂商公布最新参数规模,中文能力逼近国际前沿。
2026-08-06 报告
模型动态
豆包大模型全面开放 API
字节跳动宣布豆包大模型 API 全面开放,价格极具竞争力。
2026-07-20 AI