AI 资讯
未分类
ABot-Earth 0.7 高德推出的全球首个 3D 原生城市世界模型
ABot-Earth 0.7 是高德推出的全球首个 3D 原生城市世界模型。模型采用 3D 原生技术架构,用时空数据训练模型,输入一张卫星图或一段文字,10 分钟即可在消费级 GPU 上生成公里级 3D 城市。
2026-09-12
未分类
EchoWM 京东开源的交互式视听世界模型
EchoWM 是京东探索研究院开源的交互式视听世界模型。模型延续JoyAI-Echo的原生音视频生成能力,让用户以第一/第三人称视角在AI生成的世界中实时移动探索,画面、空间关系与环境音、语音持续同步且长时间不跑偏。
2026-09-11
未分类
NeoHorse-1 基元律动联合无问芯穹等开源的 Agent 模型
NeoHorse-1 是基元律动联合无问芯穹、清华、北大、港中文、阿里巴巴等推出的开源 Agent 模型,含 4B 与 9B 两版。模型采用 Agent-Native 后训练,用 Routing Harness 的真实执行轨迹为训练数据,将路由信号复用为训练课程排序依据,实现评测反馈→数据配比→模型更新闭环。
2026-09-11
未分类
VDN-MiniMax-H3 OpenVDN 开源的视频生成加速方案
VDN-MiniMax-H3是 OpenVDN 团队开源的视频生成加速方案,基于 MiniMax-H3 改造。模型采用混合注意力架构,局部滑动窗口 Softmax 保留精细细节,远距离线性注意力处理长程上下文,再通过 8 步蒸馏大幅压缩去噪步数。
2026-09-10
未分类
Suno v6 Suno 推出的新一代 AI 音乐生成模型系列
Suno v6 是 AI 音乐生成平台 Suno 推出的新一代模型系列,包含旗舰模型 v6(Pro/Premier用户)、实验性模型 v6-wild 和免费的 v6-mini。相比前代,模型生成速度大幅提升,支持自然语言编辑歌曲特定部分、多音频源混音、采样提取,能从音频和图片生成歌曲。
2026-09-10
未分类
teamai-cli 腾讯开源的 AI 团队协作 CLI 工具
TeamAI CLI 是腾讯开源的 MIT 协议 CLI 工具,用于统一管理团队的 AI 编程配置。工具将 skills、rules、MCP、hooks 等资源存入 Git 仓库,通过 push→MR→merge→pull 工作流分发给每位成员的本地 AI 工具。
2026-09-10
未分类
GoReady AI 求职招聘应用,自动提炼简历重点
GoReady(中文名:就绪)是AI求职招聘应用,由前月之暗面产品团队成员孟凡嵩创立。应用通过AI解析岗位JD与简历的匹配点和差距、生成沟通话术、按岗位自动提炼简历重点,并提供AI访谈、简历生成、职业规划等功能。
2026-09-10
未分类
GPT-6 Astra vs Claude Fable 5.1 实测对比,谁更接近 AGI?
这几天 GPT-6 Astra 发布后大家都在讨论一个事,在实现 AGI 方面 GPT-6 Astra 是否已经赢太多?
我刷到黄仁勋说 AGI 确实因为 GPT-6 Astra 而到来了。
2026-09-10
未分类
PixRestore 香港理工联合OPPO推出的统一图像修复模型
PixRestore 是香港理工大学与 OPPO 研究院联合推出的统一图像修复模型。模型采用像素空间 Diffusion Transformer 直接在像素层面进行 flow matching,避免细节损失。
2026-09-10
未分类
ffmpeg-skill 开源的本地化视频剪辑与处理 Agent Skill
ffmpeg-skill 是面向编程 Agent(Claude Code/Cursor/Codex)的开源 Agent Skill,让 AI 能像专业剪辑师一样调用本地 FFmpeg 处理视频。工具内置 28 个结构化工具,覆盖探测、剪切、拼接、字幕、调色、响度、多机位、批量导出等完整链路,遵循探测→编辑→检查→验证固定工作流。
2026-09-10
未分类
AuK 腾讯混元开源的语音生成与编辑基础模型
AuK是腾讯混元开源的15亿参数语音生成与编辑基础模型,采用流匹配扩散架构而非自回归。模型能通过统一的自然语言指令接口完成16种语音任务,包括零样本/指令式TTS、语音内容编辑、声学调节、副语言编辑及降噪和人声分离等。
2026-09-10
未分类
XiaoMi MiMo Desktop 小米推出的桌面端通用 AI Agent
XiaoMi MiMo Desktop 是小米推出的桌面端通用 AI Agent,内置新一代 MiMo-X-Pro/Flash 双模型。模型可直接读取表格、PDF、音视频等多格式素材,自动拆解任务、调用工具,交付可编辑的文档、PPT、网页、3D模型等成果。
2026-09-09