AIA AI 日报|2026-08-06:MAGI-2-preview

AIA AI 日报|2026-08-06

本帖压缩呈现 7 条 AI 进展(站内本期共 7 条):4 条精选,0 条进入「震惊瘫坐」。

30 秒结论

  1. Sand.ai 开源 MAGI-2-preview,采用 114B 总参数、约 6B 激活的 MoE 视频架构,并公开代码与权重。
  2. Fable5 显示当前模型在需要主动移动视角、寻找证据的视觉任务上成功率仅 3.5%,暴露“会看图但不会主动看”的缺口。
  3. RL-100 将模仿学习与强化学习结合,面向真实机器人操作同时优化成功率、稳定性和执行效率。

:red_circle: 要闻

1. :star: Fable5 主动视觉评测:大模型静态看图尚可,但交互式找证据仅 3.5%
Fable5 显示当前模型在需要主动移动视角、寻找证据的视觉任务上成功率仅 3.5%,暴露“会看图但不会主动看”的缺口。

2. :star: RL-100:融合模仿学习与强化学习,追求机器人操作的高成功率与稳定性
RL-100 将模仿学习与强化学习结合,面向真实机器人操作同时优化成功率、稳定性和执行效率。

3. Atomic Dance:用原子动作表示提升音乐舞蹈生成的可解释性与控制性
Atomic Dance 将舞蹈拆成原子动作单元,提升音乐驱动舞蹈生成的可解释性和细粒度控制。

:blue_circle: 模型发布

4. :star: MAGI-2-preview:114B 总参数、6B 激活的开源 MoE 视频生成模型
Sand.ai 开源 MAGI-2-preview,采用 114B 总参数、约 6B 激活的 MoE 视频架构,并公开代码与权重。

5. :star: 字节 SeedRealtime:原生音视频全双工模型面向自然实时交互
字节跳动发布 SeedRealtime,原生联合处理音频与视觉并支持全双工对话,目标是实现可打断、低延迟的自然交互。

:green_circle: 开发生态

6. QuerySplat / Topos-Lite:少量照片秒级生成可探索 3D 场景
影溯公开 QuerySplat 与 Topos-Lite,尝试用少量照片在秒级生成可交互三维场景。

7. 即梦接入 Seedance 2.5,并推出 Maya、Blender 插件与智能编辑工具
即梦 AI 接入 Seedance 2.5,并上线 Maya、Blender 插件和智能编辑模式,瞄准专业视频制作流程。

:books: 往期精选

以下内容来自近 30 天的精选回顾,不计入今日新增,也不会冒充当日新闻。

:star: 萝卜快跑进入右舵市场验证:香港机场岛取消车内安全员,伦敦同步启动道路测试
萝卜快跑在香港机场岛启动无车内安全员测试,并在伦敦开展道路测试,开始验证自动驾驶方案向右舵左行市场迁移。

:star: DeepSeek-V4-Flash 正式版上线:Agent 能力重点重训,原生支持 Responses API
DeepSeek-V4-Flash 正式版 API 上线公测;架构与 Preview 相同,仅重新后训练,重点强化 Agent 与代码任务,并原生适配 Responses API。


:magnifying_glass_tilted_right: 查看完整方法、关键结果、局限与原始来源

欢迎直接回复编号,讨论你认为最值得关注的进展。

:star: = 精选;:exploding_head: = 震惊瘫坐。内容由 AIA 新闻情报站完成事件去重、中文化与编辑审阅。