AIA AI 日报|2026-08-06
本帖压缩呈现 7 条 AI 进展(站内本期共 7 条):4 条精选,0 条进入「震惊瘫坐」。
30 秒结论
- Sand.ai 开源 MAGI-2-preview,采用 114B 总参数、约 6B 激活的 MoE 视频架构,并公开代码与权重。
- Fable5 显示当前模型在需要主动移动视角、寻找证据的视觉任务上成功率仅 3.5%,暴露“会看图但不会主动看”的缺口。
- RL-100 将模仿学习与强化学习结合,面向真实机器人操作同时优化成功率、稳定性和执行效率。
要闻
1.
Fable5 主动视觉评测:大模型静态看图尚可,但交互式找证据仅 3.5%
Fable5 显示当前模型在需要主动移动视角、寻找证据的视觉任务上成功率仅 3.5%,暴露“会看图但不会主动看”的缺口。
2.
RL-100:融合模仿学习与强化学习,追求机器人操作的高成功率与稳定性
RL-100 将模仿学习与强化学习结合,面向真实机器人操作同时优化成功率、稳定性和执行效率。
3. Atomic Dance:用原子动作表示提升音乐舞蹈生成的可解释性与控制性
Atomic Dance 将舞蹈拆成原子动作单元,提升音乐驱动舞蹈生成的可解释性和细粒度控制。
模型发布
4.
MAGI-2-preview:114B 总参数、6B 激活的开源 MoE 视频生成模型
Sand.ai 开源 MAGI-2-preview,采用 114B 总参数、约 6B 激活的 MoE 视频架构,并公开代码与权重。
5.
字节 SeedRealtime:原生音视频全双工模型面向自然实时交互
字节跳动发布 SeedRealtime,原生联合处理音频与视觉并支持全双工对话,目标是实现可打断、低延迟的自然交互。
开发生态
6. QuerySplat / Topos-Lite:少量照片秒级生成可探索 3D 场景
影溯公开 QuerySplat 与 Topos-Lite,尝试用少量照片在秒级生成可交互三维场景。
7. 即梦接入 Seedance 2.5,并推出 Maya、Blender 插件与智能编辑工具
即梦 AI 接入 Seedance 2.5,并上线 Maya、Blender 插件和智能编辑模式,瞄准专业视频制作流程。
往期精选
以下内容来自近 30 天的精选回顾,不计入今日新增,也不会冒充当日新闻。
萝卜快跑进入右舵市场验证:香港机场岛取消车内安全员,伦敦同步启动道路测试
萝卜快跑在香港机场岛启动无车内安全员测试,并在伦敦开展道路测试,开始验证自动驾驶方案向右舵左行市场迁移。
DeepSeek-V4-Flash 正式版上线:Agent 能力重点重训,原生支持 Responses API
DeepSeek-V4-Flash 正式版 API 上线公测;架构与 Preview 相同,仅重新后训练,重点强化 Agent 与代码任务,并原生适配 Responses API。
欢迎直接回复编号,讨论你认为最值得关注的进展。
= 精选;
= 震惊瘫坐。内容由 AIA 新闻情报站完成事件去重、中文化与编辑审阅。