Odyssey 于 10 月 8 日发布基础世界模型 Odyssey-3(自回归扩散 Transformer)。Odyssey-3 Pro(720p)在 Physics-IQ Verified 视频续写榜拿到 66.1,为公开最高分;图生视频 54.7。研究预览已在浏览器免费开放(Flash 变体),支持第一/第三人称漫游与独立相机;API 需联系申请,暂无开源权重与公开价格。官方称仅用数十小时演示即可让模型控制多种机械臂。
核心要点速览
- ✓Physics-IQ Verified 视频续写:Odyssey-3 Pro 66.1(best-of-8,公开最高)/ 63.4(Prompt 增强);480p 版 51.8 → 61.6 → 64.4(官方发布)
- ✓图生视频:Odyssey-3 Pro 54.7;官方称在 WorldMark 4 个类别中 3 项第 1(厂商自测,待第三方复核)
- ✓架构:自回归扩散 Transformer,根据历史观测 + 最新动作/事件实时预测环境演化
- ✓落地:外挂 action decoder,数十小时机械臂演示即可迁移控制,观察到训练数据中没有的抓取失败恢复行为(技术长文)
- ✓可用性:浏览器研究预览免费;API 走申请,无开源权重、无公开价格

开发者 3 秒速决决策指标
把技术选型换算成你的开发预算
40 款主流编程套餐横向比价,支持输入/输出 Token 真实账单模拟
相关资源与官方项目出处
免代理直达深度技术解析与实战评估
核心背景与行业痛点
具身智能最大的瓶颈是数据:每种机器人、每个任务都要采集大量专属演示,连“抓空了怎么补救”这种失败场景也得逐一录。世界模型的思路是先从海量视觉观测中学会物理与因果,再迁移到具体机器。Odyssey 由前无人驾驶团队创立,10 月 8 日发布的 Odyssey-3 是其迄今最强的基础世界模型。
架构亮点与底层机制
Odyssey-3 是自回归扩散 Transformer:根据此前的观测与最新输入(移动、相机、插入事件),实时预测环境下一步怎样变化。分两档:Odyssey-3(480p)与 Odyssey-3 Pro(720p),浏览器预览跑的是更快的 Flash 变体。控制物理系统时,在模型上挂一个 action decoder,用“观测-动作”配对数据训练,把内部表征翻译成机器动作(技术长文)。
权威 Benchmark 与实测跑分对比
- Physics-IQ Verified(Anates Labs 与 DeepMind 的物理基准,覆盖流体、光学、固体力学、磁学、热学)视频续写:Odyssey-3 Pro 66.1(best-of-8),官方称为公开最高分;Prompt 增强 63.4。
- 480p 版:基础 51.8、Prompt 增强 61.6、best-of-8 64.4;官方图表同时对比 FLUX 3、Cosmos3 等模型的单视频生成成本。
- 图生视频:Pro 54.7。WorldMark 4 类中 3 类第 1 属厂商自测,建议等待第三方复核。
开发者实战落地与开箱指南
即刻查看该技术对应模型与主流工具的实测差异,或一键测算团队 API 调用与 $20/月套餐盈亏平衡点。
讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察