Token导航 LogoToken导航TokenDH.com

World Labs发布世界模型Atlas 支持文图音视频多模态生成

更新时间 2026-09-03来源 品玩正文 315字阅读约 1分钟1 张图片

品玩9月2日讯,由李飞飞创办的 AI 公司World Labs 正式宣布,推一款下一代世界模型出Atlas。

该模型为全模态模型,从头预训练,原生支持文本、图像、视频和3D联合处理。Atlas采用多模态自回归扩散Transformer架构,将所有输入整合至共享空间上下文,基于此生成后续内容,保持3D一致性。

Atlas支持相机控制视频生成,可从多张图像生成最长1分钟、1440p视频;支持空间重建,仅需少量图像即可生成3D输出,基准优异;支持时空模拟,可从视频建模,实现视频重新构图与机器人仿真;支持文本图像生成及360度全景图。

Atlas将驱动World Labs后续Marble等产品。Atlas已进入早期访问阶段,仅面向部分合作伙伴开放

文章标签模型发布
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多