来源:新浪科技
新浪科技讯 9月22日上午消息,今日举办的2026云栖大会上,阿里巴巴ATH技术副总裁、淘天集团首席科学家郑波分享指出,“三年内会出现一个原生全模态统一模型,体验将不再受限于模态的边界。”
据郑波介绍,在最富创意的视觉生成领域,阿里正通过视觉生成模型的持续迭代升级,让AI创造出更好的作品,让用户享受到更好的体验。大会期间,阿里图像生成模型Qwen-Image-3.1亮相,它面向电商、创意、设计等真实商用场景全新优化升级,将原本数小时的视觉设计压缩至秒级交付,水准堪比专业设计师,还支持图像精准编辑。
此外,阿里还发布了音乐生成模型Happy Shrimp 1.1版本,在音乐表现、人声质量、多语种演唱及指令理解四个专业维度进一步提升,支持百余种曲风与十余种主流语言,覆盖人声歌曲与纯音乐两大生成场景。阿里世界模型最新版本HappyOyster 2.0 Preview也同步亮相,通过对模型架构、训练方法和数据体系的全面升级,显著提升了智能实时交互、记忆能力、实时响应、物理规律遵循等核心能力,让世界模型真正从实验室走向真实可用。
此外,阿里全新的下一代视频生成模型也将于11月发布,朝着更长、更可控、更完整、更智能的方向演进:在更长的时间里,新模型仍然能保持一致性,创作者可精准掌控人物、场景与镜头;同时,模型能具备导演级的创作思维,从生成单个镜头迈向理解完整叙事。(文猛)








