Token导航 LogoToken导航

生数科技发布Vidu Q4 Preview视频模型 每秒0.09元起

更新时间 2026-10-08来源 IPO早知道正文 2173字阅读约 7分钟5 张图片
并不只是一次价格下降,而是模型能力、系统效率和大众可用性同时向前一步。
本文为IPO早知道原创
作者|Stone Jin
微信公众号|ipozaozhidao

据IPO早知道消息,生数科技于10月8日发布新一代视频生成旗舰模型的首个预览版本 Vidu Q4 Preview。

新模型围绕人物演绎、镜头语言与复杂视效三项核心能力升级,最多支持 15 张参考图、3 段参考音频,并提供 2K、4K 输出。首发优惠价格低至 0.09 元/秒起,推动旗舰视频生成进入以“分”为单位计价的区间。

某种程度上而言,生数科技的本次发布标志着旗舰视频生成模型正在进入普通创作者和小团队可以更高频调用的价格区间。

图片

图片

从“元时代”到“分时代”

创作从押注变成选择

Vidu Q4 Preview首发优惠价格为0.09 元/秒起,并提供 540P、720P、1080P、2K、4K 等多种输出规格。在可比规格与计费条件下,同等预算可多生成约 5 倍内容。

图片

对普通创作者而言,这意味着一个想法不必因为第一次生成效果不理想就被放弃;对独立创作者和小型工作室而言,则意味着有限预算可以支持更多试镜、分镜和版本测试。

这种变化也会进一步传导到产业端——广告团队可以同时测试多个创意和开场,电商商家可以针对不同产品和人群生成更多素材,漫剧、短剧团队可以提前验证人物关系和镜头节奏,影视制作也可以将AI更多用于创意验证和分镜预演。

换言之,AI降低的并不是创作本身的价值,而是反复尝试的成本。

这里需要指出的一点是,衡量视频模型是否真正普惠,不能只看“生成一条视频多少钱”,还要看一条可用镜头需要尝试多少次,以及整个创作过程的综合成本。

只有模型能力提升和使用成本下降同时发生,前沿视频模型才有机会从少量精选样片真正进入日常创作。

图片

技术路线持续演进

Q4进一步强化“表现力”

从产品力上来看,Q4 Preview 在降低价格的同时,将“传神表现力”作为这一代旗舰模型的重点:提升人物表情、情绪与动作的完整性,加强动态运镜、切镜和复杂镜头衔接,并进一步改善爆炸、烟火、粒子等复杂视效与人物、空间和叙事之间的关系。

从这个角度看,视频模型所谓的“DeepSeek时刻”,并不只是一次价格下降,而是模型能力、系统效率和大众可用性同时向前一步。

在技术路线上,Q4 Preview延续了生数科技在视频生成领域的技术路线——2022年,生数科技核心团队提出 U-ViT 架构;2024 年 4 月,Vidu 首次公开亮相。此后,Vidu 持续推进参考生视频、多主体一致性、生成效率与成本优化。从Vidu 2.0 到 Q 系列,模型逐步具备多镜头叙事、声画同出和复杂运镜等能力。Q4 Preview 模型则进一步聚焦人物表演、镜头语言与视觉特效,形成新一代“传神旗舰”。

当然,Q4 Preview 仍是一个面向创作者开放的预览版本。生数科技表示,希望通过提前开放,让模型尽快进入真实创作场景,并通过用户反馈和实际需求持续完善正式版本。

图片

发布后即成海外讨论的主要焦点

关注点逐渐转向综合能力的衡量

值得一提的是,Vidu Q4 Preview的发布也在海外AI创作者社区引发关注。在X平台,多位海外创作者将其放在Seedance、可灵、MiniMax等头部视频模型的竞争格局中讨论。其中,旗舰级视频生成能力与更具竞争力的价格组合,成为海外讨论的主要焦点。

AI工作流与自动化领域创作者 Ethan Cole AI、AI内容创作者 Zyra AI 等认为,更低的生成成本能够降低创作试错门槛,让创作者有更多空间探索不同创意、反复调整作品。

能力方面,最多15张参考图、3段参考音频及4K输出,也引发了海外创作者对创作可控性和实际工作流的讨论。AI视频创作者 Shami 重点关注多参考能力在角色、商品及视觉风格一致性上的应用价值,科技与AI博主 Orikan 则进一步将讨论延伸至实际创作效率,关注“获得一个可用镜头究竟需要多少成本”。

从海外讨论来看,创作者的关注点正从单纯比较模型生成效果,逐渐转向生成质量、创作可控性与实际使用成本的综合衡量。Vidu Q4 Preview凭借表现力与性价比的组合,成为海外AI视频创作者关注的新选择。


视频生成与具身智能

共同指向世界模型

进一步放眼 AI 行业,通用人工智能公司的技术探索正从语言和内容生成,进一步延伸到空间理解、世界建模和具身智能。

生数科技也在沿着这一方向持续投入。作为一家通用世界模型公司,其一端是面向数字世界的视频生成模型 Vidu,另一端是面向物理世界的世界动作模型 Motubrain。

在这条技术路线中,视频生成与具身智能并非彼此割裂:一个生成世界,一个在世界中行动——视频模型需要理解人物、物体和空间如何随时间变化;具身模型则进一步需要理解动作如何改变环境。两者背后,都指向对世界状态及其变化规律的建模。

这也是生数科技对多模态技术的长期判断:多模态模型不仅需要理解和生成内容,也需要进一步理解物理世界,并支持真实环境中的行动。

生数科技提出通用世界模型五级发展路线,推动模型能力从高质量视觉内容生成,逐步向时空一致性理解、实时交互、物理规律模拟及自主决策演进,构建连接数字内容生产与物理AI应用的技术体系。

生数科技表示,世界模型的发展不仅是生成质量的提升,更是人工智能从生成内容走向理解世界、模拟世界和交互世界的过程。其将持续推动基础模型能力突破,加速世界模型从数字内容生产向物理 AI 应用拓展。

文章标签DeepSeek模型发布AI产品
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多