Token导航 LogoToken导航TokenDH.com

NVIDIA发布Nemotron 3 Ultra模型优化复杂工作流

更新时间 2026-06-05来源 品玩正文 431字阅读约 2分钟1 张图片

品玩6月5日讯,NVIDIA近日正式推出Nemotron 3 Ultra,这是一款专为复杂工作流设计的开源混合专家模型。该模型参数总量达5500亿,激活参数为550亿,旨在解决长周期任务中的成本与效率挑战。通过结合前沿推理能力与架构创新,该模型在保持高精度的同时,推理吞吐量较同类开源模型提升5倍,并可降低最高30%的任务完成成本。

该模型集成了多项技术突破,包括支持长文本处理的混合Mamba-Transformer架构、提升生成效率的多Token预测(MTP)技术,以及适用于不同GPU架构的NVFP4精度格式。此外,NVIDIA同步发布了Nemotron 3.5内容安全模型与多语言语音识别模型,分别用于内容审核与实时语音交互场景。

为促进广泛采用,Nemotron系列采用OpenMDW-1.1许可协议开放模型权重、数据及训练配方。开发者可通过Hugging Face下载模型,或在NVIDIA NIM微服务及多家云服务商处获取支持,用于构建安全、高效的自动化工作流。

资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多