MiMo-V2.5-ASR
分类:语音模型 / 上下文:- / 调用名:mimo-v2.5-asr
MiMo-V2.5-ASR 是小米 2026 年 4 月发布的开源语音识别模型,支持中英双语、中文方言、代码切换、歌词识别、噪声环境和多说话人场景。

更值得关注的是终端生态结合和小米体系内的落地可能,适合关注端侧、硬件联动和新入口场景的团队。现阶段更偏潜力观察位,价格与开放深度要结合后续平台推进来看。
主分类:多模态模型
适合:端侧场景 / 硬件结合 / 生态观察
付费:小米开放平台账号 / 企业合作
地区:中国大陆
接入判断
按原生接口接小米 MiMo 适合作为官方原生入口,接入前先按文档核对鉴权方式、模型 ID 和计费口径。
协议:官方原生 API
价格:以官方价格页为准
模型:已收录 11 个
分类:语音模型 / 上下文:- / 调用名:mimo-v2.5-asr
MiMo-V2.5-ASR 是小米 2026 年 4 月发布的开源语音识别模型,支持中英双语、中文方言、代码切换、歌词识别、噪声环境和多说话人场景。
分类:语言模型 / 上下文:1M / 调用名:mimo-v2.5-pro-ultraspeed
MiMo-V2.5-Pro UltraSpeed 是小米与 TileRT 联合发布的高速推理模式,面向低延迟 Agent 和代码场景,峰值约 1000 tokens/s。
分类:语言模型 / 上下文:1M / 调用名:mimo-v2.5-pro
小米当前最强的长上下文 Agent 与软件工程模型,公开口径为 1T 总参数、42B 激活参数,并支持 1M 上下文。
价格记录更新时间:2026-04-23
查看模型详情分类:语言模型 / 上下文:1M / 调用名:mimo-v2-pro
小米 MiMo 官方模型页提示 MiMo-V2 系列已于 2026 年 6 月 30 日正式下线,原模型名称已失效,应迁移到 V2.5 系列。
价格记录更新时间:2026-04-23
查看模型详情分类:多模态模型 / 上下文:1M / 调用名:mimo-v2.5
MiMo 当前主力全模态理解模型,支持图像、视频、音频与文本输入,并具备原生 Agent 执行能力和 1M 上下文。
价格记录更新时间:2026-04-23
查看模型详情分类:多模态模型 / 上下文:256K / 调用名:mimo-v2-omni
小米 MiMo 官方模型页提示 MiMo-V2 系列已于 2026 年 6 月 30 日正式下线,原模型名称已失效,应迁移到 V2.5 系列。
价格记录更新时间:2026-04-23
查看模型详情分类:语音模型 / 上下文:8K / 调用名:mimo-v2.5-tts
MiMo-V2.5-TTS 使用内置高质量音色做语音合成,支持唱歌模式与更细粒度的风格控制。
价格记录更新时间:2026-04-23
查看模型详情分类:语音模型 / 上下文:8K / 调用名:mimo-v2.5-tts-voiceclone
MiMo-V2.5-TTS-VoiceClone 基于少量音频样本做高保真音色克隆,用于指定音色的语音合成。
价格记录更新时间:2026-04-23
查看模型详情分类:语音模型 / 上下文:8K / 调用名:mimo-v2.5-tts-voicedesign
MiMo-V2.5-TTS-VoiceDesign 通过自然语言描述快速生成新音色,适合做品牌声线与角色音色设计。
价格记录更新时间:2026-04-23
查看模型详情分类:语音模型 / 上下文:8K / 调用名:mimo-v2-tts
小米 MiMo 官方模型页提示 MiMo-V2 系列已于 2026 年 6 月 30 日正式下线,原模型名称已失效,应迁移到 V2.5 系列。
价格记录更新时间:2026-04-23
查看模型详情分类:语言模型 / 上下文:256K / 调用名:mimo-v2-flash
小米 MiMo 官方模型页提示 MiMo-V2 系列已于 2026 年 6 月 30 日正式下线,原模型名称已失效,应迁移到 V2.5 系列。
价格记录更新时间:2026-04-23
查看模型详情