详细参数
模型类型
speech_recognition
适合场景
语音转文字 / 多语种与方言识别
计费价格
公开资料未说明
计费方式
公开资料未说明
计费单位
未标注
输入形式
音频
输出形式
文本
MiMo-V2.5-ASR 是小米 2026 年 4 月发布的开源语音识别模型,支持中英双语、中文方言、代码切换、歌词识别、噪声环境和多说话人场景。
适合
语音转文字 / 多语种与方言识别
speech_recognition
价格
公开资料未说明
1M Tokens
输入
音频
输出
文本
规格
speech_recognition
所属厂商:小米 MiMo
详细参数
模型类型
适合场景
计费价格
计费方式
计费单位
输入形式
输出形式
能力与信息
交互链路
实时
语音输入
语音输出
语音理解
转写
翻译
时间戳
语音生成
TTS
说话人区分
开发接入
工具调用
接入信息
调用名
API 基础地址
调用协议
主接口
发布时间
价格与计费
计费摘要
输入价
输出价
缓存输入
币种
计费单位
单位类型
价格说明
原始价格文案
补充说明
发布时间
官方入口