计费价格
公开资料未说明
输入形式
音频
官方模型目录与价格对比
按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。
先缩小候选,再进详情页看接口、计费和能力边界。
已收录模型
1,303
覆盖厂商
63
带价格信息
355
计费价格
公开资料未说明
输入形式
音频
MiMo-V2.5-Pro UltraSpeed 是小米与 TileRT 联合发布的高速推理模式,面向低延迟 Agent 和代码场景,峰值约 1000 tokens/s。
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
¥7.00 / 1M Tokens
输出价格
¥21.00 / 1M Tokens
输入价格
¥0.70 / 1M Tokens
输出价格
¥2.10 / 1M Tokens
输入价格
公开资料未说明
输出价格
公开资料未说明
Universal-3.5 Pro 是 AssemblyAI 于 2026 年 6 月发布的新一代高准确率语音识别模型,增强代码切换、说话人分离和多语言支持。
计费价格
公开资料未说明
输入形式
音频
A code editing LLM for autocomplete (FIM), apply edit, and next edit suggestions.
输入价格
公开资料未说明
输出价格
公开资料未说明
Ring 2.6 1T 是 InclusionAI 于 2026 年 5 月发布的万亿参数旗舰推理模型,面向 Agent、工程开发和复杂任务。
输入价格
公开资料未说明
输出价格
公开资料未说明
Ling 3.0 Flash 是 InclusionAI 于 2026 年 8 月公开的开放权重 Agent 模型,面向复杂推理、代码和长程任务。
输入价格
公开资料未说明
输出价格
公开资料未说明
Ling 3.0 Tiny 是 InclusionAI 于 2026 年 8 月公开的轻量开放权重 Agent 模型,适合低成本推理和本地部署。
输入价格
公开资料未说明
输出价格
公开资料未说明
Ling 2.6 Flash 是 InclusionAI 于 2026 年 4 月公开的轻量开放权重推理模型,适合代码和 Agent 场景。
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
Today, we release INTELLECT-3, a 100B+ parameter Mixture-of-Experts model trained on our RL stack, achieving state-of-the-art performance for its size across math, code, science and reasoning benchmarks, outperforming many larger frontier models.
输入价格
公开资料未说明
输出价格
公开资料未说明
We're excited to release INTELLECT-2, the first 32B parameter model trained via globally distributed reinforcement learning. Unlike traditional centralized training efforts, INTELLECT-2 trains a reasoning language model using fully asynchronous RL across a dynamic, heterogeneous swarm of compute contributors.
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
Granite 4.1 30B 是 IBM 于 2026 年 4 月发布的开放权重企业旗舰文本模型,面向复杂推理、代码和长上下文 Agent。
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
Pricing Integration List chevron-right Language Models chevron-right Trinity-Nano (6B) Trinity-Mini (26B) Trinity-Large-Preview Trinity-Large-Thinking API Reference chevron-right Your First API Call Chat Completion Usage Models Capabilities chevron-right Streaming Messages Multi-Turn Conversations Function Calling Structured Outputs Reasoning Traces Quick Deploys chevron-right Download Models arrow-up-right Hardware Prerequisites Consumer Hardware chevron-right Inference Engines chevron-right Policies chevron-right Deprecation Policy chevron-up chevron-down gitbook Powered by GitBook gitbook xmark block-quote On this page xmark xmark copy Copy chevron-down block-quote On this page block-quote Language Models Trinity-Large-Preview Overview Trinity Large (Preview) is a 400B-parameter (13B active) sparse mixture-of-experts language model, engineered to scale model capacity while maintaining inference efficiency over long contexts, with strong performance in reasoning-heavy workloads including math, coding-related tasks, and multi-step agent workflows.
输入价格
公开资料未说明
输出价格
公开资料未说明