Token导航 LogoToken导航TokenDH.com

官方模型目录与价格对比

找模型,不只看名字,还要看 能力和价格

按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。

先缩小候选,再进详情页看接口、计费和能力边界。

已收录模型

1,303

覆盖厂商

63

带价格信息

355

多模态模型华为盘古稳定版

Pangu-CV-语义分割-V2

语义分割。使用盘古统一预训练基模型底座,添加分割任务头构建语义分割模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

图像分割视觉分析企业接入
多模态模型华为盘古稳定版

Pangu-CV-异常检测-V3

异常检测。盘古计算机视觉异常检测大模型,对不符合预期模式或数据集中大多数样本的项目、事件或观测值的异常点进行识别和检测。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉检测工业质检企业接入
多模态模型华为盘古稳定版

Pangu-CV-实例分割-V1

实例分割。使用盘古统一预训练基模型底座,添加分类任务头构建语义分割模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

图像分割视觉分析企业接入
多模态模型华为盘古稳定版

Pangu-CV-万物分割-V2

万物分割。盘古计算机视觉万物分割大模型,能够识别和分割已知类别对象,同时也能处理未知类别对象的模型。具备对未知类别的泛化能力,并在面对新类别时能够做出合理的响应。

输入价格

公开资料未说明

输出价格

公开资料未说明

图像分割视觉分析企业接入
多模态模型华为盘古稳定版

Pangu-CV-开集分类-V3

开集分类。盘古CV开集分类大模型,根据在图像信息中所反映的不同特征,把不同类别识别到的图像处理方法,利用盘古CV技术对图像进行定量分析,为图像分配若干个类别。

输入价格

公开资料未说明

输出价格

公开资料未说明

图像分类视觉理解企业接入
多模态模型华为盘古稳定版

Pangu-AIKits-ImageSearch-Large-Tagging

2025年5月发布的版本,基于transformer结构,其中Large模型的参数量31M,模型推理使用固定的尺寸,推理速度快,兼具模型效果和推理性能。

输入价格

公开资料未说明

输出价格

公开资料未说明

图像搜索服装标签商品检索
多模态模型Writer稳定版

Palmyra X6

Palmyra X6 是 Writer 当前默认的 Agent 模型,面向长时程企业工作流、研究、内容生成和连接器驱动的多步骤任务。

输入价格

公开资料未说明

输出价格

公开资料未说明

企业 Agent长流程任务研究与运营
多模态模型Writer稳定版

Palmyra X5

Writer 当前最新旗舰多模态模型,支持 1M Tokens 上下文,并可在 chat completions 中直接混合文本和图片输入。

输入价格

公开资料未说明

输出价格

公开资料未说明

企业知识工作流长文档问答图文 Agent
多模态模型Writer即将下线

Palmyra Vision

Writer 旧版视觉模型,支持图像理解、描述和比较;官方已建议迁移到 Palmyra X5 + chat with images。

输入价格

公开资料未说明

输出价格

公开资料未说明

图像理解图像描述视觉问答
多模态模型Reka稳定版

Reka Edge 2

Reka Edge 2 是 Reka 当前官网列出的轻量多模态模型,面向低延迟文本、图像、视频和音频理解。

输入价格

公开资料未说明

输出价格

公开资料未说明

低延迟多模态理解成本敏感
多模态模型Reka稳定版

Reka Core

Superior capabilities for complex tasks

输入价格

公开资料未说明

输出价格

公开资料未说明

复杂任务多模态问答视频理解
多模态模型Reka稳定版

Reka Flash

Fast and cost-efficient model for most tasks

输入价格

公开资料未说明

输出价格

公开资料未说明

通用助手多模态聊天成本敏感
多模态模型InclusionAI稳定版

VISTA 4B

VISTA 4B 是 InclusionAI 于 2026 年 6 月发布的 GUI 定位视觉语言模型,可根据截图和指令输出点击坐标。

输入价格

公开资料未说明

输出价格

公开资料未说明

GUI Agent界面定位开放权重
多模态模型InclusionAI稳定版

VISTA 9B

VISTA 9B 是 InclusionAI 于 2026 年 6 月发布的 GUI 定位视觉语言模型,可根据截图和指令输出点击坐标。

输入价格

公开资料未说明

输出价格

公开资料未说明

GUI Agent界面定位开放权重
多模态模型智源 BAAI预览版

Orca 4B

Orca 4B 是 BAAI 于 2026 年 7 月发布的通用世界模型,围绕 Next-State Prediction 建模,用于理解和预测世界状态变化。

输入价格

公开资料未说明

输出价格

公开资料未说明

世界模型状态预测开放研究
多模态模型Liquid AI稳定版

LFM2.5 VL 1.6B Extract

LFM2.5 VL 1.6B Extract 是 Liquid AI 于 2026 年 5 月发布的视觉信息抽取模型。

输入价格

公开资料未说明

输出价格

公开资料未说明

视觉抽取文档理解端侧部署
多模态模型Liquid AI稳定版

LFM2.5-VL-1.6B

Best-in-class 1.6B vision-language model for multimodal understanding

输入价格

公开资料未说明

输出价格

公开资料未说明

图文理解视觉问答端侧多模态
多模态模型Liquid AI稳定版

LFM2.5-VL-450M

Compact 450M vision-language model with enhanced performance for edge deployment

输入价格

公开资料未说明

输出价格

公开资料未说明

图文理解视觉问答端侧多模态
多模态模型Liquid AI稳定版

LFM2-VL-3B

Highest-capacity 3B vision-language model with enhanced visual reasoning

输入价格

公开资料未说明

输出价格

公开资料未说明

图文理解视觉问答端侧多模态
多模态模型Liquid AI稳定版

LFM2-VL-1.6B

1.6B vision-language model (deprecated - use LFM2.5-VL-1.6B instead)

输入价格

公开资料未说明

输出价格

公开资料未说明

图文理解视觉问答端侧多模态