Fara1.5-4B
Fara1.5-4B 是 Microsoft Research AI Frontiers 发布的浏览器 Computer Use Agent,通过截图理解网页并输出结构化点击、输入、滚动等动作。
输入价格
公开资料未说明
输出价格
公开资料未说明
官方模型目录与价格对比
按模型类型、上下文、价格和厂商整理官方模型目录,方便你快速筛出适合写代码、做推理、跑视觉或搭 Agent 的那一批模型。
先缩小候选,再进详情页看接口、计费和能力边界。
已收录模型
1,303
覆盖厂商
63
带价格信息
355
Fara1.5-4B 是 Microsoft Research AI Frontiers 发布的浏览器 Computer Use Agent,通过截图理解网页并输出结构化点击、输入、滚动等动作。
输入价格
公开资料未说明
输出价格
公开资料未说明
Fara1.5-9B 是 Microsoft Research AI Frontiers 发布的浏览器 Computer Use Agent,通过截图理解网页并输出结构化点击、输入、滚动等动作。
输入价格
公开资料未说明
输出价格
公开资料未说明
Fara1.5-27B 是 Microsoft Research AI Frontiers 发布的浏览器 Computer Use Agent,通过截图理解网页并输出结构化点击、输入、滚动等动作。
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
计费价格
公开资料未说明
生成形式
text_to_video / image_to_video / keyframe_video
Pika 当前公开的 Turbo 视频型号,主要用于 Pikascenes、Pikadditions、Pikaswaps 与 Pikatwists 等高性价比工作流。
计费价格
公开资料未说明
生成形式
scene_video / addition_video / swap_video / twist_video
计费价格
公开资料未说明
生成形式
addition_video / swap_video / twist_video / template_video
计费价格
公开资料未说明
生成形式
performance_video
PP-OCRv6 是 PaddlePaddle 于 2026 年 6 月发布的新一代开源 OCR 模型线,覆盖文字检测与识别,适合中文文档处理和本地部署。
输入价格
公开资料未说明
输出价格
公开资料未说明
HPD-Parsing 是 PaddlePaddle 于 2026 年 7 月公开的文档解析模型,面向复杂版面、表格和视觉文档结构化提取。
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
2025年4月发布的版本,图生视频支持16:9、9:16、1:1、4:3、3:4、原始比例等6种长宽比,时长5s的视频生成,视频续写支持16:9、9:16、1:1、4:3、3:4、原始比例等6种长宽比,续写96帧(24帧率的视频续写约4s),需要8个推理单元部署。
计费价格
公开资料未说明
生成形式
image_to_video / video_to_video
计费价格
公开资料未说明
生成形式
text_to_image
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
目标跟踪。盘古计算机视觉目标跟踪大模型,盘古计算机视觉目标跟踪大模型,在视频中对感兴趣物体进行检测、提取、识别和跟踪,从而获得目标物体的相关参数。
输入价格
公开资料未说明
输出价格
公开资料未说明
万物检测。盘古计算机视觉万物检测大模型,能够识别和定位已知类别对象,同时也能处理未知类别对象的模型。具备对未知类别的泛化能力,并在面对新类别时能够做出合理的响应。
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明
输入价格
公开资料未说明
输出价格
公开资料未说明