Cerebras Cloud
服务类型
专用训练云 / 高速推理云
适合场景
需要专用训练云、差异化芯片架构和高速推理云的团队。
完整度
A
公开卡型
Cerebras 专用加速器 / 高速推理集群
计费与起租
按调用量 / 项目制
按调用或分钟级起
API / 托管推理实例 · 在线推理 / API 服务
AI 算力服务商与 GPU 云平台名单
收录国内外 AI 算力相关服务商,覆盖公有云 GPU、自助 GPU、智算平台、推理云、科研超算和算力基础设施。
先按业务形态筛,再决定是挑租卡平台、推理平台,还是企业智算与基础设施。
已收录服务商
79
有公开价格
38
国内平台
40
服务类型
专用训练云 / 高速推理云
适合场景
需要专用训练云、差异化芯片架构和高速推理云的团队。
完整度
A
公开卡型
Cerebras 专用加速器 / 高速推理集群
计费与起租
按调用量 / 项目制
按调用或分钟级起
API / 托管推理实例 · 在线推理 / API 服务
服务类型
低延迟推理云
适合场景
需要低延迟推理云和非通用 GPU 路线推理能力的团队。
完整度
B
公开卡型
Groq LPU / 专用推理加速器
计费与起租
按调用量 / 按配额/套餐
按调用或分钟级起
API / 托管推理实例 · 在线推理 / API 服务
服务类型
Serverless Inference / GPU 基础设施
适合场景
需要开放模型推理、Serverless GPU 和 GPU 集群支撑的团队。
完整度
A
公开卡型
L40S / A100 / H100/H200
计费与起租
按调用量 / 按实例计费
按调用或分钟级起
API / 托管推理实例 · 在线推理 / API 服务
服务类型
Dedicated Inference / 模型服务平台
适合场景
需要生产级专用推理部署和跨云自动扩缩容的团队。
完整度
A
公开卡型
L4/L40S / A100 / H100
计费与起租
按实例计费 / 合同计费
按调用或分钟级起
API / 托管推理实例 · 在线推理 / API 服务
服务类型
Serverless GPU / AI 运行时平台
适合场景
需要 Serverless GPU、Python 运行时和工程化 AI 工作负载平台的团队。
完整度
A
公开卡型
T4/L4 / A10/A100 / H100
计费与起租
按秒/分钟计费 / 按调用量
分钟级起
API / 托管推理实例 · 在线推理 / API 服务
服务类型
模型运行平台 / GPU 托管推理
适合场景
需要快速调用模型、按次运行和托管推理能力的团队。
完整度
A
公开卡型
T4/L40S / A100 / H100
计费与起租
按调用量 / 按运行时长
按调用起
API / 托管推理实例 · 在线推理 / API 服务
服务类型
分布式 GPU / 推理云
适合场景
需要分布式算力和推理云能力的团队。
完整度
C
公开卡型
RTX 4090 / A100/H100 / 分布式 GPU 池
计费与起租
按调用量 / 按实例计费
按调用或分钟级起
API / 分布式 GPU 池 · 在线推理 / 边缘推理
服务类型
AI 原生推理云 / GPU 基础设施
适合场景
需要专注推理云、Dedicated GPU 和 AI 原生交付的团队。
完整度
A
公开卡型
L40S / A100 / H100/H200
计费与起租
按调用量 / 按实例计费
按调用或分钟级起
API / 托管推理实例 · 在线推理 / API 服务
服务类型
GPU Cloud / GPU API
适合场景
需要 GPU API、Bare Metal 和 API 型算力平台的团队。
完整度
B
公开卡型
L40S / A100 / H100/H200
计费与起租
按 API 调用 / 按实例计费
按调用或分钟级起
API / 托管推理实例 · 在线推理 / API 服务
服务类型
AI API / 推理云 / 自建 AI 云底座
适合场景
需要推理云和企业自建 AI 云底座路线的团队。
完整度
B
公开卡型
SambaNova 专用加速器 / 推理节点 / 企业集群
计费与起租
按调用量 / 套餐/项目制
按调用或分钟级起
API / 托管推理实例 · 在线推理 / API 服务