推理云全球完整度 A
Together AI
Together AI 同时强调推理服务和 GPU compute 底座,适合开放模型和工程化推理场景。
Serverless Inference / GPU 基础设施Serverless开放模型推理优先需咨询
适合场景
需要开放模型推理、Serverless GPU 和 GPU 集群支撑的团队。
类型
推理云
Serverless Inference / GPU 基础设施
区域
全球
全球多区 / 按区域与机房供给
起租
按调用或分钟级起
按调用量 / 按实例计费
价格
需咨询
常见按调用量、吞吐或实例规格计费,需和 GPU 直租分开看。
交付
API / 托管推理实例
在线推理 / API 服务
对象
2 类
个人 / 企业
用户
出海团队
暂无公开价格链接
选型摘要
算力类型
Serverless Inference / GPU 基础设施
区域范围
全球
适合对象
需要开放模型推理、Serverless GPU 和 GPU 集群支撑的团队。
部署与计费
公开卡型
L40S / A100 / H100/H200
计费方式
按调用量 / 按实例计费
最低起租
按调用或分钟级起
价格与交付
价格公开度
需咨询
交付方式
API / 托管推理实例
地域/机房口径
全球多区 / 按区域与机房供给
公开价格链接
暂无公开价格链接
常见按调用量、吞吐或实例规格计费,需和 GPU 直租分开看。
核心信息
栏目分类
推理云
源完整度
A
适合人群
个人 / 企业
用户类型
出海团队
支持项
支持容器 / 支持 API / 支持推理 / 支持多卡/集群
适合任务
在线推理 / API 服务 / 批量推理
官网
https://www.together.ai/
产品页
https://www.together.ai/inference?c8dae807_page=2
核验状态
verified
标签与能力
标签
推理云GPU 集群开放模型
亮点
Serverless开放模型推理优先
支持项
支持容器支持 API支持推理支持多卡/集群
用户类型
出海团队
适合任务
在线推理API 服务批量推理
网站入口
备注与提醒
应与 Baseten、Modal、Replicate 区分开来。