详细参数
模型定位
multimodal_generation
适合场景
图像 / 视频 / 音频生成
输入价格
公开资料未说明
输出价格
公开资料未说明
FLUX 3 是 Black Forest Labs 的多模态基础模型,统一学习图像、视频和音频,并支持图像生成编辑、视频生成与原生音频。
适合
图像 / 视频 / 音频生成
multimodal_generation
价格
公开资料未说明
1M Tokens
输入
文本 / 图像 / 视频 / 音频
可做实时交互
输出
图像 / 视频 / 音频
规格
上下文未说明
详细参数
模型定位
适合场景
输入价格
输出价格
能力与信息
文本主能力
推理
工具调用
结构化输出
训练与版本
微调
蒸馏
多模态扩展
视觉理解
语音输入
语音输出
实时交互
输入与输出
输入形式
输出形式
接入信息
知识截止
调用名
API 基础地址
调用协议
主接口
发布时间
价格与计费
计费摘要
输入价
输出价
缓存输入
币种
计费单位
单位类型
价格说明
原始价格文案
补充说明
发布时间
官方入口