简介
FlagEval (天秤)大模型评测体系及开放平台,旨在建立科学、公正、开放的评测基准、方法、工具集,协助研究人员全方位评估基础模型及训练算法的性能,同时探索利用AI方法实现对主观评测的辅助,大幅提升评测的效率和客观性。
适合场景
FlagEval (天秤)大模型评测体系及开放平台,旨在建立科学、公正、开放的评测基准、方法、工具集,协助研究人员全方位评估基础模型及训练算法的性能,同时探索利用AI方法实现对主观评测的辅助,大幅提升评测的效率和客观性。
AI导航网 3805
FlagEval (天秤)大模型评测 - AI导航网官网
FlagEval
大模型评测
模型测评
亮点概览
亮点 1
AI模型平台
亮点 2
AI模型训练
亮点 3
API服务
亮点 4
AI大模型
亮点 5
模型评测
亮点 6
研究人员
产品信息
产品名称
分类
二级分类
中文友好度
商业场景
定价模式
标签与平台
标签
平台
语言
地区
继续浏览同类导航
Lightning
Lightning AI是一个用于构建和部署模型及全栈AI应用的开发框架,提供训练、服务和超参数优化等能力,帮助开发者减少基础设施配置工作。
petals
Petals 是一个开源协作框架,用于分布式运行和微调大型语言模型,如 BLOOM-176B,让用户只加载部分模型也能参与大模型推理。
AlibabaWood
AlibabaWood 是一款面向电商营销的视频生成工具,结合产品信息与 AI 自动生成以商品为核心的故事短视频,包括脚本、文案、配乐和多版本剪辑。
Inpainter
Inpainter是一款AI图像修复与补全工具,基于Stable Diffusion模型和Replicate API,用于生成或填补图像缺失区域,并提供API与GitHub相关资源。
Gpux
GPUX.AI 提供面向 GPU 计算任务的资源服务,支持在 Docker 容器中运行各类 GPU 应用,并具备自动扩缩容推理能力。
RunPod
RunPod 是一个面向 AI 与高性能计算场景的 GPU 云服务,提供按需租用、无服务器 GPU 计算、托管 AI 端点和 Jupyter Notebook 等能力。
