Token导航 LogoToken导航TokenDH.com
AI模型平台模型训练有 API

FlagEval

AI导航详情页

FlagEval(天秤)是北京智源人工智能研究院(BAAI)推出的科学、公正、开放的大模型评测体系及开放平台,为研究人员提供全面评估基础模型及训练算法性能的工具和方法。FlagEval采用“能力-任务-指标”三维评测框架,从多个维度对大模型的认知能力进行评估,涵盖对话、问答、情感分析等多种应用场景,提供超过22个数据集和8万道评测题目。

官网域名

flageval.baai.ac.cn

平台

Web / API

定价

未标注

最后核验

2026-05-16

免费版:否API:是开源:否需登录:否需邀请:否

简介

FlagEval(天秤)是北京智源人工智能研究院(BAAI)推出的科学、公正、开放的大模型评测体系及开放平台,为研究人员提供全面评估基础模型及训练算法性能的工具和方法。FlagEval采用“能力-任务-指标”三维评测框架,从多个维度对大模型的认知能力进行评估,涵盖对话、问答、情感分析等多种应用场景,提供超过22个数据集和8万道评测题目。

适合场景

01

FlagEval(天秤)是北京智源人工智能研究院(BAAI)推出的科学、公正、开放的大模型评测体系及开放平台,为研究人员提供全面评估基础模型及训练算法性能的工具和方法。FlagEval采用“能力-任务-指标”三维评测框架,从多个维度对大模型的认知能力进行评估,涵盖对话、问答、情感分析等多种应用场景,提供超过22个数据集和8万道评测题目。

02

flageval

03

FlagEval - AI工具介绍 | NaviAI

04

AI工具导航

05

AI工具集

06

人工智能工具

亮点概览

亮点 1

AI模型平台

亮点 2

AI模型训练

亮点 3

ChatGPT

亮点 4

Midjourney

亮点 5

AI聊天机器人

亮点 6

3D建模

产品信息

产品名称

FlagEval

分类

AI模型平台

二级分类

模型训练

中文友好度

中文友好

商业场景

platform

定价模式

未标注

标签与平台

标签

AI模型平台AI模型训练ChatGPTMidjourneyAI聊天机器人3D建模API服务AI大模型模型评测研究人员

平台

Web / API

语言

中文

地区

中国

产品截图

FlagEval 截图

继续浏览同类导航