AI工具箱

精选 3209+ 优质 AI 工具导航,一站直达

3209 在线工具 20 大分类
返回全部 AI开发平台× AI大模型评测×
PaLM 2

PaLM 2

Google发布全新大语言模型,参数量超3400亿。

免费增值
Cohere

Cohere

AI产品大语言模型平台构建指南

免费增值
MMBench

MMBench

MMBench是用于多模态大模型评测的平台,具有广泛模型覆盖和专业评估体系,为模型研发和选择提供支持。

免费增值
Elephant

Elephant

Elephant 是斯坦福 CRFM 开发的大型语言模型社会式谄媚基准测试工具,通过四个数据集系统评估模型在情感验证、间

免费
PhyX

PhyX

PhyX是首个通过真实视觉场景评估AI模型物理推理能力的大规模基准测试数据集,包含3000个多模态物理问题,覆盖力学、电

免费
Chatbox AI

Chatbox AI

开源的AI客户端助手,支持多种主流AI模型

免费增值
阿里巴巴M6

阿里巴巴M6

阿里巴巴达摩院发布超大型中文预训练模型M6。

免费增值
C-Eval

C-Eval

C-Eval是评估大模型能力的平台,提供多模型多科目测试结果,助您选模型与研究模型性能。

免费增值
OpenCompass

OpenCompass

OpenCompass是专业大模型评测平台,提供多维度评测和对比等功能,适用于研究机构和企业等。

免费增值
HELM

HELM

HELM是一款全面评估语言模型的工具,具有多维度评估等功能和全面专业等特色,应用于研究与企业场景。

免费增值
OpenBMB

OpenBMB

清华团队支持的大规模预训练语言模型库及相关工具介绍。

免费增值
SuperCLUE

SuperCLUE

SuperCLUE是中文通用大模型综合性测评基准,能多维度测试模型能力,为模型研发和选型提供参考。

免费增值
序列猴子

序列猴子

探索出门问问的超大规模语言模型,体验先进的AI技术。

免费增值
Codex

Codex

AI代码生成模型,由OpenAI开发,助力编程训练。

免费增值
MMLU

MMLU

MMLU助力大模型语言理解能力评测,提供全面精准评估。

免费增值
AG1-Eval

AG1-Eval

AG1-Eval是专业的AI大模型评测平台,提供权威榜单、支持人机评测、拥有多样评测集等。

免费增值
BLOOM

BLOOM

探索HuggingFace的大型语言模型(LLM)。

免费增值
LLaMA

LLaMA

Meta公司发布新型AI语言模型,引领技术革新。

免费增值
Replicate

Replicate

开源机器学习模型在线运行指南

免费增值
Evidently AI

Evidently AI

开源机器学习模型监测与测试工具

免费增值
H2O EvalGPT

H2O EvalGPT

H2O EvalGPT助力实现AI模型精准评估、对比与调优,提升模型可靠性与性能。

免费增值
StableLM

StableLM

开源大语言模型,由Stability AI推出,类似ChatGPT。

免费增值
StableVicuna

StableVicuna

开源聊天机器人,采用RLHF技术,实现大规模智能对话。

免费增值
LLMEval3

LLMEval3

LLMEval3是专注于AI大模型评测的工具,提供精准高效评测服务。

免费增值