AI工具箱
精选 3209+ 优质 AI 工具导航,一站直达
PaLM 2
Google发布全新大语言模型,参数量超3400亿。
免费增值
Cohere
AI产品大语言模型平台构建指南
免费增值
MMBench
MMBench是用于多模态大模型评测的平台,具有广泛模型覆盖和专业评估体系,为模型研发和选择提供支持。
免费增值Elephant
Elephant 是斯坦福 CRFM 开发的大型语言模型社会式谄媚基准测试工具,通过四个数据集系统评估模型在情感验证、间
免费PhyX
PhyX是首个通过真实视觉场景评估AI模型物理推理能力的大规模基准测试数据集,包含3000个多模态物理问题,覆盖力学、电
免费
Chatbox AI
开源的AI客户端助手,支持多种主流AI模型
免费增值
阿里巴巴M6
阿里巴巴达摩院发布超大型中文预训练模型M6。
免费增值
C-Eval
C-Eval是评估大模型能力的平台,提供多模型多科目测试结果,助您选模型与研究模型性能。
免费增值
OpenCompass
OpenCompass是专业大模型评测平台,提供多维度评测和对比等功能,适用于研究机构和企业等。
免费增值
HELM
HELM是一款全面评估语言模型的工具,具有多维度评估等功能和全面专业等特色,应用于研究与企业场景。
免费增值
OpenBMB
清华团队支持的大规模预训练语言模型库及相关工具介绍。
免费增值
SuperCLUE
SuperCLUE是中文通用大模型综合性测评基准,能多维度测试模型能力,为模型研发和选型提供参考。
免费增值
序列猴子
探索出门问问的超大规模语言模型,体验先进的AI技术。
免费增值
Codex
AI代码生成模型,由OpenAI开发,助力编程训练。
免费增值
MMLU
MMLU助力大模型语言理解能力评测,提供全面精准评估。
免费增值
AG1-Eval
AG1-Eval是专业的AI大模型评测平台,提供权威榜单、支持人机评测、拥有多样评测集等。
免费增值
BLOOM
探索HuggingFace的大型语言模型(LLM)。
免费增值
LLaMA
Meta公司发布新型AI语言模型,引领技术革新。
免费增值
Replicate
开源机器学习模型在线运行指南
免费增值
Evidently AI
开源机器学习模型监测与测试工具
免费增值
H2O EvalGPT
H2O EvalGPT助力实现AI模型精准评估、对比与调优,提升模型可靠性与性能。
免费增值
StableLM
开源大语言模型,由Stability AI推出,类似ChatGPT。
免费增值
StableVicuna
开源聊天机器人,采用RLHF技术,实现大规模智能对话。
免费增值
LLMEval3
LLMEval3是专注于AI大模型评测的工具,提供精准高效评测服务。
免费增值