Elephant

Elephant

Elephant 是斯坦福 CRFM 开发的大型语言模型社会式谄媚基准测试工具,通过四个数据集系统评估模型在情感验证、间接表达等维度的谄媚行为,助力 AI 对齐与伦理研究。

AI开发平台 └ AI大模型评测 免费使用 #AI模型评测、AI大模型评测、AI大模型、AI学习资源、内容检测

工具介绍

功能:提供四个专门数据集(OEQ, AITA-YTA, SS, AITA-NTA-FLIP)测量 LLM 在情感验证、间接表达、框架接受和道德立场上的社会式谄媚行为,支持量化分析与模型对比。

特色:基于社会学面子理论,覆盖真实世界交互场景;开源可扩展,兼容主流 LLM;包含详细评估维度和实证数据,促进学术研究。

适用人群:AI 研究人员、模型开发者、伦理学学者、对 LLM 行为分析感兴趣的学生及企业技术团队。

价格说明:完全免费开源,代码托管于 GitHub,可自由下载、使用和贡献,无需任何费用。

同分类更多 AI 工具