工具介绍
功能:提供四个专门数据集(OEQ, AITA-YTA, SS, AITA-NTA-FLIP)测量 LLM 在情感验证、间接表达、框架接受和道德立场上的社会式谄媚行为,支持量化分析与模型对比。
特色:基于社会学面子理论,覆盖真实世界交互场景;开源可扩展,兼容主流 LLM;包含详细评估维度和实证数据,促进学术研究。
适用人群:AI 研究人员、模型开发者、伦理学学者、对 LLM 行为分析感兴趣的学生及企业技术团队。
价格说明:完全免费开源,代码托管于 GitHub,可自由下载、使用和贡献,无需任何费用。