Google Research·· 2026-04-03AI 评分54
Google Research 提出评估 LLM 行为倾向对齐的框架,分析 25 个模型与人类共识的差距
Evaluating alignment of behavioral dispositions in LLMs
AI 导读
Google Research 发布评估 LLM 行为倾向对齐的研究,基于 IRI、ERQ 等标准化心理问卷生成情境判断测试(SJT),在职业沉着、冲突解决、订旅行等现实场景中比较模型与 550 名参与者的人类偏好分布。
来源:Google Research · research.google