跳到正文
原文
Google Research·· 2026-04-03精选AI 评分62

Google Research 提出评估 LLM 行为倾向对齐的框架

Evaluating alignment of behavioral dispositions in LLMs

AI 导读

Google Research 发布论文《Evaluating alignment of behavioral dispositions in LLMs》,提出一个基于心理学问卷和情境判断测试的框架,评估25个LLM在现实场景中的行为倾向与人类共识的对齐程度。

推荐理由

原文用25个LLM的实测数据展示了模型行为与人类共识之间的两类差距,读者可据此理解当前对齐评估的局限。

来源:Google Research · research.google