AI READING NOTE
论文提出“图灵实验”(Turing Experiment),要求语言模型模拟具有代表性的人类被试样本,而不只是模仿某个个体。作者用最后通牒博弈、花园路径句、米尔格拉姆服从实验和群体智慧四类任务比较不同模型。较新的模型复现了前三项经典结果,但在群体智慧任务中出现“过度准确”偏差,说明群体层面的相似性检验也应系统识别模型特有的行为扭曲。
站内已收录 1 篇相关论文。你可以继续按方法和解读深度缩小范围。
题目 · 作者 · 年份 · 发表来源 · 原始摘要 · AI导读
论文提出“图灵实验”(Turing Experiment),要求语言模型模拟具有代表性的人类被试样本,而不只是模仿某个个体。作者用最后通牒博弈、花园路径句、米尔格拉姆服从实验和群体智慧四类任务比较不同模型。较新的模型复现了前三项经典结果,但在群体智慧任务中出现“过度准确”偏差,说明群体层面的相似性检验也应系统识别模型特有的行为扭曲。