该项目对 3225 个 LLM 模型进行测试,分析它们在判断作者年龄时的自信程度与准确性,揭示了大模型在社会属性判断上的系统性偏差。
▲2
为什么值得关注
访问 Hacker News 页面 →
揭示了大模型在社会认知任务中的“自信错误”现象,为 AI 伦理与可信度评估提供了重要实证依据,引发对模型偏见的深度反思。
手机端点「分享」直达微信/朋友圈/小红书;桌面端用「复制文案」后到 App 内粘贴发布
揭示了大模型在社会认知任务中的“自信错误”现象,为 AI 伦理与可信度评估提供了重要实证依据,引发对模型偏见的深度反思。