Flash News

AI创企创始人Austen Allred:永远别让模型给自己打分

Gauntlet AI创始人Austen Allred直言,“你永远不能信任一个AI模型来给自己的输出打分”,这一点在教育评卷、代码审查到代理对自身任务评估的实验中都被反复证伪。越来越多研究和实战经验表明,大模型在自评时会延续同一套偏差和幻觉,给出看似自洽却同样错误的“打分理由”,因此高风险场景下必须引入独立的人类或外部系统来交叉验证,而不能指望“模型自己纠错”。

来源:公开信息

AI

Source

·ABAB News
·
1 min read
·183d ago
分享: