返回每日动态论文Meta 研究:AI 评审可被说服改判,70% 偏离真相X:Rohan Paul (@rohanpaul_ai)8月15日 08:117小时前导读Meta 新论文揭示 AI 评审系统的危险失败模式:被评审的 AI 可通过持续自适应说服,在 9 个前沿模型上翻转 62-91% 的评审判决。更严重的是,改判通常不是修正错误--70% 的成功翻转反而偏离了真实答案,对智能体监督体系构成实际威胁。