跳到正文
MarkTechPost· Asif Razzaq·· 4 小时前AI 评分48

Sakana AI 的 LLM 同行评审系统能捕捉 73% 的核心主张错误

Sakana AI’s LLM Peer Review System Catches 73% of Core-Claim Errors

AI 导读

Sakana AI 的 MLR 系统在同行评审中检测出 73.43% 的核心主张错误,使用 Claude Sonnet 4 和 Haiku 3.5 模型,无需 GPU 和微调。该系统通过三个智能体进行多层评审,包含摘要、文献对比和三轮提示链分析,成本约 $0.47 每次评审。在真实撤稿论文中,其精确匹配率仅为 16.11%,仍易受隐藏提示注入影响。

来源:MarkTechPost · marktechpost.com