MarkTechPost· Asif Razzaq·· 4 小时前AI 评分48
Sakana AI 的 LLM 同行评审系统能捕捉 73% 的核心主张错误
Sakana AI’s LLM Peer Review System Catches 73% of Core-Claim Errors
AI 导读
Sakana AI 的 MLR 系统在同行评审中检测出 73.43% 的核心主张错误,使用 Claude Sonnet 4 和 Haiku 3.5 模型,无需 GPU 和微调。该系统通过三个智能体进行多层评审,包含摘要、文献对比和三轮提示链分析,成本约 $0.47 每次评审。在真实撤稿论文中,其精确匹配率仅为 16.11%,仍易受隐藏提示注入影响。
来源:MarkTechPost · marktechpost.com