跳到正文
原文
MarkTechPost· Asif Razzaq·· 8 小时前AI 评分50

Sakana AI 推出 MLR 系统,LLM 同行评审捕获 73% 核心声明错误

Sakana AI’s LLM Peer Review System Catches 73% of Core-Claim Errors

AI 导读

Sakana AI 发布 Multi-Layered Review (MLR) 系统,在 Contradiction Benchmark 中捕获 73.43% 的核心声明错误,远超最佳基线 AgentReview 的 14.81%。该系统基于 Claude Sonnet 4 和 Haiku 3.5 构建,无需微调,单次评审成本约 $0.47,但在真实撤稿论文上的精确匹配率仅为 16.11%。

来源:MarkTechPost · marktechpost.com