跳到正文
Towards Data Science· Gal Arav·· 1 天前AI 评分45

Google 团队测量了我论点的一半,另一半仍待验证

A Google Team Measured Half of My Argument, and Left the Other Half Open

AI 导读

Google 团队在论文中验证了基于合同的测试生成能提升 9.8 个百分点的缺陷检测率,但合同内容是从代码中提取的,未实现独立验证。该方法通过让 AI 模型先推理代码并记录其合同(前提、后置条件和未定义行为),再生成测试用例,但合同仍依赖代码实现,无法独立判断正确行为。论文未测试隐藏验收标准是否能比完整代码可见的测试套件发现更多真实缺陷。

来源:Towards Data Science · towardsdatascience.com