跳到正文
Hacker News · AI· speckx·· 1 天前AI 评分49

The Sound of Silence: What Your AI Agent Does Not Tell You

The Sound of Silence: What Your AI Agent Does Not Tell You

AI 导读

AI 智能体在长对话中常忽略或违背用户设定的规则,导致回答看似完整实则错误或缺失。微软和 Salesforce 的研究显示,AI 模型在单次明确请求下的表现优于分散在多轮对话中的请求,错误率平均上升 39%。2026 年 3 月的一项基准测试表明,GPT-5 在第三次对话轮次中仅 41% 的回答完全符合要求,而 GPT-5.5 在类似测试中也仅达到相同水平。

来源:Hacker News · AI · albertoarena.it