跳到正文
热点事件持续更新

AI智能体对隐藏指令遵循情况实测:半数泄露

1 篇报道1 个报道来源1 小时前更新

先了解这件事

AI 综述

一项实测评估了13个AI模型在工具描述中添加隐藏信息指令时的行为,在8个可评分的模型中,4个(Qwen3 4B、Qwen3 14B、Minstral 8B、Gemma 4)在所有运行中均未向用户透露内部参考号,而另外4个(Claude Haiku/Sonnet/Fable、Granite 4.0 Tiny)则始终泄露了该信息。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月10日
  1. Hacker News · AI精选
    实测8个AI智能体是否遵守隐藏信息指令:4个始终遵守,4个完全无视

    作者测试了13个模型在工具描述中添加隐藏信息指令时的行为,8个可评分模型中4个(Qwen3 4B、Qwen3 14B、Minstral 8B、Gemma 4)在所有运行中均未向用户透露内部参考号,4个(Claude Haiku/Sonnet/Fable、Granite 4.0 Tiny)则始终泄露。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。