开源中国·2026-09-30 18:23· 5 天前精选AI 评分63Anthropic 红队评估 GLM-5.3 的网络安全能力Anthropic 红队盯上 GLM-5.3:能力追平 Mythos,却连拒绝护栏都是摆设AI 导读Anthropic 的前沿红色团队评估了智谱的 GLM-5.3,认为其是首个能像 Claude Mythos Preview 那样自主构建端到端漏洞利用,但缺乏足够安全护栏的模型。来源:开源中国 · oschina.netAnthropic / Claude安全对齐论文研究评测基准#论文/研究#安全/对齐#评测/基准#Anthropic