跳到正文
The Zvi· Zvi Mowshowitz·· 20 天前精选AI 评分64

Anthropic 滥用报告揭示 AI 安全威胁与中美蒸馏战争

The Bad Guy With An AI Named Claude

AI 导读

Zvi Mowshowitz 解读 Anthropic 发布的 AI 滥用报告,披露 2025 年 12 月至 2026 年 8 月间阻止的七类恶意行为,包括网络攻击、影响力操作和模型蒸馏。报告特别指出中国实验室系统性蒸馏 Claude 的行为,涉及深度求索、月之暗面和小米等机构通过虚假账户转发用户查询。作者认为尽管存在威胁,但当前滥用规模仍属可控,同时警示蒸馏行为可能加剧中美 AI 竞争。

推荐理由

作者基于 Anthropic 滥用报告,分析了 AI 模型在安全领域的实际威胁格局与中美科技竞争态势。

来源:The Zvi · thezvi.substack.com