MIT News · 人工智能· Adam Zewe | MIT News·· 2026-07-13AI 评分51
MIT 等机构提出新方法,无需生成即可检测模型是否被微调用于制作儿童性虐待材料
New method aims to keep kids safe from illegal AI-generated content
AI 导读
MIT、波士顿大学和儿童安全非营利组织 Thorn 的研究人员开发了一种名为高斯探测的新审计方法,无需生成图像即可检测模型是否被 LoRA 微调用于生成儿童性虐待材料。该方法通过分析模型内部表征的变化,在测试中识别有害模型变体的准确率达到 100%。
来源:MIT News · 人工智能 · news.mit.edu