跳到正文
Towards Data Science· Utkarsh Mangal·· 18 小时前AI 评分51

逆转诅咒:为何语言模型知道‘A是B’却无法回答‘B是A’

The Reversal Curse: Why a Language Model That Knows “A Is B” Can’t Tell You “B Is A”

AI 导读

本文探讨了语言模型中的‘逆转诅咒’现象,即模型在单向训练后无法回答反向事实问题。作者用仅 60 行 NumPy 代码构建的极简模型复现了该现象,其反向准确率为 0%,而正向为 100%。实验表明,问题根源在于训练目标仅更新‘主语’词的嵌入,导致‘宾语’词的嵌入从未被训练,从而无法支持反向推理。

来源:Towards Data Science · towardsdatascience.com