跳到正文
Hugging Face · 每日论文·· 1 天前AI 评分52

基础模型可通过训练数据中的提示词实现推理

Base Models Can Reason By Taking a Cue From Training Data

AI 导读

研究发现,固定特定起始 token(如 ".\n\nOkay" 或 "Alright,")可显著提升基础模型在数学和编程任务上的表现,例如 Olmo-3-7B 的 MATH-500 准确率从 42% 提升至 78%,Qwen3-14B 从 72% 提升至 87%。

来源:Hugging Face · 每日论文 · huggingface.co