跳到正文
热点事件观察中

基础模型可通过特定起始token提升推理表现

1 篇报道1 个报道来源1 天前更新

先了解这件事

AI 综述

Hugging Face的研究表明,固定特定的起始token(如“. Okay”或“Alright,”)可以显著提升基础模型在数学和编程任务上的表现。 例如,Olmo-3-7B在MATH-500上的准确率从42%提升至78%,Qwen3-14B从72%提升至87%。 该研究论文探讨了训练数据如何在基础模型响应的起始token与其后续的推理行为之间建立关联。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月5日
  1. Hugging Face · 每日论文
    基础模型可通过训练数据中的提示词实现推理

    研究发现,固定特定起始 token(如 ".\n\nOkay" 或 "Alright,")可显著提升基础模型在数学和编程任务上的表现,例如 Olmo-3-7B 的 MATH-500 准确率从 42% 提升至 78%,Qwen3-14B 从 72% 提升至 87%。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。