跳到正文
Hugging Face · 每日论文·· 3 天前AI 评分45

通过递归自重写扩展复杂任务轨迹:Qwen-3.8-27B 框架实现

Scaling Trajectories for Complex Tasks through Recursive Self-Rewrite

AI 导读

递归自重写(RSR)框架使用 Qwen-3.8-27B 通过多样化的任务轨迹生成更丰富的训练数据,三类任务轨迹联合解决了 759 个终端任务,比最强单轨迹提升 34.3%。

来源:Hugging Face · 每日论文 · huggingface.co