跳到正文
今天10月5日周一1 条
10月3日周六
9月30日周三
  1. Hacker News · AI 高赞33

    The AI Race Just Got Awkward 中文标题

    西方实验室近期在模型推理优化方面大量采用中国实验室的技术,如 DeepSeek 的 KV 缓存优化方案使每 token 的缓存占用降至 890 字节。Claude Opus 5.5 和 GPT-6.1 Sol 的缓存读取成本分别比前代下降 60% 和 80%。这两款模型均未提前大量宣传,但用户反馈显示其性能接近旗舰版本 Claude Fable 5.1 和 GPT-6 Astra。

7月22日周三
  1. Interconnects43

    开源模型回顾:Kimi K3、Qwen 3.8、Xi 的 WAIC 演讲、知识蒸馏、开源与闭源差距及未来展望

    Kimi K3 和 Qwen 3.8 等中国开源模型近期发布,显示出在性能和应用上的快速进步。Qwen 宣布其下一版本将开放权重,这在开源模型领域是一大变化。开源模型与闭源模型在前沿任务上的差距常被不同基准测试放大,但实际应用中仍具潜力,尤其在软件工程等细分领域。

7月13日周一
  1. Interconnects45

    开源模型面临6个月生存期挑战

    开源大语言模型可能在未来6个月内面临被禁或无限期延迟的风险,若其能力达到GPT 5.5、Claude Opus 4.8或GLM-5.2水平。目前中国开源模型如DeepSeek在能力上领先其他开源模型,但尚未发布公开版本。Anthropic推动的政策讨论正将开源模型与安全、技术竞争等议题捆绑,其主张可能影响美国市场对开源模型的监管方向。

6月29日周一
12月30日周二
  1. Ahead of AI34

    2025 年大语言模型发展现状:推理能力、RLVR 和 GRPO 的突破

    2025 年大语言模型领域持续发展,推理模型成为主流,DeepSeek R1 作为开源模型表现出与顶级闭源模型相当的性能,并引入 RLVR 和 GRPO 算法降低训练成本。训练 DeepSeek R1 的成本估计为 294,000 美元,远低于此前预期,但该数字仅涵盖计算资源费用,未包含研究人员薪资等其他成本。各大模型开发者均推出了基于推理的模型变体,推动了模型能力的扩展与优化。

11月4日周二