跳到正文
10月4日周日
  1. 钛媒体59

    钛媒体分析:为何中国等不来Muse,以及国内大厂的Agent围墙战

    作者认为,Meta的Muse在美国的成功基于开放的网页生态,而中国互联网服务高度集中在封闭的App内,导致跨平台Agent难以实现。文章分析了字节、腾讯、阿里在Agent领域的布局,指出它们各自受限于自家生态,形成了‘围墙’。同时探讨了豆包手机、华为小艺、阶跃星辰等试图通过系统权限或中立协议破局的路径,并预测了B端、硬件和监管三条可能的破局钥匙。

    推荐理由:作者基于中美互联网生态差异,分析了Muse模式在中国面临的围墙困境,并梳理了国内大厂各自的应对策略与潜在破局路径。

10月3日周六
  1. 钛媒体44

    AI正在造AI

    AI正从辅助工具演变为“创造工具的工具”,进入递归式自我改进(RSI)阶段。OpenAI成立了RSI团队,目标是到2028年3月前实现完全自动化的AI研究员,让AI自主生成和审计训练数据。在代码层面,AI编程工具渗透率已达85%,Anthropic工程师70%到90%的代码由AI辅助完成,而个人用户也能通过自然语言描述快速生成完整应用,参与“AI造AI”的循环。

10月1日周四
9月23日周三
9月21日周一
  1. Interconnects61

    中美开放权重模型竞争格局分析

    Nathan Lambert基于对Hugging Face下载量、OpenRouter使用数据、arXiv论文引用等多源指标的分析,指出中国开放权重模型自2025年起在下载量、使用率和学术引用上全面领先美国,尤其在编码、推理等任务上表现突出。

    推荐理由:原文通过多维度数据对比,揭示了中美在开放权重模型领域的竞争格局变化,为理解当前AI生态演进提供了关键视角。

9月18日周五
8月17日周一
8月15日周六
  1. The Pragmatic Engineer35

    The Pulse: Meta 的“离职潮”失控

    Meta 触发的“离职潮”持续扩大,未被裁员或调岗的工程师纷纷另谋高就,公司试图通过高额股权激励挽留,但效果不佳。Cursor 团队发布了一款通用 AI 工具,提供类似 Codex 的知识工作自动化体验,用户反馈积极,预计更多 AI 厂商将跟进。本周 The Pulse 发布延迟一天,因作者家庭新增宠物狗,影响了工作节奏。

8月4日周二
  1. Replit 博客50

    AI 采用始于可信数据:Replit 构建语义层与运营真值层

    Replit 认为企业 AI 采用的核心障碍是信任问题,并于 2025 年底开始构建用于定义数据含义和修正的记录系统。该运营真值层是一个版本可控、经过人工审核、与模型无关的定义与修正知识库,旨在让每个处理数据的智能体都从相同的业务理解起点出发。Anthropic、OpenAI 和 Meta 也各自通过其智能体架构、内部数据智能体和分析智能体,在构建经过验证的知识层这一方向上呈现出行业共识。

7月13日周一
6月29日周一
12月30日周二
  1. Ahead of AI34

    2025 年大语言模型发展现状:推理能力、RLVR 和 GRPO 的突破

    2025 年大语言模型领域持续发展,推理模型成为主流,DeepSeek R1 作为开源模型表现出与顶级闭源模型相当的性能,并引入 RLVR 和 GRPO 算法降低训练成本。训练 DeepSeek R1 的成本估计为 294,000 美元,远低于此前预期,但该数字仅涵盖计算资源费用,未包含研究人员薪资等其他成本。各大模型开发者均推出了基于推理的模型变体,推动了模型能力的扩展与优化。