跳到正文
9月30日周三
  1. Cloudflare · AI31

    Cloudflare AI Gateway 的 User Insights 新增模型过度使用识别功能

    Cloudflare AI Gateway 的 User Insights 功能新增了识别模型过度使用的视图,帮助团队发现任务所需能力低于所选模型的情况。该功能可关联用户、智能体、应用程序及任务类别(如编码、研究、总结),并支持成本、延迟和对话轮次分析。这些洞察同时支撑了新推出的“潜在节省”视图和公开测试版 Auto Router,所有功能对 AI Gateway 用户免费开放。

  2. Cloudflare · AI65

    Cloudflare AI Gateway 推出 Auto Router 公开测试版以降低 AI 成本

    Cloudflare 在 AI Gateway 中发布 Auto Router 公开测试版,通过自动将请求路由到性价比更高的模型来帮助组织降低 AI 成本。内部测试显示,相比仅使用 OpenAI Sol 和 Anthropic Claude Opus 等前沿模型,Auto Router 可节省高达 30% 的成本。

    推荐理由:Cloudflare 通过其 AI Gateway 推出自动路由功能,旨在为组织在内部部署 AI 时提供成本控制方案。

  3. Cloudflare · AI55

    Cloudflare 推出 Pay Per Use 测试版,为 AI 使用内容付费

    Cloudflare 推出 Pay Per Use 测试版,允许内容发布者向已识别的 AI 公司授权内容,并根据实际使用情况(如被 AI 搜索引用、智能体报告引用)获得报酬。AI 公司定义付费用途和价格,发布者选择接受哪些报价,Cloudflare 负责处理注册、使用记录、计费和支付。该机制旨在为 AI 驱动的网络构建一个经济层,让内容在被他人产品使用时也能产生可持续收入。

    推荐理由:原文详细描述了新机制的运作流程和商业逻辑,为内容创作者和AI公司提供了一种新的合作框架参考。

  4. Cloudflare · AI62

    Cloudflare 发布 Monetization Gateway 测试版,支持 AI 智能体按需付费

    Cloudflare 发布 Monetization Gateway 测试版,允许网站、API、MCP 工具或数据集的拥有者向访问的 AI 智能体按次收费。该网关使用 HTTP 402 状态码,通过 Base 区块链上的 USDC 稳定币进行支付结算,无需重定向到结账页面或调用单独的支付 API。

    推荐理由:原文展示了如何通过 HTTP 402 状态码和稳定币支付,让网站、API 和 MCP 工具直接向 AI 智能体收费,并给出了四个实际用例。

  5. Cloudflare · AI37

    Cloudflare Registrar 简化面向用户与 AI 智能体的域名服务体验

    Cloudflare Registrar 全面更新了域名搜索与购买体验,并增强了对 AI 智能体的支持。新的搜索界面实时显示所支持的 420+ 后缀的精确结果,并可通过 API、MCP 及新推出的 cf CLI 让 AI 智能体直接搜索、注册或转移域名。该服务旨在为用户和智能体提供同样自然、简洁的交互体验。

  6. Cloudflare · AI63

    Cloudflare 发布应对 AI 智能体流量的系列产品与工具

    Cloudflare 发布一系列产品与工具,帮助网站应对 AI 智能体流量超过人类流量带来的挑战。超过一半的互联网流量已非人类,导致网站收入下降而成本上升。Cloudflare 推出了 AI Crawl Control、Web Bot Auth、Disallow AI Training 等工具,让网站能识别、区分并控制不同 AI 流量。

    推荐理由:原文详细阐述了非人类流量成为主流后网站面临的收入困境,并给出了 Cloudflare 提供的身份验证、流量控制和付费结算等具体解决方案。

  7. Cloudflare · AI65

    Cloudflare Containers 重构以支持可扩展的智能体沙盒

    Cloudflare 宣布重构其 Containers 服务,以更好地支持 AI 智能体工作负载。主要更新包括引入新的 durable_object 调度策略,允许在运行时选择沙盒镜像和实例类型,使容器启动速度提升 6 倍以上,并新增了文件系统快照功能。这些改进旨在让智能体能够按需创建、暂停和恢复工作空间,满足编码助手、评估和强化学习等场景的需求。

    推荐理由:Cloudflare Containers 针对 AI 智能体工作负载进行了架构重构,提供了更快的启动速度和运行时配置能力。

  8. KDnuggets30

    Ollama 用于管理本地语言模型:KDnuggets 快速参考指南

    Ollama 提供了一条命令即可运行本地语言模型,并通过 HTTP 服务器提供 OpenAI 风格的端点。摘要显示,模型是否适合当前硬件内存是关键问题,且上下文长度可能与预期不符。此外,Ollama 支持通过 JSON schema 约束结构化输出,并兼容 OpenAI 的 /v1 接口,方便客户端切换至本地运行。

  9. InfoQ · AI/ML38

    Patrick Debois 演讲:Context is the New Code

    Patrick Debois 提出“上下文即代码”的理念,认为在 AI 智能体时代,为模型准备的上下文(如 CLAUDE.md、AGENTS.md、库文档、产品需求文档)已成为类似代码的核心制品。这催生了“上下文开发生命周期”,包含生成、评估、分发和观察改进四个环节,并可通过 MCP 等工具从 Slack 等渠道自动获取上下文。

  10. Neo4j 博客15

    如何设置并兑换 Neo4j 初创企业计划信用额度

    接受 Neo4j 初创企业计划后,需通过 Aura Console 创建账户、获取组织 ID、添加支付方式并提交确认邮件以激活信用额度。信用额度在提交组织 ID 后开始计算 12 个月有效期,未激活前不会过期。若公司名称变更或多人申请,需联系 startups@neo4j.com 处理以避免账单混淆。

  11. 雷锋网40

    华为 NPO 光引擎 Hi-ONE 如何支撑 4096 卡昇腾 960 超节点?

    华为自研光引擎 Hi-ONE 以 NPO 形式部署于 4096 卡昇腾 960 超节点,用 5500 颗替代 4.8 万颗 800G 可插拔光模块,单颗带宽达 7.2T。该方案将高速电连接压缩至约 5 厘米,并在跨柜灵衢互联设备上实现单机约 280T 全光互联带宽。文章同时探讨了其内置共享光源设计及 7.2T 带宽系统使用方式等未公开技术细节。

  12. AWS · AI 博客32

    Amazon Bedrock 引入 Anthropic 模型支持首尔和新加坡区域推理

    Amazon Bedrock 现在支持在首尔和新加坡区域使用 Anthropic 的 Claude Opus 5 和 Claude Sonnet 5 进行本地推理,输入和输出数据全程保留在指定区域。用户可通过 Amazon Bedrock 控制台或 API 调用模型,无需额外配置即可测试不同模型变体。该功能适用于需满足数据本地化要求的金融、医疗及公共部门应用。

  13. 爱范儿72

    OpenAI 发布 GPT-6.1 Sol 与智能体助理 dots

    OpenAI 在 DevDay 2026 上发布 GPT-6.1 Sol 模型,以五分之一价格实现接近 Astra 的性能,同时推出 24 小时在线的智能体助理 dots,支持操作 4000 个应用并具备权限控制,ChatGPT Space 实现协作编辑功能,Pro 会员额度减半但新增 Pro 500 高端套餐支持 UltraFast 模式。

    推荐理由:原文给出了新模型、智能体功能和套餐额度调整的完整信息,读者可据此评估其对企业工作流的影响。

  14. 极客公园68

    OpenAI 发布 ChatGPT 新功能与会员体系调整

    OpenAI 在开发者大会上发布多项更新,包括由 GPT-6 Astra 驱动的 dots 智能体、Pro 500 新会员档位、Astra Ultrafast 加速模式及 ChatGPT 应用生态扩展,同时调整会员用量规则,将计价方式从对话次数转向工作量,支持在 Slack、Teams 和第三方应用中协作,企业用户可使用额度购买 Adobe、Figma 等软件。

    推荐理由:OpenAI 将 ChatGPT 从聊天工具转向工作平台,通过 dots 智能体、会员分档和应用生态重构使用场景,读者可据此理解其商业化路径的转变。

  15. CNET · AI67

    OpenAI DevDay 发布 GPT-6.1 Sol、Dots 智能体并调整订阅计划

    OpenAI 在年度开发者大会上宣布了多项产品更新。推出了名为 Dots 的新型 AI 智能体,由 GPT-6 Astra 驱动,面向 Pro、Business Premium 和企业订阅者。

    推荐理由:原文详细列出了新模型、新智能体、新协作空间和订阅计划调整,读者可以据此判断 OpenAI 最新的产品布局和定价策略变化。

  16. Replit 博客77

    Replit Agent 发布支持模型自主决策的新功能

    Replit Agent 发布新功能,允许 GPT-6 Astra 等模型在任务执行中自主决定子代理层级、努力程度和复用策略,实现动态 delegation。在 DeepSWE 和 Terminal-Bench 基准上,该架构在成本与性能上均优于 Astra 单独运行及侧边工架构,且无需修改提示或框架。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

9月29日周二
  1. The Pragmatic Engineer47

    Why has Shopify dropped React Native?

    Shopify宣布放弃React Native,转向原生移动开发,原因是AI智能体在代码生成能力上的显著提升,使其不再满足于React Native的抽象层。Shopify在12周内完成了Shop应用的原生重构,表明原生开发效率已大幅提高。Kotlin Multiplatform作为跨平台技术,允许在iOS和Android上共享业务逻辑,可能因AI推动而更受关注。

  2. Cloudflare · AI31

    Cloudflare 如何利用 AI 规划后量子迁移路线

    Cloudflare 正在开发名为 CryptoLabe 的内部 AI 工具,以推动其平台在 2029 年前实现全面的后量子就绪。该工具通过两阶段扫描,在代码库中发现并理解加密技术的使用情况,并生成迁移进度指标。CryptoLabe 高度定制于 Cloudflare 的内部系统,公司分享了相关经验以帮助其他组织进行后量子迁移。

  3. O'Reilly Radar36

    A Data Center Is a Dependency Graph Before It Is a Building

    新超大规模数据中心区域的物理基础设施已建成,但能否在六个月内投入生产取决于软件配置。服务上线前需构建依赖关系图,明确各服务启动前必须满足的条件,避免因隐藏依赖导致整体阻塞。Meta 2021 年的网络故障表明,局部合理的安全机制可能在系统层面造成更大影响。

  4. MIT Technology Review · AI27

    MIT Technology Review:如何将 AI 从成本支出转变为战略资产

    随着 AI 应用从实验转向生产,企业需从单纯关注 token 价格转向评估拥有专属容量的经济性。德勤《2026 年企业 AI 现状》报告显示,2025 年员工使用 AI 的比例上升了 5%,且预计六个月内至少有 40% AI 项目进入生产阶段的企业比例将翻倍。当 AI 需求变得稳定、可预测且规模足够大时,拥有并优化专属容量可能比按需消费更具经济效益和可控性。

  5. Microsoft 官方博客31

    Microsoft 推出新数据创新,让 AI 更好结合企业专属知识

    Microsoft 推出 Fabric IQ,使 Copilot 能结合企业独有的 Power BI 语义模型和业务定义,提供基于治理数据的答案。该功能默认启用,适用于 Fabric 和 Power BI 用户,同时保留现有访问控制和治理机制。此外,Fabric 还引入了 IQ Sharing 和 Observability,支持跨组织安全共享数据并提升 AI 扩展时的监控能力。

  6. 极客公园66

    Manus 发布 2.0 版本,推出个人 AI 助手 CUE 与云电脑功能

    Manus 正式发布 2.0 版本,推出个人 AI 助手应用 CUE,支持手机和桌面端,与 Manus 共享基础设施。新版本包含自研 Cascade Agent 框架,可减少 23.2% Token 消耗、缩短 28.2% 任务完成时间、降低 32% 运行成本。

    推荐理由:原文介绍了 Manus 2.0 的核心功能升级和新应用 CUE,读者可以据此了解其在个人 AI 助手和全场景 Agent 方向的布局变化。