Vercel Agent 现已支持从 npm 和自定义注册表安装私有包
Vercel Agent 新增了从 npm 和自定义注册表安装私有依赖包的能力。该功能通过读取 Vercel 上配置的共享环境变量(如 NPM_TOKEN 或 NPM_RC)进行身份验证,且凭证值不会进入 Agent 沙箱。npm、pnpm 和经典 Yarn 在 Agent 会话中的认证方式与 Vercel 构建过程保持一致。
Vercel Agent 新增了从 npm 和自定义注册表安装私有依赖包的能力。该功能通过读取 Vercel 上配置的共享环境变量(如 NPM_TOKEN 或 NPM_RC)进行身份验证,且凭证值不会进入 Agent 沙箱。npm、pnpm 和经典 Yarn 在 Agent 会话中的认证方式与 Vercel 构建过程保持一致。
NVIDIA 开发者博客介绍了使用 NVIDIA Dynamo-Triton 部署 HSTU 生成式推荐系统的方法。该方法将推荐任务重构为用户行为序列建模,将交互、上下文、候选项目和行动作为高基数事件流中的 token 进行处理。
NVIDIA 通过 cuObject 和 SCADA Server SDK 扩展了对大容量文件与对象存储的高速安全访问,以支持 AI 工作负载。AI 训练、微调、推理上下文、工具调用、搜索和数据库查询等任务均依赖此类高速数据访问。
NVIDIA发布Open Agent Safety Platform,一个在硬件层面监控和终止AI智能体的参考设计。该平台基于BlueField-4 DPU和NVIDIA Sentry,通过隔离的网络路径实现对智能体行为的持续监控与毫秒级隔离,防止智能体逃逸后无法被及时终止。
推荐理由:原文介绍了NVIDIA在硬件层面部署AI智能体监控与终止机制的设计,读者可据此理解其对智能体安全控制的工程化路径。
Databricks 发布 ai_decide AI 功能,基于决策模型在毫秒级完成对受管数据的结构化判断,支持分类、评分与实时决策。该功能可在 SQL 中调用,也可通过 REST API 用于实时应用与智能体,延迟与成本显著低于传统 LLM。目前处于 Beta 阶段,兼容 TypeSafe AI 的 Jev 模型,支持在 Databricks 上直接运行开源决策模型。
PyTorch Conference North America 2026 即将在圣何塞举行,为开源 AI 社区提供交流平台。会议指南重点介绍了多场关于分布式计算框架 Ray 的议题,涵盖其与 Kubernetes 的协同演进、在 LinkedIn 和 Uber 等公司的生产级数据与模型训练应用,以及在模型推理与后训练阶段的关键作用。
微软研究院开发了一套端到端机器学习系统,可为美国本土 66,935 座变电站提供提前 30 至 60 分钟的位置特定空间天气风险预测。该系统结合太阳风观测、AE/Dst 指数预报、地质电导率与电网数据,在 2020-2026 年评估期内对重大事件的检测率达到 76.5%。
NVIDIA NeMo Relay 工具可用于追踪和分析智能体工作流中的低效行为。该工具能揭示导致延迟增加和 token 消耗的冗余步骤,例如失败的搜索或重复的文件读取,从而帮助开发者优化智能体性能。
Amazon Bedrock Knowledge Bases 提供了一种通过自然语言查询理赔文档并返回带引用答案的解决方案。该方案使用 AgenticRetrieveStream API 从 PDF、Word 和文本笔记中检索信息,并通过上下文对齐检查确保答案基于最新记录。应用可实时显示答案和引用来源,适用于处理理赔状态查询、多轮对话和元数据过滤等场景。
AWS 发布 Amazon Bedrock AgentCore Runtime Instances,支持多智能体在单个 GPU 实例上通过共享会话 ID 实现长期协作,具备多日持久化、GPU 支持、跨团队独立部署和混合打包格式共存能力,可用于音乐制作等复杂工作流。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
Atlas Agent Engine 与 Arize AX 集成,为 AI 智能体提供可治理的运行基础和细粒度可观测性。Arize AX 支持在 span 级别分析模型调用、检索步骤、工具调用、延迟和 token 使用情况,并通过 Signal 系统自动识别失败并建议修复。该集成基于 OpenTelemetry 标准,无需自定义代码即可发送 trace 数据,提升跨框架和模型的灵活性。
CoreWeave 宣布其云平台已提供 NVIDIA Vera Rubin NVL72 系统,并成为首批提供该平台的云服务商之一。Cognition 作为首个生产用户,其 Devin AI 软件工程师的推理工作负载在 Vera Rubin NVL72 上实现了比 GB200 NVL72 高达 4.8 倍的 token 吞吐量提升。
Torch Spyre 基于 PyTorch 跨仓库 CI 中继(CRCR)实现了 L2 级集成,通过智能体流程从代码和执行证据中筛选并重组测试,并使用声明式 YAML 框架在不修改上游测试的情况下适配它们。这套方法旨在为任何通用的 privateuse1 设备提供可扩展的测试解决方案,并计划与 PyTorch 社区合作,将可复用部分上游化。
Cloudflare AI Gateway 的 User Insights 功能新增了识别模型过度使用的视图,帮助团队发现任务所需能力低于所选模型的情况。该功能可关联用户、智能体、应用程序及任务类别(如编码、研究、总结),并支持成本、延迟和对话轮次分析。这些洞察同时支撑了新推出的“潜在节省”视图和公开测试版 Auto Router,所有功能对 AI Gateway 用户免费开放。
Cloudflare 在 AI Gateway 中发布 Auto Router 公开测试版,通过自动将请求路由到性价比更高的模型来帮助组织降低 AI 成本。内部测试显示,相比仅使用 OpenAI Sol 和 Anthropic Claude Opus 等前沿模型,Auto Router 可节省高达 30% 的成本。
推荐理由:Cloudflare 通过其 AI Gateway 推出自动路由功能,旨在为组织在内部部署 AI 时提供成本控制方案。
Cloudflare 推出 Pay Per Use 测试版,允许内容发布者向已识别的 AI 公司授权内容,并根据实际使用情况(如被 AI 搜索引用、智能体报告引用)获得报酬。AI 公司定义付费用途和价格,发布者选择接受哪些报价,Cloudflare 负责处理注册、使用记录、计费和支付。该机制旨在为 AI 驱动的网络构建一个经济层,让内容在被他人产品使用时也能产生可持续收入。
推荐理由:原文详细描述了新机制的运作流程和商业逻辑,为内容创作者和AI公司提供了一种新的合作框架参考。
Cloudflare 发布 Monetization Gateway 测试版,允许网站、API、MCP 工具或数据集的拥有者向访问的 AI 智能体按次收费。该网关使用 HTTP 402 状态码,通过 Base 区块链上的 USDC 稳定币进行支付结算,无需重定向到结账页面或调用单独的支付 API。
推荐理由:原文展示了如何通过 HTTP 402 状态码和稳定币支付,让网站、API 和 MCP 工具直接向 AI 智能体收费,并给出了四个实际用例。
Cloudflare Registrar 全面更新了域名搜索与购买体验,并增强了对 AI 智能体的支持。新的搜索界面实时显示所支持的 420+ 后缀的精确结果,并可通过 API、MCP 及新推出的 cf CLI 让 AI 智能体直接搜索、注册或转移域名。该服务旨在为用户和智能体提供同样自然、简洁的交互体验。
Cloudflare 发布一系列产品与工具,帮助网站应对 AI 智能体流量超过人类流量带来的挑战。超过一半的互联网流量已非人类,导致网站收入下降而成本上升。Cloudflare 推出了 AI Crawl Control、Web Bot Auth、Disallow AI Training 等工具,让网站能识别、区分并控制不同 AI 流量。
推荐理由:原文详细阐述了非人类流量成为主流后网站面临的收入困境,并给出了 Cloudflare 提供的身份验证、流量控制和付费结算等具体解决方案。
Cloudflare 宣布重构其 Containers 服务,以更好地支持 AI 智能体工作负载。主要更新包括引入新的 durable_object 调度策略,允许在运行时选择沙盒镜像和实例类型,使容器启动速度提升 6 倍以上,并新增了文件系统快照功能。这些改进旨在让智能体能够按需创建、暂停和恢复工作空间,满足编码助手、评估和强化学习等场景的需求。
推荐理由:Cloudflare Containers 针对 AI 智能体工作负载进行了架构重构,提供了更快的启动速度和运行时配置能力。
接受 Neo4j 初创企业计划后,需通过 Aura Console 创建账户、获取组织 ID、添加支付方式并提交确认邮件以激活信用额度。信用额度在提交组织 ID 后开始计算 12 个月有效期,未激活前不会过期。若公司名称变更或多人申请,需联系 startups@neo4j.com 处理以避免账单混淆。
Amazon Bedrock 现在支持在印度本地区域对 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5 进行推理。
Amazon Bedrock 现在支持在首尔和新加坡区域使用 Anthropic 的 Claude Opus 5 和 Claude Sonnet 5 进行本地推理,输入和输出数据全程保留在指定区域。用户可通过 Amazon Bedrock 控制台或 API 调用模型,无需额外配置即可测试不同模型变体。该功能适用于需满足数据本地化要求的金融、医疗及公共部门应用。
WeAreDevelopers World Congress North America 会议中,AI 生成代码的审查成为软件开发的主要瓶颈,多位演讲者指出人类审查速度有限,而基于智能体的代码审查同样存在速度限制。
NVIDIA 开源了基于 TensorRT 的 AI 模型参考实现库 TensorRT Model Connect。该项目围绕编码智能体设计,采用了并行工作、模型族隔离、可逆变更和 GPU 验证等核心原则。
NVIDIA 发布了 Metropolis 视频搜索与摘要蓝图 VSS Blueprint 3.3,旨在降低构建和运行视觉 AI 智能体的成本。该蓝图整合了视频摄取、流处理、事件检测、检索、摘要和报告等功能,帮助开发者将视觉语言模型的能力转化为可维护的生产级系统。
Amazon Quick 的提示工程通过不同组件实现差异化处理,本文解析了 Quick Research、Quick Flows 和 Quick Sight 的提示设计模式与陷阱。
AWS 博客介绍了一个结合 AI 智能体进行结构化提取和 RAG 进行文档检索的混合架构,用于处理大规模合同文档。该平台使用 Claude Sonnet 进行字段提取,Claude Haiku 进行独立验证,并在签名检测出现分歧时调用 Amazon Textract 作为裁决器。
Replit Agent 发布新功能,允许 GPT-6 Astra 等模型在任务执行中自主决定子代理层级、努力程度和复用策略,实现动态 delegation。在 DeepSWE 和 Terminal-Bench 基准上,该架构在成本与性能上均优于 Astra 单独运行及侧边工架构,且无需修改提示或框架。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
Condé Nast 与 AWS 生成式 AI 创新中心合作,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建了 AI 驱动的多模态视频发现解决方案。
Vercel CLI 新增 `vercel traces search` 命令,允许开发者和 AI 智能体直接从终端搜索项目的追踪数据。该命令默认返回最近一小时内最新的 100 条追踪记录,支持按环境、状态、时长等多种条件筛选,并可通过 `--json` 选项输出结构化数据供脚本分析。
Cloudflare 使用前沿大语言模型对其 WAF 进行动态安全测试,模拟黑客行为迭代攻击载荷。在针对授权客户测试环境的 1107 次攻击尝试中,绝大多数被 WAF 成功拦截。少数未被拦截的请求帮助 Cloudflare 创建了新的检测规则,以增强所有客户的安全防护。
Cloudflare 正在开发名为 CryptoLabe 的内部 AI 工具,以推动其平台在 2029 年前实现全面的后量子就绪。该工具通过两阶段扫描,在代码库中发现并理解加密技术的使用情况,并生成迁移进度指标。CryptoLabe 高度定制于 Cloudflare 的内部系统,公司分享了相关经验以帮助其他组织进行后量子迁移。
Microsoft 推出 Fabric IQ,使 Copilot 能结合企业独有的 Power BI 语义模型和业务定义,提供基于治理数据的答案。该功能默认启用,适用于 Fabric 和 Power BI 用户,同时保留现有访问控制和治理机制。此外,Fabric 还引入了 IQ Sharing 和 Observability,支持跨组织安全共享数据并提升 AI 扩展时的监控能力。
Ollama 0.35 版本新增了对决策模型的支持,通过新的 /v1/systemone 端点提供基于 TypeSafe Jev API 的快速、类型化决策能力。
OpenAI 的 GPT-6.1 Sol 模型现已在 Vercel AI Gateway 上线。它在编码、计算机使用和专业工作(包括阅读复杂文档和执行多步骤工作流)上相比 GPT-6 Sol 有所改进,并提升了困难问题的准确性。
Mistral AI 在德国慕尼黑开设新中心,专注于工业 AI 和 Physics AI 研究与应用。该中心将组建专门研究团队,并与宝马、西门子能源等企业合作开发工业 AI 应用。Mistral 强调其开放权重架构和欧洲本地计算基础设施,以保障欧洲的 AI 主权。
Cloudflare 发布 Vinext 1.0,可将基于 Pages 或 App Router 的 Next.js 应用移植并部署到 Cloudflare Workers 免费计划、Netlify 或 AWS Lambda 等任意 Web 平台。
Cloudflare 为其专为 AI 智能体设计的浏览器 Kitesurf 发布更新,新增对 WebMCP 的支持,使智能体能直接调用网站功能。Kitesurf 还扩展了支持的 Web API,通过了超过 73 万项 Web Platform Tests 子测试,并针对智能体循环延迟进行了内部引擎优化。该浏览器现已完全支持 Browser Run API,并推出了可在终端中运行的版本。
LangSmith 推出自定义应用功能,允许用户基于其智能体数据构建、发布和运行专属界面,无需自行处理托管、认证和权限问题。该功能支持通过聊天提示或代码构建,Plus 和 Enterprise 计划用户可直接在 LangSmith Chat 中指定数据展示方式和可视化需求,生成可运行的应用。自定义应用可与 LangSmith 数据保持连接,用于重复性评审流程,提升人工反馈和实验对比的效率。