NVIDIA cuObject 与 NVIDIA SCADA Server SDK 扩展 AI 存储访问
NVIDIA 通过 cuObject 和 SCADA Server SDK 扩展了对大容量文件与对象存储的高速安全访问,以支持 AI 工作负载。AI 训练、微调、推理上下文、工具调用、搜索和数据库查询等任务均依赖此类高速数据访问。
NVIDIA 通过 cuObject 和 SCADA Server SDK 扩展了对大容量文件与对象存储的高速安全访问,以支持 AI 工作负载。AI 训练、微调、推理上下文、工具调用、搜索和数据库查询等任务均依赖此类高速数据访问。
Databricks 发布 ai_decide AI 功能,基于决策模型在毫秒级完成对受管数据的结构化判断,支持分类、评分与实时决策。该功能可在 SQL 中调用,也可通过 REST API 用于实时应用与智能体,延迟与成本显著低于传统 LLM。目前处于 Beta 阶段,兼容 TypeSafe AI 的 Jev 模型,支持在 Databricks 上直接运行开源决策模型。
Google 在全球 Gemini 聊天中推出 Skills 功能,用于保存和复用常用指令以自动化重复任务。Skills 将取代 Gems,并将在未来几周内为 Google Workspace 客户提供,个人账户的 Gems 支持将于 11 月停止。用户可以通过输入‘/’和技能名称来快速调用,并可以组合多个技能或添加参考文件。
推荐理由:原文明确了从 Gems 到 Skills 的迁移路径和时间表,读者可以据此规划现有工作流的调整。
CoreWeave 宣布其云平台已提供 NVIDIA Vera Rubin NVL72 系统,并成为首批提供该平台的云服务商之一。Cognition 作为首个生产用户,其 Devin AI 软件工程师的推理工作负载在 Vera Rubin NVL72 上实现了比 GB200 NVL72 高达 4.8 倍的 token 吞吐量提升。
Cloudflare AI Gateway 的 User Insights 功能新增了识别模型过度使用的视图,帮助团队发现任务所需能力低于所选模型的情况。该功能可关联用户、智能体、应用程序及任务类别(如编码、研究、总结),并支持成本、延迟和对话轮次分析。这些洞察同时支撑了新推出的“潜在节省”视图和公开测试版 Auto Router,所有功能对 AI Gateway 用户免费开放。
Cloudflare 在 AI Gateway 中发布 Auto Router 公开测试版,通过自动将请求路由到性价比更高的模型来帮助组织降低 AI 成本。内部测试显示,相比仅使用 OpenAI Sol 和 Anthropic Claude Opus 等前沿模型,Auto Router 可节省高达 30% 的成本。
推荐理由:Cloudflare 通过其 AI Gateway 推出自动路由功能,旨在为组织在内部部署 AI 时提供成本控制方案。
Cloudflare 推出 Pay Per Use 测试版,允许内容发布者向已识别的 AI 公司授权内容,并根据实际使用情况(如被 AI 搜索引用、智能体报告引用)获得报酬。AI 公司定义付费用途和价格,发布者选择接受哪些报价,Cloudflare 负责处理注册、使用记录、计费和支付。该机制旨在为 AI 驱动的网络构建一个经济层,让内容在被他人产品使用时也能产生可持续收入。
推荐理由:原文详细描述了新机制的运作流程和商业逻辑,为内容创作者和AI公司提供了一种新的合作框架参考。
Cloudflare 发布 Monetization Gateway 测试版,允许网站、API、MCP 工具或数据集的拥有者向访问的 AI 智能体按次收费。该网关使用 HTTP 402 状态码,通过 Base 区块链上的 USDC 稳定币进行支付结算,无需重定向到结账页面或调用单独的支付 API。
推荐理由:原文展示了如何通过 HTTP 402 状态码和稳定币支付,让网站、API 和 MCP 工具直接向 AI 智能体收费,并给出了四个实际用例。
Cloudflare Registrar 全面更新了域名搜索与购买体验,并增强了对 AI 智能体的支持。新的搜索界面实时显示所支持的 420+ 后缀的精确结果,并可通过 API、MCP 及新推出的 cf CLI 让 AI 智能体直接搜索、注册或转移域名。该服务旨在为用户和智能体提供同样自然、简洁的交互体验。
Cloudflare 宣布重构其 Containers 服务,以更好地支持 AI 智能体工作负载。主要更新包括引入新的 durable_object 调度策略,允许在运行时选择沙盒镜像和实例类型,使容器启动速度提升 6 倍以上,并新增了文件系统快照功能。这些改进旨在让智能体能够按需创建、暂停和恢复工作空间,满足编码助手、评估和强化学习等场景的需求。
推荐理由:Cloudflare Containers 针对 AI 智能体工作负载进行了架构重构,提供了更快的启动速度和运行时配置能力。
Blueking Lite AI 智能运维平台本周更新,其智能体问答功能新增了展示知识库中图片的能力。平台还支持查看 API 调用日志,并在 CMDB 中新增了物理服务器 Redfish 采集功能。
OpenAI 在 DevDay 2026 开发者大会上发布了由 GPT-6 Astra 驱动的个人 AI 智能体助理 'dots'。它被描述为比 ChatGPT 更有野心,拥有卡通形象,可集成到手机、笔记本及第三方应用中。
MateClaw 2.3.0 正式版发布,为 Persistent Goal 功能增加了用户配置的托管 JSON 验收机制。Agent 需发布不可变的产物版本,服务端检查结果并绑定到当前要求与具体生成,所有绑定有效后才允许完成目标。
DeepSeek Harness v0.2 预览版发布,提供了 macOS 和 Windows 桌面端安装包,实现了开箱即用。新版本支持通过 npm 包名安装插件,并具备让 AI 自己编写插件的能力。
推荐理由:原文给出了桌面版发布和插件安装方式的变化,读者可以据此判断它会怎样改变现有工作流。
Latent Space 汇总了 OpenAI DevDay 2026 的主要发布,包括 Dots 智能体、GPT-6.1 Sol 模型及多项平台更新,并整合了社区评测和行业动态。
推荐理由:作者整合了多个独立评测和社区反馈,为读者提供了关于GPT-6.1 Sol性能、定价和Dots智能体功能的多角度事实依据。
开源 Windows 多 Agent 工作台 Termexo 发布了 v0.10.9 版本。该版本将工作区内 Agent 的状态集中显示为五种图标:空闲(灰色)、运行/思考(绿色闪动)、异常/等待授权(红色)以及完成(绿色对号)。状态提示旨在帮助开发者快速定位需要处理的终端。
OpenAI 在开发者大会上发布了一系列产品更新,旨在将 ChatGPT 从生成工具转变为工作平台。核心新品包括全天候智能体 Dot、协作空间 ChatGPT Space、成本更低的日常主力模型 GPT-6.1 Sol,以及 UltraFast 模式、Decisions API、Agents API 等基础设施。
推荐理由:原文详细介绍了 OpenAI 一系列新产品的功能定位、定价和现场演示细节,读者可以了解其平台化战略的具体构成。
Amazon Bedrock 现在支持在印度本地区域对 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5 进行推理。
Amazon Bedrock 现在支持在首尔和新加坡区域使用 Anthropic 的 Claude Opus 5 和 Claude Sonnet 5 进行本地推理,输入和输出数据全程保留在指定区域。用户可通过 Amazon Bedrock 控制台或 API 调用模型,无需额外配置即可测试不同模型变体。该功能适用于需满足数据本地化要求的金融、医疗及公共部门应用。
OpenAI 在 DevDay 2026 发布 GPT-6.1 Sol,其标准输入输出 Token 价格仅为 GPT-6 Astra 的五分之一,智能体编程与专业工作能力显著增强。该模型支持超高速档位,API 生成速度最高提升 8 倍,已上线 GPT-6 Astra 超高速,GPT-6.1 Sol 超高速即将推出。
OpenAI 在 DevDay 2026 上发布 GPT-6.1 Sol 模型,以五分之一价格实现接近 Astra 的性能,同时推出 24 小时在线的智能体助理 dots,支持操作 4000 个应用并具备权限控制,ChatGPT Space 实现协作编辑功能,Pro 会员额度减半但新增 Pro 500 高端套餐支持 UltraFast 模式。
推荐理由:原文给出了新模型、智能体功能和套餐额度调整的完整信息,读者可据此评估其对企业工作流的影响。
OpenAI 推出 AI 智能体 Dots,基于 GPT-6 Astra 架构,支持自主处理任务并集成 4,000 多个应用平台。GPT-6.1 Sol 提供接近 Astra 的智能水平,但成本仅为后者五分之一,适用于专业任务和企业级工作流自动化,通过 OpenAI API 提供多层级用户选项。
InclusionAI 的 Ling 3.1 Flash 模型已在 Vercel AI Gateway 上线,在 2026年10月13日前可免费使用。该混合推理模型总参数量为 560B,每 token 激活参数 25B,在 AI Gateway 上提供 262K token 的上下文窗口,适用于编码、多步骤分析和使用工具的智能体任务。
LangSmith 已上线 Jev 智能体评估功能,支持以低延迟、低成本方式对开放性代理行为进行结构化评估。用户可通过 LangSmith 的 Evaluators 页添加 Jev-as-a-judge 评估器,配置状态与 typed 问题,实现多指标并行评估,显著提升评估效率与成本效益。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
GPT-6.1 Sol 已在 Amazon Bedrock 上正式可用,为编码、计算机使用和专业工作负载带来更强的推理能力。根据 OpenAI 数据,它在 DeepSWE v1.1 上达到 GPT-6 Astra 的水平,而每个任务的成本约为后者的五分之一。用户可以通过 Amazon Bedrock 控制台或 API 开始使用,并利用其基础设施和访问控制功能。
推荐理由:原文给出了模型在 Agent 任务上的性能提升和成本对比,读者可以据此判断它是否适合集成到现有工作流中。
NVIDIA 发布了 Metropolis 视频搜索与摘要蓝图 VSS Blueprint 3.3,旨在降低构建和运行视觉 AI 智能体的成本。该蓝图整合了视频摄取、流处理、事件检测、检索、摘要和报告等功能,帮助开发者将视觉语言模型的能力转化为可维护的生产级系统。
OpenAI 在 DevDay 上发布了 ChatGPT Space、Pages 和 Slides 三项新功能,旨在打造一个供人类与 AI 智能体协作的工作空间。
推荐理由:OpenAI 在 DevDay 上发布了一系列协作功能,直接对标 Anthropic 的 Claude Cowork,为企业用户提供了新的 AI 原生工作空间选项。
OpenAI 推出名为 dots 的持续运行个人 AI 智能体,由 GPT-6 Astra 模型驱动,可连接超过 4000 个应用并与 ChatGPT、Slack 或 Teams 集成。这些智能体具备只读权限、行为监控等隐私保护功能,并计划向符合条件的 Pro、Business Premium 和 Enterprise 用户开放。
OpenAI 在年度开发者大会上宣布了多项产品更新。推出了名为 Dots 的新型 AI 智能体,由 GPT-6 Astra 驱动,面向 Pro、Business Premium 和企业订阅者。
推荐理由:原文详细列出了新模型、新智能体、新协作空间和订阅计划调整,读者可以据此判断 OpenAI 最新的产品布局和定价策略变化。
DeepSeek 正式推出 DeepSeek Harness 桌面版,支持 macOS 和 Windows 安装,登录即送 6 元赠金。新版本提供完整的插件管理界面,支持通过 npm 包名安装插件,新增自动化任务、语音输入等实验室功能,并可实现 Agent 自主生成插件。
推荐理由:原文给出了桌面版功能变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
微软研究院推出名为Quine的生物AI研究系统,该系统包含一个多模态生物世界模型和一个连接模型、科学工具、文献与研究人员的工作平台。在与Broad Institute的合作中,Quine被用于预测和优先排序能驱动肿瘤细胞状态转变的化合物,其排名靠前的候选物在湿实验室实验中得到了验证。
推荐理由:原文展示了该系统在癌症研究中的具体应用案例和效果,为关注AI在生物科学领域落地的读者提供了实践参考。
Dazzle 是一款由前雅虎 CEO Marissa Mayer 推出的个人 AI 助手,其核心特点是仅通过分析用户手机相册来获取上下文信息。该助手能识别用户的爱好、旅行记录和风格偏好,并提供个性化活动与礼物建议,同时强调优先处理用户隐私。Dazzle 在去年 12 月已完成 800 万美元种子轮融资,用户可通过应用或短信与之交互。
Vercel CLI 新增 `vercel traces search` 命令,允许开发者和 AI 智能体直接从终端搜索项目的追踪数据。该命令默认返回最近一小时内最新的 100 条追踪记录,支持按环境、状态、时长等多种条件筛选,并可通过 `--json` 选项输出结构化数据供脚本分析。
OpenAI 在 DevDay 2026 上发布了超过 20 项公告,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。
Codeaha v1.0.0 正式发布,是一款本地优先、国产大模型友好的 AI 编程智能体。其核心特性包括所有会话、消息与代码变更均存储于本地 SQLite,确保代码数据不出本机,并基于 Eino Graph 实现智能体推理。
Manus 2.0 上线,包含自研 Agent 框架 Cascade、升级为共享工作区的桌面应用 Manus Studio,以及独立的个人 Agent 应用 Cue。Cascade 旨在提升效率,从项目开始就保持轻量,据称可节省 32% 成本。
AMD 宣布以全股票交易收购 World Labs,交易价值约 82 亿美元,李飞飞将出任执行副总裁兼首席科学家。Manus 推出个人 AI 助手 Cue,支持独立邮箱、电话号码和协作功能,目前处于抢先体验阶段并需邀请码免费使用。Counterpoint Research 预测,2030 年全球 200 美元以下智能手机出货量将比 2025 年减少 2.3 亿部。
Ollama 0.35 版本新增了对决策模型的支持,通过新的 /v1/systemone 端点提供基于 TypeSafe Jev API 的快速、类型化决策能力。
OpenAI 的 GPT-6.1 Sol 模型现已在 Vercel AI Gateway 上线。它在编码、计算机使用和专业工作(包括阅读复杂文档和执行多步骤工作流)上相比 GPT-6 Sol 有所改进,并提升了困难问题的准确性。
Claude Sonnet 5.5 提升了编码、长程任务和图像理解性能,输出速度比 Sonnet 5 快 30%,每任务成本降低 30%。Anthropic 的 IPO 招股书显示其估值目标为 2000 亿美元,2025 年净亏损达 420 亿美元,计划未来一年在云计算和基础设施上支出 5180 亿美元。