NVIDIA Open Agent Safety Platform:一个用于持续硅内智能体监控的参考平台
NVIDIA 推出了 Open Agent Safety Platform,这是一个用于持续监控硅内 AI 智能体安全性的参考平台。该平台旨在应对智能体 AI 带来的机遇与风险,为开发者提供安全监控的参考实现。
NVIDIA 推出了 Open Agent Safety Platform,这是一个用于持续监控硅内 AI 智能体安全性的参考平台。该平台旨在应对智能体 AI 带来的机遇与风险,为开发者提供安全监控的参考实现。
NVIDIA OpenShell 为 AI 智能体提供运行时控制功能,使其能根据新信息持续执行任务。该工具支持智能体在长时间运行中访问工作空间、计算资源、数据、凭证和外部服务。NVIDIA 开发者博客指出,这一功能扩展了智能体在软件故障分析、实验运行和业务关键操作中的应用潜力。
AIGCPanel v2.5.0 更新支持豆包语音音色,并新增云端语音模型 API 接入功能。该版本还将数字人与直播的音色分别纳入独立的音色库进行管理。AIGCPanel 是一款跨 Windows、macOS、Linux 平台的一站式 AI 数字人桌面应用。
QuotaPanel v0.1.0 是一款开源的桌面端 AI 额度面板,可将 Claude、ChatGPT、Cursor、GitHub Copilot、Kimi、DeepSeek 等 15 种订阅与 API 余额集中展示。用户无需再分别登录各家控制台即可查看剩余额度。
开源 AI 终端 uniTerm 发布 v1.9.5 版本,对工作区管理与终端体验进行了全面升级。新版本支持点选创建与拖拽分屏的工作区,并新增了终端图片显示功能。该版本还包含 SFTP 提速等超过 50 项更新。
KnowForge 2026.0.6 版本上线了会员、支付、付费内容与 AI 知识服务等商业化功能。该版本旨在探索知识服务的商业化路径,并让 AI 深度融入知识创作与阅读流程,同时帮助作者通过内容获得收益。
ShopXO 免费开源商城系统发布 v6.9.2 版本,新增 AI 大模型插件、AI 编辑器插件、商品助手插件、后台经营助手插件、以图搜款插件、商品高级购买插件和文档插件。该版本还新增了后台功能快速搜索功能,支持 DIY、主题和页面设计。
NVIDIA DSX MaxLPS 通过策略管理的动态功率共享技术,在 AI 工厂中按需分配 GPU 间的功率。该方案允许客户在正常运行时部署更多 GPU,从而提升基础设施的整体利用率与吞吐量。
Anthropic 的 Claude Sonnet 5.5 模型已在 Vercel 的 AI Gateway 上架。该模型在编码、文档制作、幻灯片和电子表格生成等日常工作任务上相比 Claude Sonnet 5 有所改进,并支持 AI Gateway 的 Zero Data Retention 策略。
Fireworks 的 Ember-1 推理模型现已在 Vercel AI Gateway 上线。该模型基于 Kimi K3 构建,在其评估中能以相近的质量减少约 40% 的生成 token,并支持 100 万 token 的上下文窗口、图像输入和工具调用。Ember-1 目前作为研究预览版提供,Fireworks 端点支持零数据保留和无提示词训练。
DeepSeek Harness 桌面版上线,提供办公科研、代码开发等使用方向及多种工作模式。Anthropic 与 Akamai 签署 7 年 116 亿美元合同,用于扩充 CPU 算力。扎克伯格因 Meta 推出的 Muse 人工智能助手,身家达 2664 亿美元,位列全球第四大富豪。
Google 为 Gemini Enterprise 用户推出了 Live Avatar 功能,能将 AI 智能体与可交互的虚拟形象结合,用于视频聊天处理保险理赔等任务。该功能支持唇形同步、实时音频视频处理,并能同时运行工具和 API 调用。目前仅提供预制的虚拟形象供企业选择,所有音视频内容均使用 SynthID 进行水印以验证其 AI 生成属性。
Cloudflare 推出 Turnstile Spin,让 AI 智能体能够自动完成 Turnstile 验证系统的端到端部署。该功能可将原本需要前后端分别配置的两步流程,简化为由智能体引导的自动化工作流,支持全新安装、修复未验证的组件以及从其他 CAPTCHA 迁移。自 7 月发布以来,已成功创建超过 65,000 个 Spin widget。
Microsoft 推出新版 Copilot,新增 Home、Code 和 Autopilot 三大功能。Home 整合 Chat 与 Cowork,集成 Word、Excel、PowerPoint 实时协作;Code 允许非开发者用自然语言构建应用,基于 GitHub Copilot 技术运行于安全沙箱;Autopilot 是持续工作的智能体,可自主执行任务并跨应用协作。
推荐理由:原文给出了新功能模块的定位、能力边界和开放路径,读者可以据此判断它会怎样改变现有工作流。
微软发布统一版 Copilot 应用,为消费者和企业用户提供单一客户端,新增 Code 和 Autopilot 标签页。新应用采用订阅加用量计费(UBB)的混合定价模式,其中涉及智能体的功能(如 Cowork、Code、Autopilot)均需按用量付费。
表演艺术家游本昌因病去世,享年 93 岁,曾因饰演「济公」等角色广受喜爱。罗永浩评价小米 18 Fold 的 D 型屏设计控制得非常完美。Meta 发布新款手持设备 Muse Charm,可与 Muse AI 智能助手配合使用,无需解锁手机或打开应用即可互动。
Google 为移动端 Gemini AI 推出了可代用户进行日常电话呼叫的智能体功能。该功能目前仅限美国、18岁以上、拥有 Pixel 11 或更新机型并订阅 Google AI 服务(每月 5 美元起)的用户使用,且设计上不会进行支付或分享信用卡号等敏感信息。其实际效果受限于企业是否愿意与 AI 对话、每日呼叫次数限制以及处理语音信箱等常见场景的能力。
Pixel Canary 模型现已在 Vercel AI Gateway 上以 stealth/pixel-canary 名称免费提供。该模型擅长编码,特别是在前端开发和移动应用设计方面。
OpenAI 准备推出 ChatGPT Pro Max 订阅计划,价格为每月 $500。Meta 推出 Muse Realtime Avatar,可实时将对话转化为互动虚拟人像,支持优化的 AI 推理栈。DeepSeek 宣布实现 $1B 年经常性收入,未提及具体模型版本或参数规模。
PyTorch 基金会将在 PyTorch Conference North America 2026 期间开设全新的 Introduction Track,并于 10 月 19 日在圣何塞举办为期一天的官方 PyTorch Associate 培训。
Midjourney 在 alpha.midjourney.com 推出了编辑模型,支持对图像进行局部修改并保持画质,同时改进了 inpainting 和 outpainting 功能。用户可通过缩略图预览不同风格下的提示词效果,并使用“Live previews”功能实时查看。此外,--tile 参数在 V8.1/8.2 版本中优化,使拼接图像的接缝更不明显。
LangSmith Engine v2 引入红队测试功能,用于主动发现智能体在生产环境中的潜在问题,如幻觉和系统提示违规。该版本可检测更隐蔽的性能问题,如延迟和成本趋势,并在提交修复前自动验证其有效性。目前红队测试功能已向现有 LangSmith 部署用户开放私有测试,支持 SaaS 部署的 Plus 和 Enterprise 计划用户可立即启用。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,通过低延迟视频流与语音同步,实现企业级虚拟代理的近实时视觉交互。该功能支持多语言无缝切换、异步工具调用与持续对话,具备精确唇形同步与自然表情,企业可通过参考图像定制专属动画形象,目前仅对 Gemini Enterprise 用户开放。所有生成内容均嵌入 SynthID 水印以确保可追溯性。
推荐理由:原文给出了功能组合和企业可用性,读者可以据此判断其在交互场景中的部署价值。
LangSmith 现在推出 Trajectories 功能,提供智能体会话的按时间顺序排列的可读视图。该功能可聚合人类、AI 和工具的消息,按首次出现顺序展示,便于调试和评估智能体行为。
LangChain 发布 LangSmith Fine-Tuning 及其 CLI 工具 smithtune,支持从 LangSmith 轨迹数据中自动构建训练集、使用 Fireworks 或 Baseten 进行 LoRA 微调,并在 LangSmith 中评估模型性能。该工具专为后训练优化设计,支持监督微调(SFT),可提升模型在特定任务上的表现,同时降低推理成本与延迟。
推荐理由:原文给出了从数据到训练再到部署的完整流程,读者可以据此评估其对开发效率的影响。
Managed Deep Agents 0.8 新增用户级记忆、身份认证、HTTP 通道和 Slack 文件传输功能,支持更安全的生产环境代理运行。该版本通过 LangSmith Context Hub 提供持久化记忆存储,区分代理级和用户级上下文,防止信息泄露。用户可通过配置访问策略控制记忆使用范围,适用于客服、研究等多场景。
Google 推出 Gemini 3.8 Live with Live Avatar,支持实时视频生成与语音同步,具备自然唇形同步、表情和多语言切换能力,可在对话中异步调用工具,适用于企业客户服务和交互式场景,当前仅在 Gemini Enterprise 中提供。
推荐理由:原文说明了实时视频生成与语音同步、多语言支持和异步工具调用能力,企业用户可据此评估其在客户服务或交互式场景中的应用潜力。
Hyper3D 上线 Agentic Mode,将 Hyper3D Rodin 与 LLM 多模态上下文分析能力整合,实现自主理解输入并选择建模路径。该模式支持从非标准素材中提取主体信息、自动增强细节,并能生成可调整的 Low-poly N-GONS 模型与动画预设。
Hugging Face 发布了 LFM2.5-VL-3B 的 DSpark 草稿模型,推理速度在设备端最高提升 3.13 倍,在 H100 GPU 上最高提升 2.66 倍,参数量增加约 280M,仅占原模型的 8.9%。
Remedy Entertainment 的《CONTROL Resonant》本周在 GeForce NOW 云游戏平台上线。购买 12 个月 GeForce NOW Ultimate 会员至 9 月 27 日可免费获得该游戏,并享受 GeForce RTX 5080 级别的云端性能。此外,GeForce NOW 支持即将登陆 Googlebooks 笔记本电脑,且本周另有九款新游戏加入平台。
Vercel 将其私有的漏洞赏金计划与开源项目赏金计划合并,推出统一的公开 Bug Bounty 计划。该计划通过 HackerOne 平台运行,覆盖 Vercel 平台所有产品及开源项目。安全团队已优化流程以应对 AI 带来的报告量激增,致力于快速响应和透明沟通。
Midjourney 在 alpha.midjourney.com 上发布了最新一轮功能更新,包括样式预览、默认参数设置、创建界面视觉刷新、搜索与归档改进、编辑功能增强、项目组织优化等。用户现在可以在样式侧边栏中启用“实时预览”,并支持在项目流中切换网格或列表视图。韩语功能已于上周在 Alpha 版本上线,现已对所有 midjourney.com 用户开放。
vLLM 提出一种基于语言模型生成过程随机性的文本水印技术,通过双密钥机制在不改变输出分布的前提下实现可检测的溯源信号。该方法利用 Gumbel-max 技巧,在每个生成步骤中使用伪随机函数生成与上下文和候选 token 相关的可复现噪声,确保水印在文本被修改后仍可识别。实验显示,Qwen3.5-27B 在启用双密钥水印后,GSM8K、MBPP 和 IFEval 的性能仅略有下降,误差范围重叠。
Meta 推出 Private Processing 技术,用于 AI 眼镜,确保用户数据在云端处理时对 Meta 不可见。该技术基于可信执行环境(TEE),通过加密存储和不可追踪性增强隐私保护。AI 眼镜需处理大量个人上下文信息,传统云架构无法满足隐私与计算需求,Private Processing 提供了安全的解决方案。
Gemini 3.8 Flash TTS 和 Flash-Lite TTS 发布,允许开发者根据描述生成声音并逐行控制语速、方言和表达方式。Claude 自主发现了一种此前未知的酶系统,与编程性遗传系统如 CRISPR 相关。Google 计划推出 Private AI Compute 内存,数据在云端加密存储,解密仅在回答请求时进行,且密钥保留在用户设备上。
Vercel Connect 新增对 TanStack AI 的支持,允许其构建的智能体通过 OAuth 安全调用 MCP 服务器而无需管理凭证。新的 `@vercel/connect/tanstack-ai` 子路径导出 `connectMCPTransport` 函数,可在每次 MCP 请求前自动附加认证提供者以获取最新 token。
GitHub Copilot 应用重构了 Pull Request 视图,以应对包含 2200 个文件、超百万行更改和 400 多条行内评论的极端大型代码审查场景。新架构将文档高度拆分为确定性的代码几何与动态区块几何两部分,解决了评论内容高度不可预测导致的滚动跳跃问题。通过虚拟化、惰性测量和独立几何管理,确保了即使在超大规模差异和对话下,审查体验依然快速流畅。
Google Beam 宣布将其全球覆盖范围扩展至美国、加拿大、英国、法国、德国和日本六个国家。一项为期八周的内部研究显示,使用 Beam 的 Google 团队感觉彼此联系紧密程度提升了 50%,并减少了 21% 的后续会议需求。Google 还与 Industrious 合作创建首个 Beam 扩展网络,并已获得 Netflix 等首批客户。
OpenAI于9月22日发布GPT-6 Sol和Luna模型,将价格下调50%,其中GPT-6 Sol输入价格为每百万token 2美元,输出为10美元;GPT-6 Luna输入为0.10美元,输出为0.50美元,均低于前代GPT-5.6对应模型。
推荐理由:原文给出了GPT-6 Sol和Luna的定价细节和对比,读者可以据此判断其在企业级应用中的成本优势和竞争定位。
Microsoft Research 的研究表明,将物理 AI 机器人的推理任务从机载 GPU 卸载到边缘或云端,能显著提升任务成功率并延长电池续航。在移动操作任务中,卸载推理使障碍物及时检测率提升30%,并将机器人手臂交接物体的成功率提高了50%。该研究还引入了基于 Kubernetes 的工具集,用于在机器人、边缘和云端之间容器化与编排 AI 工作负载。