Meta 推出开源项目 Muse Gadgets,让开发者构建连接 Muse AI 的硬件
Meta 推出了开源项目 Muse Gadgets,允许开发者构建连接其个人 AI 助手 Muse 的自定义硬件。该项目提供了开源固件、Linux SDK 及项目构想,支持用户利用树莓派或 ESP32 等开发板连接显示器、按钮和传感器。Meta 已基于此制作了 5000 个名为 Muse Home Link 的 USB-C 设备,免费赠送给 Muse 订阅者以连接家庭网络中的智能设备。
Meta 推出了开源项目 Muse Gadgets,允许开发者构建连接其个人 AI 助手 Muse 的自定义硬件。该项目提供了开源固件、Linux SDK 及项目构想,支持用户利用树莓派或 ESP32 等开发板连接显示器、按钮和传感器。Meta 已基于此制作了 5000 个名为 Muse Home Link 的 USB-C 设备,免费赠送给 Muse 订阅者以连接家庭网络中的智能设备。
PyTorch 与 Linux Foundation Education 合作推出了新的 PTCA 认证路径,将四个自定进度的学习模块与 PTCA 认证考试整合为一个结构化学习体验。该路径涵盖张量操作、数据处理、神经网络构建和模型优化等核心技能,总计包含 15-17 小时的学习与实践。该认证旨在验证初学者对 PyTorch 核心概念和工作流程的理解。
OpenAI 本周发布了新的智能体平台 Dots,作者对其进行了实测。Dots 界面类似 Meta 的 Muse,拥有可自定义的虚拟形象,但更偏向企业软件,能访问 Blender、GIMP 等应用,并通过桌面 ChatGPT 应用连接用户电脑。
Google 在2026年9月发布了新一代前沿模型 Gemini 4 Argon,其具备高级推理能力,并拥有行业领先的100万token输出上限,专为应对网络安全防御等复杂挑战而设计。
Cloudflare 通过 AI Gateway 推出 Web Search API,使 AI 智能体能获取实时网络信息。该 API 与 Ceramic.ai、Exa 和 Linkup 等合作伙伴共同推出,其网络爬虫遵守 Cloudflare 的“Verified bots”标准并尊重 robots.txt。
NVIDIA 发布 DGX Spark 64GB 内存配置,为开发者提供更低成本的本地 AI 开发与部署平台。该配置支持高达 1000 亿参数的模型完全在设备上运行,并可通过 NVIDIA Sync Cluster Assistant 将两台设备集群,将内存扩展至 128GB,在 Qwen 3.8 27B 测试中实现最高 1.7 倍的性能提升。
推荐理由:NVIDIA 为 DGX Spark 推出更低内存配置,降低了本地 AI 开发的门槛,并展示了通过集群扩展性能的具体方法。
OpenAI 在 DevDay 2026 上宣布了一系列产品和开发者更新。GPT-6.1 Sol 模型在多项评测中接近 GPT-6 Astra,但输入/输出 token 价格仅为后者的五分之一。
推荐理由:原文详细列举了多项产品更新及其开发者接口,读者可以据此评估 OpenAI 平台向持续智能体工作流的转变。
DigitalOcean 推出托管云基础设施服务 DigitalOcean Managed Agents,旨在解决 AI 智能体在生产环境中的部署和扩展难题。该服务包含 Harness Runtime 和 Action Gateway 两个核心组件,前者提供基于 microVM 的隔离、持久化计算环境,后者通过统一 MCP 端点提供超过 16,000 种工具的安全访问。
Docker 宣布将 Sandbox Kit 规范提交给 CNCF,旨在将 AI 智能体可访问的权限与其自身一样实现可移植性。该 Apache 2.0 规范(v3 版本)将智能体、其工具以及请求的主机、凭证和卷的类型化列表打包成一个标准的 OCI 镜像。
Pi 1.0 和 Pi Durable 发布,前者为 Agent 开发框架增加了对 MCP、Jev 和图像模型的原生支持、扩展支持、缓存预热等功能,后者将 Pi 用 TypeScript 重写,实现了崩溃恢复、可移植性、并发、可扩展性、上下文管理、多人协作和热更新等状态持久化特性。
NVIDIA 推出新的安全平台,为 AI 智能体增加了控制措施,但企业仍需负责定义其权限和设定边界。
微软为其 MAI 模型家族新增了首个流式转录模型 MAI-Transcribe-2-Streaming 以及两款文本转语音模型 MAI-Voice-2.1 和 MAI-Voice-2.1-Flash,旨在帮助开发者构建能即时回应的语音智能体。
苹果首款配备 OLED 显示屏的 MacBook Pro 或最快本月发布,将带来屏幕结构、机身厚度和摄像头区域的大幅调整。AI 能力获取成本自 2023 年以来平均每季度下降约 47%,三年内下降数千倍,远超其他关键技术。Figure 让 F.02 人形机器人跳入熔炉举行「火化仪式」,致敬《终结者 2》,该想法源自施瓦辛格本人提议。
OpenAI 推出 GPT-6 Astra Ultrafast 模式,在 NVIDIA Blackwell GPU 上运行,通过 API 和 ChatGPT Work、Codex 向符合条件的用户开放。
Genie One 作为基于企业业务上下文的AI协作者,帮助财务团队快速分析预算差异、现金流趋势、财务关账异常和支出模式,支持使用自然语言提问并基于已批准的指标定义和组织逻辑生成可信结果。该工具可将原本需数日完成的分析缩短至数分钟,支持创建可复用的工作流与自动化报告,结果可自动推送至聊天和邮件。目前已在Coty、Unilever等企业落地,提升财务洞察效率与响应速度。
IBM 宣布其智能体软件开发平台 IBM Bob 提供自托管部署选项,允许企业在自有基础设施内使用 AI 构建和现代化应用。该选项支持本地、私有云、主权云和物理隔离环境,使客户能更好地控制数据驻留、安全策略和开发工作流。平台保留了 BobShell IDE、并行工具调用等核心功能,并支持本地运行 Nvidia Nemotron 等模型或通过混合配置连接外部模型服务。
Amazon Quick 为其 AI 构建的 Quick Apps 推出 Live Data in Apps 功能,允许应用在每次打开时实时查询受治理的 Quick Sight 数据集,而非依赖构建时的静态快照。
NVIDIA 为 DOCA 软件平台引入了 Agent Skills,使 AI 智能体能够理解并操作 BlueField DPU 的专用基础设施。这些技能让智能体能够生成准确的配置代码,减少开发过程中的猜测和修正周期,从而加速应用部署。
NVIDIA 开源了 Do Inference Now (DIN) Deploy,这是一个 C++ 示例集合,用于将 AI 模型集成到本地应用中。它结合了 ONNX Runtime 与 NVIDIA TensorRT RTX 执行提供程序,为开发者提供了从模型检查点到原生应用部署的桥梁。
高通在Snapdragon Summit 2026上推出两款Snapdragon 8 Elite Gen 6 SoCs,分别面向高端智能手机和极端性能场景。这两款芯片基于不同设计,体现了高通在智能体AI领域的持续投入。分析师Jim McGregor和Francis Sideco在视频中讨论了该技术对移动、可穿戴设备和PC领域的影响。
Google发布Gemini 4 Argon模型,仅向经过审核的网络安全专家开放,以防范潜在滥用风险。该模型在软件工程、法律、金融和网络安全任务中表现突出,能发现关键软件漏洞。Google已向美国政府提供早期访问权限,并将根据测试反馈决定是否全面开放。
Amazon Quick Sight 推出层级过滤器,允许作者在单一控件中提供多级过滤选项,减少界面杂乱并引导读者更快定位数据。该过滤器支持最多五级层级(如 Region → Sub-Region → Country → City → Town),可跨图表应用,无需单独设置多个过滤器。用户可通过拖拽调整层级顺序,且默认仅应用于当前图表,可切换为跨图表应用。
PS5 模拟器 SharpEmu 从 5 月的 Alpha 阶段发展到可加载真实游戏 eboot.bin 文件并执行原生 CPU 指令,部分支持 GPU 功能。已有 10 款游戏被标记为可玩,包括 Tetris Forever、Astro Bot 和 Demon’s Souls 重制版。另一款 KytyPS5 模拟器上周发布首个公开版本,支持 134 款游戏但多数存在严重 bug。
AWS 开源了轻量级决策模型 Strands Decider 2B,旨在通过不生成文本来快速决策,以加速 Agent 工作流。该模型基于 Qwen3.5-2B 微调,仅用 1M 参数的‘指针头’替换传统 LLM 头,优化了本地部署和低延迟(<150ms)。
Cloudflare 发布其训练的开源决策模型 Clef 和 Clef-flash,并推出新的强化学习微调平台。Clef 模型在 Jev Decision Index 基准测试中领先,支持 64k 上下文窗口和视觉编码,并托管于 Workers AI 以降低延迟。模型已在 Hugging Face 以 Apache 2.0 许可证开源。
推荐理由:原文提供了决策模型的具体能力、基准测试结果和微调平台细节,读者可以据此评估它如何提升智能体工作流的效率和确定性。
Boston Dynamics 发布 Atlas 机器人新型机械手,具备13个自由度、可实现手指分展,支持工具操作与高强度任务,设计聚焦可靠性、可制造性和低成本,不追求外观类人化。该手采用直接驱动结构,单个执行器模块可快速更换,支持大规模生产。
Cloudflare 宣布其 Workers AI 平台接入两个欧洲开源大模型 EuroLLM 和 Apertus,并开放访问申请。EuroLLM 支持 35 种语言,包括所有 24 种欧盟官方语言;Apertus 在超过 1500 种语言的 15 万亿 token 上训练,其架构、权重、训练数据和方法均已公开。
推荐理由:原文介绍了两个欧洲开源模型接入其平台,并提供了具体的技术细节和申请入口,读者可以据此评估其多语言能力和合规设计。
Cloudflare OS 宣布开放全托管部署的候补名单,用户可通过仪表板快速启动组织专属的智能体工作空间。本次更新新增了连接 GitHub 仓库进行代码操作、改进 Google Workspace 集成以处理邮件和文档,以及支持将工作成果导出为 Excel、PDF 等多种格式的功能。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
Cloudflare AI Search 现已正式可用,新增了对多模态格式的原生支持,包括图像嵌入、PDF的OCR以及更大的文件处理能力。计费将于2026年11月1日开始,所有 Workers 计划仍提供免费额度。
推荐理由:原文详细说明了新增的多模态嵌入、文件处理和OCR功能,以及从预览到正式可用的计费模式变化。
TypeSafe AI 发布了名为 Jev 的决策模型,它不生成文本,而是返回带有概率分布和置信度的结构化答案,供软件直接调用。输入成本为每百万 token 0.042美元,输出免费,上下文窗口为 32k token,端到端延迟在 70ms 到 500ms 之间。
推荐理由:原文提供了定价、性能对比和早期采用案例,读者可以据此评估它是否适合替代现有分类或路由任务。
Microsoft 正式推出 Azure Container Apps Express 部署模型及其底层隔离计算层 Azure Container Apps Sandboxes。
Jev 是 TypeSafe AI 发布的一种新型 System One 模型,用于在无需生成文本的情况下进行快速、结构化的决策,支持分类任务中高达 200 倍的推理速度和 400 倍的成本降低。
苹果计划于10月13日推出代号J490的家庭控制中枢,支持声音和面部识别,并可控制智能家居设备。豆包新增机票和火车票预订功能,东方甄选宣布对溜溜凳进行双倍退款。DeepSeek开源昇腾平台基础组件,覆盖算子、计算与跨卡通信。
谷歌发布 Gemini 4 Argon,单次输出上限达约 100 万 tokens,定位长周期代码工程与企业知识工作,部分基准测试优于 GPT-6 Astra。中国生成式 AI 用户规模突破 7 亿,普及率超 50%,76% 用户会用其回答问题。美光 2026 财年归母净利润同比增长 895.07%,达 849.69 亿美元。
Convai Innovations 的评估/决策模型 Laya 现可通过 Vercel AI Gateway 使用,并在 2026年10月31日前通过 Boundless 服务免费。
Vercel 与 Microsoft AI 合作,将 MAI 模型引入其 AI Gateway 平台。平台新增支持 MAI-Voice-2.1、MAI-Voice-2.1-Flash 和 MAI-Transcribe-2 Streaming 三款音频模型,分别用于生成多语言语音、低延迟语音交互和实时音频转录。AI Gateway 按模型官方费率计费,不收取平台费用或推理加价。
Vercel Agent 新增了从 npm 和自定义注册表安装私有依赖包的能力。该功能通过读取 Vercel 上配置的共享环境变量(如 NPM_TOKEN 或 NPM_RC)进行身份验证,且凭证值不会进入 Agent 沙箱。npm、pnpm 和经典 Yarn 在 Agent 会话中的认证方式与 Vercel 构建过程保持一致。
Latent Space 播客采访了 OpenAI 计算机使用智能体产品负责人 Ari Weinstein 和 API 产品负责人 Nikunj Handa。Ari 解释了计算机使用智能体相比几个月前已‘180度不同’,现在更擅长调试和从失败中恢复,结合了截图、无障碍数据、DOM、Playwright 和生成代码等多种模态,并讨论了从‘比普通人快’到‘超人级’性能的路径。
推荐理由:访谈提供了 OpenAI 产品负责人对计算机使用智能体进展的内部视角,包括其能力变化、技术栈演进和未来方向。
Vercel AI Gateway 集成了 Browserbase Search 和 Fetch 工具,使支持工具调用的模型能访问实时网络信息并获取网页内容。开发者可通过单一 API 密钥跨模型提供商使用这些工具,并在切换模型时保持工具不变。这些助手功能已在 AI SDK 7.0.116 及更高版本中提供。
特朗普政府宣布推出基于 Google Gemini 和 xAI Grok 的官方聊天机器人 America.gov,旨在整合政府网站信息。该机器人目前可回答护照申请等常见问题,但用户发现其回应与总统言论相悖,并出现‘选民’独白等怪异输出,随后网站调整了部分回应。政府计划明年扩展其功能,使其能协助填写表格和申请工作。