跳到正文
9月28日周一
  1. NVIDIA · 开发者博客43

    NVIDIA OpenShell 为 AI 智能体添加运行时控制功能

    NVIDIA OpenShell 为 AI 智能体提供运行时控制功能,使其能根据新信息持续执行任务。该工具支持智能体在长时间运行中访问工作空间、计算资源、数据、凭证和外部服务。NVIDIA 开发者博客指出,这一功能扩展了智能体在软件故障分析、实验运行和业务关键操作中的应用潜力。

  2. 开源中国16

    ShopXO 免费开源商城系统 v6.9.2 版本发布

    ShopXO 免费开源商城系统发布 v6.9.2 版本,新增 AI 大模型插件、AI 编辑器插件、商品助手插件、后台经营助手插件、以图搜款插件、商品高级购买插件和文档插件。该版本还新增了后台功能快速搜索功能,支持 DIY、主题和页面设计。

9月27日周日
9月26日周六
  1. 极客公园31

    Deepseek 桌面版悄然上线;Anthropic 与 Akamai 达成 7 年 116 亿美元合作;扎克伯格因 Muse 成为全球第四大富豪

    DeepSeek Harness 桌面版上线,提供办公科研、代码开发等使用方向及多种工作模式。Anthropic 与 Akamai 签署 7 年 116 亿美元合同,用于扩充 CPU 算力。扎克伯格因 Meta 推出的 Muse 人工智能助手,身家达 2664 亿美元,位列全球第四大富豪。

  2. CNET · AI49

    Gemini Live Avatar 为 AI 智能体配上虚拟形象,引发用户不适

    Google 为 Gemini Enterprise 用户推出了 Live Avatar 功能,能将 AI 智能体与可交互的虚拟形象结合,用于视频聊天处理保险理赔等任务。该功能支持唇形同步、实时音频视频处理,并能同时运行工具和 API 调用。目前仅提供预制的虚拟形象供企业选择,所有音视频内容均使用 SynthID 进行水印以验证其 AI 生成属性。

9月25日周五
  1. Cloudflare · AI50

    Cloudflare 推出 Turnstile Spin,支持 AI 智能体自动配置网站安全验证

    Cloudflare 推出 Turnstile Spin,让 AI 智能体能够自动完成 Turnstile 验证系统的端到端部署。该功能可将原本需要前后端分别配置的两步流程,简化为由智能体引导的自动化工作流,支持全新安装、修复未验证的组件以及从其他 CAPTCHA 迁移。自 7 月发布以来,已成功创建超过 65,000 个 Spin widget。

  2. Microsoft 官方博客67

    Microsoft 推出新版 Copilot,新增 Home、Code 和 Autopilot 功能

    Microsoft 推出新版 Copilot,新增 Home、Code 和 Autopilot 三大功能。Home 整合 Chat 与 Cowork,集成 Word、Excel、PowerPoint 实时协作;Code 允许非开发者用自然语言构建应用,基于 GitHub Copilot 技术运行于安全沙箱;Autopilot 是持续工作的智能体,可自主执行任务并跨应用协作。

    推荐理由:原文给出了新功能模块的定位、能力边界和开放路径,读者可以据此判断它会怎样改变现有工作流。

  3. CNET · AI44

    Google 的 Gemini AI 新增“帮我打电话”功能及其潜在问题

    Google 为移动端 Gemini AI 推出了可代用户进行日常电话呼叫的智能体功能。该功能目前仅限美国、18岁以上、拥有 Pixel 11 或更新机型并订阅 Google AI 服务(每月 5 美元起)的用户使用,且设计上不会进行支付或分享信用卡号等敏感信息。其实际效果受限于企业是否愿意与 AI 对话、每日呼叫次数限制以及处理语音信箱等常见场景的能力。

  4. Midjourney 更新32

    Midjourney 更新:新增编辑功能、缩略图预览及其他改进

    Midjourney 在 alpha.midjourney.com 推出了编辑模型,支持对图像进行局部修改并保持画质,同时改进了 inpainting 和 outpainting 功能。用户可通过缩略图预览不同风格下的提示词效果,并使用“Live previews”功能实时查看。此外,--tile 参数在 V8.1/8.2 版本中优化,使拼接图像的接缝更不明显。

  5. LangChain 博客41

    LangSmith Engine v2 新增红队测试与自动化检测功能

    LangSmith Engine v2 引入红队测试功能,用于主动发现智能体在生产环境中的潜在问题,如幻觉和系统提示违规。该版本可检测更隐蔽的性能问题,如延迟和成本趋势,并在提交修复前自动验证其有效性。目前红队测试功能已向现有 LangSmith 部署用户开放私有测试,支持 SaaS 部署的 Plus 和 Enterprise 计划用户可立即启用。

  6. Google DeepMind54

    Gemini 3.8 Live 与 Live Avatar 功能上线

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,通过低延迟视频流与语音同步,实现企业级虚拟代理的近实时视觉交互。该功能支持多语言无缝切换、异步工具调用与持续对话,具备精确唇形同步与自然表情,企业可通过参考图像定制专属动画形象,目前仅对 Gemini Enterprise 用户开放。所有生成内容均嵌入 SynthID 水印以确保可追溯性。

    推荐理由:原文给出了功能组合和企业可用性,读者可以据此判断其在交互场景中的部署价值。

9月24日周四
  1. LangChain 博客68

    LangChain 发布 LangSmith Fine-Tuning 工具

    LangChain 发布 LangSmith Fine-Tuning 及其 CLI 工具 smithtune,支持从 LangSmith 轨迹数据中自动构建训练集、使用 Fireworks 或 Baseten 进行 LoRA 微调,并在 LangSmith 中评估模型性能。该工具专为后训练优化设计,支持监督微调(SFT),可提升模型在特定任务上的表现,同时降低推理成本与延迟。

    推荐理由:原文给出了从数据到训练再到部署的完整流程,读者可以据此评估其对开发效率的影响。

  2. LangChain 博客43

    Managed Deep Agents 0.8 发布:新增用户级记忆、身份认证与多渠道支持

    Managed Deep Agents 0.8 新增用户级记忆、身份认证、HTTP 通道和 Slack 文件传输功能,支持更安全的生产环境代理运行。该版本通过 LangSmith Context Hub 提供持久化记忆存储,区分代理级和用户级上下文,防止信息泄露。用户可通过配置访问策略控制记忆使用范围,适用于客服、研究等多场景。

  3. Google · Gemini 博客58

    Google 推出 Gemini 3.8 Live with Live Avatar

    Google 推出 Gemini 3.8 Live with Live Avatar,支持实时视频生成与语音同步,具备自然唇形同步、表情和多语言切换能力,可在对话中异步调用工具,适用于企业客户服务和交互式场景,当前仅在 Gemini Enterprise 中提供。

    推荐理由:原文说明了实时视频生成与语音同步、多语言支持和异步工具调用能力,企业用户可据此评估其在客户服务或交互式场景中的应用潜力。

  4. NVIDIA Blog20

    CONTROL Resonant 登陆 GeForce NOW 云游戏平台

    Remedy Entertainment 的《CONTROL Resonant》本周在 GeForce NOW 云游戏平台上线。购买 12 个月 GeForce NOW Ultimate 会员至 9 月 27 日可免费获得该游戏,并享受 GeForce RTX 5080 级别的云端性能。此外,GeForce NOW 支持即将登陆 Googlebooks 笔记本电脑,且本周另有九款新游戏加入平台。

  5. Midjourney 更新31

    Midjourney 更新 Alpha Changelog - 9/23/26

    Midjourney 在 alpha.midjourney.com 上发布了最新一轮功能更新,包括样式预览、默认参数设置、创建界面视觉刷新、搜索与归档改进、编辑功能增强、项目组织优化等。用户现在可以在样式侧边栏中启用“实时预览”,并支持在项目流中切换网格或列表视图。韩语功能已于上周在 Alpha 版本上线,现已对所有 midjourney.com 用户开放。

  6. vLLM 官方博客36

    vLLM 如何通过双密钥水印技术实现文本溯源

    vLLM 提出一种基于语言模型生成过程随机性的文本水印技术,通过双密钥机制在不改变输出分布的前提下实现可检测的溯源信号。该方法利用 Gumbel-max 技巧,在每个生成步骤中使用伪随机函数生成与上下文和候选 token 相关的可复现噪声,确保水印在文本被修改后仍可识别。实验显示,Qwen3.5-27B 在启用双密钥水印后,GSM8K、MBPP 和 IFEval 的性能仅略有下降,误差范围重叠。

  7. Engineering at Meta47

    Meta 将 Private Processing 技术扩展至 AI 眼镜

    Meta 推出 Private Processing 技术,用于 AI 眼镜,确保用户数据在云端处理时对 Meta 不可见。该技术基于可信执行环境(TEE),通过加密存储和不可追踪性增强隐私保护。AI 眼镜需处理大量个人上下文信息,传统云架构无法满足隐私与计算需求,Private Processing 提供了安全的解决方案。

  8. TLDR AI31

    Gemini TTS 🗣️, Claude’s novel enzyme 🧬, Google private memory 🔒

    Gemini 3.8 Flash TTS 和 Flash-Lite TTS 发布,允许开发者根据描述生成声音并逐行控制语速、方言和表达方式。Claude 自主发现了一种此前未知的酶系统,与编程性遗传系统如 CRISPR 相关。Google 计划推出 Private AI Compute 内存,数据在云端加密存储,解密仅在回答请求时进行,且密钥保留在用户设备上。

  9. Vercel 博客37

    Vercel Connect 现已支持 TanStack AI

    Vercel Connect 新增对 TanStack AI 的支持,允许其构建的智能体通过 OAuth 安全调用 MCP 服务器而无需管理凭证。新的 `@vercel/connect/tanstack-ai` 子路径导出 `connectMCPTransport` 函数,可在每次 MCP 请求前自动附加认证提供者以获取最新 token。

  10. GitHub Blog · AI & ML34

    GitHub Copilot 应用如何渲染超大型 Pull Request

    GitHub Copilot 应用重构了 Pull Request 视图,以应对包含 2200 个文件、超百万行更改和 400 多条行内评论的极端大型代码审查场景。新架构将文档高度拆分为确定性的代码几何与动态区块几何两部分,解决了评论内容高度不可预测导致的滚动跳跃问题。通过虚拟化、惰性测量和独立几何管理,确保了即使在超大规模差异和对话下,审查体验依然快速流畅。

  11. Google · AI Blog30

    Google Beam 扩展至新区域并新增合作伙伴与客户

    Google Beam 宣布将其全球覆盖范围扩展至美国、加拿大、英国、法国、德国和日本六个国家。一项为期八周的内部研究显示,使用 Beam 的 Google 团队感觉彼此联系紧密程度提升了 50%,并减少了 21% 的后续会议需求。Google 还与 Industrious 合作创建首个 Beam 扩展网络,并已获得 Netflix 等首批客户。

  12. AI Business59

    OpenAI发布GPT-6 Sol和Luna模型并大幅降价

    OpenAI于9月22日发布GPT-6 Sol和Luna模型,将价格下调50%,其中GPT-6 Sol输入价格为每百万token 2美元,输出为10美元;GPT-6 Luna输入为0.10美元,输出为0.50美元,均低于前代GPT-5.6对应模型。

    推荐理由:原文给出了GPT-6 Sol和Luna的定价细节和对比,读者可以据此判断其在企业级应用中的成本优势和竞争定位。

  13. Microsoft Research49

    Microsoft Research 研究:为物理 AI 机器人卸载推理可提升性能与续航

    Microsoft Research 的研究表明,将物理 AI 机器人的推理任务从机载 GPU 卸载到边缘或云端,能显著提升任务成功率并延长电池续航。在移动操作任务中,卸载推理使障碍物及时检测率提升30%,并将机器人手臂交接物体的成功率提高了50%。该研究还引入了基于 Kubernetes 的工具集,用于在机器人、边缘和云端之间容器化与编排 AI 工作负载。