Gemini 推出连接应用新功能
Gemini 开始推出连接应用功能,用户可在单一界面管理项目、设计创意资产和规划健身计划。此次更新支持连接 Airtable、Linear、Adobe 等多个领域的工具,涵盖生产力、创意和生活方式类应用。用户可通过设置或在聊天中使用 @ 提及或直接提问来调用这些应用。
Gemini 开始推出连接应用功能,用户可在单一界面管理项目、设计创意资产和规划健身计划。此次更新支持连接 Airtable、Linear、Adobe 等多个领域的工具,涵盖生产力、创意和生活方式类应用。用户可通过设置或在聊天中使用 @ 提及或直接提问来调用这些应用。
Google 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款新语音模型,支持通过自然语言提示创建自定义角色声音、复制语音、多语言生成及双人对话场景控制。
Neo4j 2026.09 版本引入重评分二进制向量搜索,相比 2026.08 版本,检索吞吐量提升约 5 倍,查询延迟也更优。该技术通过使用高度压缩的二进制量化向量进行初步搜索,再用完整精度向量进行重评分,显著降低内存占用。在 768 维 Float32 嵌入向量场景下,相同内存预算下可存储的向量数量约为之前标量量化(8 位)的 4 倍。
Google 的 Gemini 3.8 Flash-Lite TTS 和 Gemini 3.8 Flash TTS 模型现已在 AI Gateway 平台可用。两款模型支持超过 100 种语言的文本转语音,具备长文本叙述、音调语速控制和双人对话功能。开发者可通过 AI SDK 7 或更高版本调用模型 ID 进行语音生成。
Vercel Sandbox 的 Drives 功能已在 Hobby、Pro 和 Enterprise 计划中开放公开测试版。Drives 是一种持久存储,可作为目录挂载到沙盒中,用于保存 AI 智能体的工作区或磁盘记忆,并可跨不同沙盒实例复用。每个沙盒最多可挂载四个 Drives,默认最大容量为 1 TiB,并可配置至 16 TiB。
TLDR AI 汇总了 OpenAI 推出 GPT-6 Sol 和 Luna、Anthropic 发布 Claude Opus 5.5、Google 发布 RRSI 方法等动态,同时提及 SWE-Bench Pro V2 评测结果、vLLM 硬件无关层进展及 OpenAI 与 Anthropic 首席执行官将出席联合国安理会 AI 安全会议。
NVIDIA Confidential Computing 通过内存加密的机密虚拟机与机密 GPU,为处理敏感信息的大语言模型推理工作负载提供可信执行环境。该方案旨在满足个人、企业及受监管场景下对数据与模型上下文隐私保护的需求。
NVIDIA 推出 Topograph,通过拓扑感知调度优化 AI 工厂中 GPU 工作负载的放置。该技术旨在减少因拓扑域碎片化和跨共享链路通信导致的吞吐量下降与作业成本上升问题,从而提升整体系统效率。
vLLM 正在引入一套新的硬件无关层,旨在确保项目在追求前沿 GPU 性能的同时,能继续支持多样化硬件和模型。这套新层遵循可编译、可扩展、隔离和可移植四大设计原则,已在 transformers 后端中提供初步支持。在 NVIDIA H100 GPU 上的测试表明,其 token 吞吐量与原生实现相比差距在 3.4% 以内。
NVIDIA 为游戏开发者推出 DLSS 5,其核心是 DLSS 3D-Guided Neural Rendering 技术和精细控制功能,可帮助开发者添加逼真的光照与材质细节。同时更新的还包括 NVIDIA ACE、RTX Mega Geometry 2.0 以及 RTX Kit,涉及角色 AI、高密度几何体和渲染工作流。
OpenAI 的 GPT-6 Sol 和 GPT-6 Luna 模型现已在 Vercel AI Gateway 上线。GPT-6 Sol 适用于需要持续调查的复杂编码和智能体工作流,GPT-6 Luna 则是高吞吐量、重复性任务的高性价比选择。相比 GPT-5.6,两者在事实可靠性、沟通直接性和避免误导性代码完成声明方面有所改进。
推荐理由:Vercel AI Gateway 新增了 OpenAI 的两个 GPT-6 变体,并说明了各自在价格、适用场景和可靠性上的定位差异。
vLLM 官方发布 vllm-metal v0.28.0,将 vLLM 的调度器、分页 KV 缓存和 OpenAI 兼容服务移植到 Apple Silicon,通过 MLX 和 Metal 执行。
推荐理由:原文给出了在 Apple Silicon 上并发服务的性能数据和部署方式,读者可以据此判断其在本地推理场景下的可用性与效率提升。
Anthropic 正在测试其即将发布的 Opus 5.5,该模型可能在本周宣布,传闻其输入 token 价格为 $4/百万,输出 token 价格为 $20/百万。
Anthropic 的 Claude Opus 5.5 模型现已在 Vercel AI Gateway 上线,可通过 anthropic/claude-opus-5.5 调用。
推荐理由:原文给出了新模型在 Vercel AI Gateway 上的可用性、核心能力变化和关键 API 变更,读者可以据此判断如何接入和使用。
NVIDIA TensorRT 11.0 引入了多设备推理功能,允许单个 TensorRT 网络利用 NCCL 分布式集合在多个 GPU 上执行,同时保持 TensorRT 的推理优化。该功能旨在解决生成式 AI 对计算和内存日益增长的需求,并已在 NVIDIA Dynamo-Triton 中得到支持。
Vercel Connect 新增了对 Microsoft Teams 的托管连接器支持。该连接器可为组织创建一个 Teams 机器人,供应用和智能体运行,用户可在频道中 @提及或直接发送消息,代码将以机器人身份接收并回复消息。作为 Vercel 托管连接器,Vercel 会在租户中注册 Entra 应用和 Azure Bot 资源,无需存储客户端密钥,管理员完成一次性设置即可。
NVIDIA Earth-2 平台帮助能源、应急管理等天气敏感行业整合来自资产、雷达和卫星的本地观测数据。该平台旨在利用这些实时数据,辅助组织理解和应对跨领域的物理风险。
Cloudflare Python Workers 现已正式发布,成为 Cloudflare 开发者平台的一等支持语言。Python Workers 原生支持所有 Cloudflare 绑定,开发者能以 Pythonic 方式无缝使用 Workers AI、R2、D1 等服务,并可直接运行 FastAPI、Django、Flask 等流行 Web 框架。
Vercel AI Gateway 现已支持通过现有 TypeSafe 客户端或 HTTP API 调用 TypeSafe AI 的 Jev 概率决策模型。Jev 接收状态并输出带有概率的强类型答案,无需解析生成文本。所有调用路径均通过 AI Gateway 计费,并可在使用情况和可观测性面板中与其他模型调用一同查看。
Meta 开放开发者构建 Muse connectors,开发者提供 API,Muse 负责智能体、浏览器和上下文处理,提交后需通过功能、安全和法律审查。Meta SAM 3.1 可在图像和视频中检测、分割和跟踪对象,通过 Meta Model API 提供服务,每 1000 张图像收费 $2.50,每 1000 帧视频收费 $0.20。
小米的 MiMo V2.6 Pro、MiMo V2.6 Flash 和 MiMo V2.6 Pro UltraSpeed 三款模型现已在 AI Gateway 平台上线。
SpaceXAI 的 Grok 4.7 现已在 Vercel AI Gateway 上提供,模型 ID 为 spacexai/grok-4.7。在 9 月 27 日前使用该模型的请求自动享受 40% 折扣。
推荐理由:原文提供了 Grok 4.7 在 Vercel 平台的具体接入方式和限时折扣,读者可以据此评估其部署成本和使用门槛。
mcp-handler v2.2.0 版本新增了对 WebMCP 标准的实验性支持,允许开发者通过添加脚本标签将现有 MCP 工具暴露给浏览器内的智能体。该功能通过代理调用支持已登录用户的认证工具,无需浏览器端 OAuth 流程。
Vercel 的 AI 代码生成工具 v0 现支持通过共享环境变量读取 npm 凭据,以安装私有包和自定义注册表中的依赖。团队可使用 `NPM_TOKEN` 访问 registry.npmjs.org 的私有包,或使用 `NPM_RC` 配置多个自定义注册库。凭据可标记为敏感信息,v0 不会将其暴露给模型或写入沙盒文件系统。
Google 的 Envisioning Studio 与设计师 Jane Wade 和 Sergio Hudson 合作,利用 Google Flow AI 创意工作室开发了两款定制工具。
Jev 在 Vercel AI Gateway 上线 24 小时内,付费团队使用率达到了 13%,是 GPT-5.6 家族的两倍多,Fable 5.1 的六倍多,成为该平台历史上采用最快的模型。Jev 是一款由 TypeSafe AI 推出的概率决策模型,专为软件内的结构化决策设计,可并行评估问题并返回带概率的答案,据称在自身工作流评估中比大语言模型快 194 倍、便宜 445 倍。
推荐理由:原文提供了 Jev 在 Vercel AI Gateway 上的具体采用数据和性能对比,读者可以据此评估其市场接受度和技术定位。
Claude Projects v2 支持通过对话管理云端项目,利用线程实现并行操作并提升任务执行效率,目前处于 Beta 阶段,面向部分订阅者开放。Google 家庭智能体基于云计算机和账户运行,可处理家庭共享的邮件、文件和日历,协调最多六人活动,美国实验项目需排队等候。
GLM 5.3 FlashX 现已通过 AI Gateway 提供服务,支持以约 200 tokens 每秒的速度进行推理,适用于代码智能体、工具循环和交互式应用。该模型可通过 API 格式调用,并支持自定义报告、API 密钥预算、路由规则等功能。AI Gateway 不加价反映模型提供方定价,且不收取平台费用,包括 Bring Your Own Key 请求。
Vercel CLI 现在支持在一秒内部署静态资源,用户可通过命令 `vercel deploy` 立即分享原型、发布 HTML 报告或预览代码智能体生成的页面。该功能适用于包含最多 10 个 HTML 或 Markdown 文件、总大小不超过 5 MB 的目录,且支持 .html、.htm 和 .md 文件扩展名。需升级至 Vercel CLI 59.16.0 或更高版本以使用此功能。
Vercel 博客宣布,Turbo build machines 现在支持按每个部署单独启用。用户可通过在 Git 提交信息中添加 #VERCEL_BUILD_MACHINE=TURBO、使用 Vercel CLI 59.20.0 或更高版本的 vc deploy --turbo 命令,或在创建部署时将 buildMachine 设置为 turbo 实现。
联合国系统与 Google 合作推出开源平台 UN System Data Commons,整合了全球关键统计数据。该平台基于 Google 的 Data Commons 构建,提供自然语言搜索和交互式可视化功能,并支持通过 Model Context Protocol (MCP) 让 AI 智能体直接获取权威数据。平台目标是到 2027 年纳入 80% 的联合国系统统计数据集。
Gemini 3.8 Live 支持实时对话,允许用户摆脱传统的提示词-响应结构进行交互。
Vercel Sandbox 现已支持运行 Harbor 评测,用户可通过 harbor run 命令在隔离的 Firecracker microVM 中并行执行 Terminal-Bench 等基准测试。
推荐理由:原文提供了在 Vercel Sandbox 上运行 Harbor 评测的具体命令和配置方式,读者可直接复用以并行化多模型基准测试。
Vercel skills CLI 1.7.0 版本新增支持从 Notion 页面安装智能体技能,用户可通过命令 npx skills add notion 浏览并安装共享的技能包,或直接传入 Notion 页面 URL 安装单个技能,依赖 Notion CLI 进行认证,技能权限由 Notion 页面权限控制。
LangChain 发布开源智能体助手 Deep Life Sci,支持访问 ClinicalTrials.gov、PubMed 和 PubMed Central 的超 600 万项临床试验记录与 4100 万篇文献,可并行处理文档并运行代码分析,提供可审计的全流程追踪与评估能力,适用于基因组学、临床试验数据提取与文档自动化等场景。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
WRITER 的 AI 智能体与 Palmyra X6 基础模型能帮助外部销售代表规模化处理个性化沟通。系统通过连接器整合 Salesforce 和 Outlook 数据,为每次会议生成个性化简报与后续跟进草稿,并内置合规审查功能。这解决了销售代表在管理数百名顾问时,因信息分散和准备时间不足而难以建立深度信任关系的挑战。
Neo4j 推出 GraphAware Financial Crime Intelligence 和 Virtual Graph 等新功能,支持企业级 AI 应用扩展与复杂问题解决。
Neo4j 推出 Virtual Graph 功能,允许用户在 Snowflake、Databricks 和 Google BigQuery 等数据仓库中直接创建和查询知识图谱,无需复制数据。
Ming-Image 0.1 是一个开源的视觉设计生成与可编辑图层分解模型系列,包含两个 6B 参数模型:Ming-Image-0.1-Design 用于生成 UI、信息图、海报等视觉设计,Ming-Image-0.1-Design-Layer 用于将扁平化设计图像分解为独立可编辑的透明图层。
OpenAI 的全双工语音模型 GPT-Live 1 已在 Vercel AI Gateway 上线,支持同时听与说,无需等待对方说完。该模型还支持客户端委托,允许应用在语音会话进行时,调用 AI Gateway 上的任何文本模型(如 GPT-5.6-sol)处理深度任务,委托请求单独计费。
推荐理由:原文介绍了全双工语音交互和客户端委托的具体实现方式,读者可以据此评估其技术特点和应用潜力。