NVIDIA 推出 CUDA Rust:提供两种编写 GPU Kernel 的路径
NVIDIA 宣布将大力投入 Rust 原生 GPU 编程,并计划在 2027 年及以后持续发展和完善 CUDA Rust 工具链。此举旨在为不断变化的 AI 模型和技术提供从推理引擎到智能体运行时的系统层支持。
NVIDIA 宣布将大力投入 Rust 原生 GPU 编程,并计划在 2027 年及以后持续发展和完善 CUDA Rust 工具链。此举旨在为不断变化的 AI 模型和技术提供从推理引擎到智能体运行时的系统层支持。
Neo4j 发布 @neo4j-labs/nams-ai-provider 工具包,为 Vercel AI SDK 提供基于图数据库的持久化记忆功能,支持三种集成模式:Provider、Middleware 和 Tools,通过单行代码替换即可实现跨会话记忆,记忆内容以实体-关系图结构存储,支持检索、修正和合并实体,且保证在模型调用失败时不影响响应。
推荐理由:原文给出了集成代码示例和三种模式,读者可以据此判断如何在现有 Vercel AI SDK 项目中实现持久化记忆。
Google 的音乐生成模型 Lyria 3.5 已在 Gemini 应用和 Gemini API 中面向全球用户推出。该模型提供更具表现力的人声和更丰富的编曲,用户可在应用内选择流派、人声/器乐风格,并使用新模板快速创作。Lyria 3.5 也通过 Google Flow Music、Google AI Studio 和 Google Vids 提供给艺术家、开发者和技术人员使用。
LangChain 发布对 Model Context Protocol (MCP) 的新版支持,将 MCP 功能整合进主包 langchain.mcp,基于 FastMCP 构建,支持无状态协议、客户端缓存和中断式 elicitation。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
Midjourney 正在征集用户反馈和改进想法,计划在未来一两周内进行正式投票。用户可通过 midjourney.com/ideas 提交建议。该平台未明确说明具体功能或技术方向,仅表示将根据社区意见调整开发优先级。
NVIDIA PAIR Virtual Inference Router 可聚合本地网络中多个设备的算力,为 AI 智能体提供统一的推理资源池。该工具支持多智能体协同工作流,能提升复杂任务的完成速度。
Google DeepMind 发布 WeatherNext 3,引入实时卫星数据、每小时更新、5公里分辨率,提升降水预测精度,并集成至 Search、Gemini、Maps 等产品。该模型通过直接学习观测数据,实现更精准的局部天气预测,尤其改善了拉丁美洲、非洲和亚太地区覆盖。
推荐理由:原文给出了实时卫星数据接入、小时级更新和分辨率提升等关键变化,读者可据此评估其对气象服务的影响。
Fly.io 为其 Sprites 服务发布了 MCP 服务器,让 AI 智能体可以通过 MCP 协议动态创建和管理云端计算机。Sprites 是具备持久文件系统和真实网络连接的轻量级云计算机,旨在为 AI 智能体提供安全、可扩展且成本低廉的执行环境。用户可通过指定 URL 在 Claude Desktop 等支持 MCP 的工具中集成此功能,并利用预设的安全护栏控制资源使用。
Google 推出面向企业客户的 AI 图像生成与编辑工具 Google Pics,基于 Nano Banana 模型。该工具提供精准编辑功能,可生成 2K 和 4K 图像,并直接集成到 Slides、Docs 和 Drive 等 Workspace 应用中。
Hugging Face 发布了售价 399 美元的可编程微型鸭子机器人 Microduck。这款开源机器人能执行行走、拾取物体、跌倒恢复乃至轮滑等行为,其 SDK、仿真环境和强化学习训练栈均在 GitHub 开源。此次发布基于 Hugging Face 2025 年收购 Pollen Robotics 后对实体 AI 领域的持续拓展。
Microsoft 推出 VibeVoice-ASR-Streaming-1.5B,支持流式语音识别并标注说话人身份,可自定义热词和10种语言。模型基于 microsoft/VibeVoice 项目,提供持续转录功能,适用于多语言场景。该项目采用 MIT 许可证,由微软研究院团队开发,欢迎用户反馈与合作。
Microsoft 推出 VibeVoice-ASR-Streaming-7B,支持流式语音识别并标注说话人身份,可自定义热词及10种语言。模型基于 microsoft/VibeVoice 项目,提供持续转录功能,适用于多语种场景。该项目采用 MIT 许可证,由微软研究院团队开发,欢迎用户反馈与合作。
Google 启动 Fairwind 计划,为政府机构和可信合作伙伴提供其最先进的网络防御能力。该计划首先提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具,帮助防御者自主发现并修复漏洞,在数分钟内生成已验证的、可部署的补丁。全球已有超过 650 家合作伙伴参与该计划。
Google 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber 两款新模型,前者在编码与智能体任务中性能显著提升,后者在漏洞检测与自动修复方面达到前沿水平,均以 Flash 级别的速度和成本提供,其中 3.8 Flash Cyber 通过 Fairwind 程序向受信任的防御方开放。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
Choruz 是一个本地优先的人机协作应用,支持人类与 AI 智能体在类似 Slack 的空间中协同工作。每个智能体运行独立 CLI,可通过消息、线程、任务和文件交接工作,支持 Claude Code、Codex、Grok 及 webhook 驱动的外部智能体,默认集成 Pi、OpenCode、MathCode 插件。
推荐理由:原文提供了本地化协作空间的架构设计和多智能体协同机制,读者可据此评估其在开发工作流中的集成潜力。
Google 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型推出了智能体视频理解功能。该功能通过动态搜索视频片段,将分析成本降低高达 66%,token 消耗减少高达 88%,同时将准确性提升高达 7%。
推荐理由:原文给出了新功能在成本、效率和准确性上的具体提升数据,以及支持的模型和开放入口,读者可以据此评估其对视频分析工作流的影响。
Google Workspace 推出 AI 图像创作与编辑工具 Google Pics,基于 Nano Banana 模型,提供对象分割、图内文字编辑与翻译、协作和多版本生成等功能。未来几周将向 Google AI Pro 和 Ultra 订阅者以及大多数 Workspace 商业客户开放,并将集成到 Slides、Docs 和 Drive 中,用户可在 pics.new 试用。
推荐理由:原文明确了产品定位、核心功能、集成路径和开放范围,读者可以据此判断它如何融入现有工作流。
Anthropic 推出 Enterprise Frontier Safeguards (EFS),允许客户在自有云基础设施中存储数据并控制数据审查流程,以兼顾隐私与安全检测。
NVIDIA 宣布其 BioNeMo NIM 微服务现可在 Claude Science 中运行,用于蛋白质结构预测。该集成使 AI 科学家能够调用专门的模型来辅助科学研究的假设提出与实验规划环节。
NVIDIA Omniverse NuRec 平台旨在帮助开发者将感知软件栈适配到不同车型。该平台通过合成数据生成,能模拟传感器位置、校准、视场、遮挡和车身几何等关键参数的差异。这有助于解决因车型变更导致的感知性能变化问题,加速自动驾驶系统的开发与验证。
JuliaHub 推出了 AI 平台 Dyad 3.0,以帮助工程团队加速开发火箭、热泵和卫星等复杂物理系统。该平台允许工程师上传数据和设计文档,由自主 AI 智能体进行物理模拟、安全分析和质量控制,实现“代理式”硬件设计。其底层编程语言 Julia 拥有超过 100 万用户,采用即时编译技术,旨在为科学家和工程师提供兼具易用性与高性能的编程工具。
Ollama 的 Pro、Max 和 Team 订阅计划现已采用透明的按 token 计费模式,每个计划均包含每月使用额度。Pro 计划每月 20 美元含 60 美元额度,Max 计划每月 100 美元含 300 美元额度,Team 计划每月 500 美元含 1000 美元共享额度。新定价无服务费和数据保留,支持 Claude Code 和 Codex 等流行编程智能体,并提供 API。
NVIDIA TensorRT Model Connect 开源参考实现集合简化了将开源 AI 模型集成到原生应用的过程。该工具通过两条命令,即可将模型从检查点部署到 NVIDIA TensorRT 推理环境,减少了模型特定的转换、预处理和后处理代码需求。
Google 为 Search 中的 AI Mode 新增了航班价格追踪、积分里程显示和酒店直接预订三项旅行功能。航班价格追踪覆盖全球超 180 个国家和地区,酒店预订功能已在美国英语用户中推出,并集成了 Booking.com、Expedia 等多家合作伙伴。
LangChain 本月推出管理深度智能体(Managed Deep Agents)和 LLM 网关(LLM Gateway)的公开测试版,支持一键部署、成本控制和敏感数据处理。Deep Agents v0.7 版本减少 65% 的基础输入 token,同时保持性能。Stripe 和 Apollo 已分别基于 Deep Agents 构建了企业级生产力工具和 AI 助手,显著提升了效率。
Anthropic 今日宣布为全球科学家开放 10,000 个 Claude 订阅席位,提供一年免费或折扣访问。标准席位免费,高级席位每月 $15,使用量上限为普通席位的 5 倍。同时,AI for Science 计划将扩展至更多科学领域,包括数学和蛋白质设计等高计算需求的研究。
Anthropic 开放 Model Hardware Standard (MHS) 研究预览,该标准为 AI 智能体安全操作物理设备提供统一规范。MHS 可将实验室和制造设备的集成时间从数周缩短至数小时,支持显微镜、液体处理器和机械臂等设备并行运行。标准采用模型无关设计,通过标准化驱动程序和 MCP 协议实现设备互联,目前已与 Genentech、华盛顿大学等机构合作验证。
推荐理由:Anthropic 推出的硬件标准能显著降低设备集成时间,为实验室和制造业提供自动化新方案。
Weaviate 1.39 版本新增 Boost API 和 Maximal Marginal Relevance (MMR) 多样性选择功能并正式发布。Boost API 支持查询时重新排序,结合过滤、数值排名、时间衰减和数值衰减四种条件,可应用于 hybrid、bm25、near_text 等多种搜索方式。
Replit 推出面向所有用户的智能模型路由功能,可根据任务动态选择最佳模型以平衡质量、速度和成本。测试显示该功能在保持相同输出质量的同时,成本比上一代 Max Mode 降低 65%。所有用户默认从 Free Mode 开始,企业管理员可自定义工作区允许使用的模型集。
NVIDIA 推出 NVLink Fusion 技术,将 NVLink 与高带宽内存(HBM)集成,以支持下一代 AI 基础设施。该技术旨在满足大型模型和复杂推理工作负载对算力的巨大需求,为超大规模企业和 AI 原生公司部署定制 AI 加速器(XPU)提供关键的内存带宽支持。
LangSmith 重构了产品首页并引入资源标签功能,以更好地组织工作区内的资源。首页按可观测性、评估和提示工程三个主要领域重新划分,支持更清晰的开发流程管理。资源标签允许用户按自定义标签或“Application”进行过滤,提升资源分组和访问的灵活性,并将很快支持基于属性的访问控制(ABAC)。
LangSmith LLM Gateway 公开测试版上线,提供针对生产环境 Agent 的模型调用治理能力,支持成本控制、速率限制、模型降级和敏感数据保护,可统一管理多模型、多提供商的调用策略,适用于组织、工作区、用户及 API key 级别的控制,并与 OpenAI、Anthropic、Fireworks 等主流模型提供商兼容。
推荐理由:原文给出了成本控制、速率限制和数据保护等核心功能,读者可据此评估其对生产环境治理的实际影响。
LangChain 在 2026 年 1 月发布了 LangSmith Agent Builder 的 GA 版本,支持通过自然语言构建智能体,包括提示词生成、工具选择、子智能体和技能配置。
LangChain 发布 LangGraph v0.1,提供对智能体工作流的细粒度控制能力,支持条件分支、循环、人类协作与时间旅行式调试;同时推出 LangGraph Cloud,提供可扩展、容错的部署基础设施,支持一键部署、流式输出、异步任务与定时任务,并集成 LangGraph Studio 用于可视化调试与协作。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
LangChain与NVIDIA联合发布NemoClaw深度智能体蓝图,整合Nemotron 3 Ultra模型、LangChain Deep Agents Code与NVIDIA OpenShell运行时,支持企业构建可治理、可优化的开放智能体系统。在评测中,该方案以$4.48成本达成0.86综合得分,较次优方案降低约10倍推理成本。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
LangChain 与 NVIDIA 联合发布企业级智能体开发平台,整合 LangGraph、Deep Agents 与 NVIDIA Nemotron 模型、NeMo Agent Toolkit、NIM 微服务及 Dynamo,支持从构建、加速、部署到监控的全流程。
推荐理由:原文给出了平台整合的完整能力链,读者可以据此评估其对开发效率和生产部署的影响。
LangChain 宣布 LangGraph Platform 正式上线,提供一键部署、水平扩展、持久化存储和原生 LangGraph Studio 等能力,支持长周期、状态化智能体的生产级运行。该平台提供云、混合和完全自托管三种部署模式,适用于需高可用、可追溯、多团队协作的智能体工作流。
推荐理由:原文给出了部署选项和核心功能,读者可以据此判断它如何支持长周期智能体的生产化落地。
Goodfire 推出的 Silico 平台提供多种工具以解析 AI 模型内部行为,支持用户以自然语言描述需求并自动生成实验计划。该平台已用于解析 Pleiades 表观遗传基础模型,发现其通过 DNA 片段长度模式检测阿尔茨海默病,这是首个通过逆向工程基础模型在自然科学领域取得的重要发现。
Ollobot 推出的 OlloNi SS1 通过主动互动、跌倒检测和持续陪伴功能,填补了现有技术在情感陪伴和安全监测方面的空白。该机器人支持多芯片 AI 4K 视觉模块、跨多种室内表面的移动能力以及坡度 3.5 度的爬坡功能,能够自然地在家庭环境中活动并参与日常互动。其设计聚焦于长期共存与情感共鸣,而非拟人化外观,同时配备物理摄像头遮盖以增强隐私保护。
Ollama 现已支持将 Claude Desktop 配置为第三方网关提供商。开发者可以在 Claude Desktop 中使用 Ollama 托管的开源模型或云端模型,并可在 Anthropic 模型与 Ollama 模型之间轻松切换。Ollama 默认禁用遥测,并执行零数据保留政策。