在 Claude Science 中运行 NVIDIA BioNeMo NIM 微服务进行蛋白质结构预测
NVIDIA 宣布其 BioNeMo NIM 微服务现可在 Claude Science 中运行,用于蛋白质结构预测。该集成使 AI 科学家能够调用专门的模型来辅助科学研究的假设提出与实验规划环节。
NVIDIA 宣布其 BioNeMo NIM 微服务现可在 Claude Science 中运行,用于蛋白质结构预测。该集成使 AI 科学家能够调用专门的模型来辅助科学研究的假设提出与实验规划环节。
NVIDIA Omniverse NuRec 平台旨在帮助开发者将感知软件栈适配到不同车型。该平台通过合成数据生成,能模拟传感器位置、校准、视场、遮挡和车身几何等关键参数的差异。这有助于解决因车型变更导致的感知性能变化问题,加速自动驾驶系统的开发与验证。
JuliaHub 推出了 AI 平台 Dyad 3.0,以帮助工程团队加速开发火箭、热泵和卫星等复杂物理系统。该平台允许工程师上传数据和设计文档,由自主 AI 智能体进行物理模拟、安全分析和质量控制,实现“代理式”硬件设计。其底层编程语言 Julia 拥有超过 100 万用户,采用即时编译技术,旨在为科学家和工程师提供兼具易用性与高性能的编程工具。
Ollama 的 Pro、Max 和 Team 订阅计划现已采用透明的按 token 计费模式,每个计划均包含每月使用额度。Pro 计划每月 20 美元含 60 美元额度,Max 计划每月 100 美元含 300 美元额度,Team 计划每月 500 美元含 1000 美元共享额度。新定价无服务费和数据保留,支持 Claude Code 和 Codex 等流行编程智能体,并提供 API。
NVIDIA TensorRT Model Connect 开源参考实现集合简化了将开源 AI 模型集成到原生应用的过程。该工具通过两条命令,即可将模型从检查点部署到 NVIDIA TensorRT 推理环境,减少了模型特定的转换、预处理和后处理代码需求。
Google 为 Search 中的 AI Mode 新增了航班价格追踪、积分里程显示和酒店直接预订三项旅行功能。航班价格追踪覆盖全球超 180 个国家和地区,酒店预订功能已在美国英语用户中推出,并集成了 Booking.com、Expedia 等多家合作伙伴。
LangChain 本月推出管理深度智能体(Managed Deep Agents)和 LLM 网关(LLM Gateway)的公开测试版,支持一键部署、成本控制和敏感数据处理。Deep Agents v0.7 版本减少 65% 的基础输入 token,同时保持性能。Stripe 和 Apollo 已分别基于 Deep Agents 构建了企业级生产力工具和 AI 助手,显著提升了效率。
Anthropic 今日宣布为全球科学家开放 10,000 个 Claude 订阅席位,提供一年免费或折扣访问。标准席位免费,高级席位每月 $15,使用量上限为普通席位的 5 倍。同时,AI for Science 计划将扩展至更多科学领域,包括数学和蛋白质设计等高计算需求的研究。
Anthropic 开放 Model Hardware Standard (MHS) 研究预览,该标准为 AI 智能体安全操作物理设备提供统一规范。MHS 可将实验室和制造设备的集成时间从数周缩短至数小时,支持显微镜、液体处理器和机械臂等设备并行运行。标准采用模型无关设计,通过标准化驱动程序和 MCP 协议实现设备互联,目前已与 Genentech、华盛顿大学等机构合作验证。
推荐理由:Anthropic 推出的硬件标准能显著降低设备集成时间,为实验室和制造业提供自动化新方案。
Replit 推出面向所有用户的智能模型路由功能,可根据任务动态选择最佳模型以平衡质量、速度和成本。测试显示该功能在保持相同输出质量的同时,成本比上一代 Max Mode 降低 65%。所有用户默认从 Free Mode 开始,企业管理员可自定义工作区允许使用的模型集。
NVIDIA 推出 NVLink Fusion 技术,将 NVLink 与高带宽内存(HBM)集成,以支持下一代 AI 基础设施。该技术旨在满足大型模型和复杂推理工作负载对算力的巨大需求,为超大规模企业和 AI 原生公司部署定制 AI 加速器(XPU)提供关键的内存带宽支持。
LangSmith 重构了产品首页并引入资源标签功能,以更好地组织工作区内的资源。首页按可观测性、评估和提示工程三个主要领域重新划分,支持更清晰的开发流程管理。资源标签允许用户按自定义标签或“Application”进行过滤,提升资源分组和访问的灵活性,并将很快支持基于属性的访问控制(ABAC)。
LangSmith LLM Gateway 公开测试版上线,提供针对生产环境 Agent 的模型调用治理能力,支持成本控制、速率限制、模型降级和敏感数据保护,可统一管理多模型、多提供商的调用策略,适用于组织、工作区、用户及 API key 级别的控制,并与 OpenAI、Anthropic、Fireworks 等主流模型提供商兼容。
推荐理由:原文给出了成本控制、速率限制和数据保护等核心功能,读者可据此评估其对生产环境治理的实际影响。
LangChain 在 2026 年 1 月发布了 LangSmith Agent Builder 的 GA 版本,支持通过自然语言构建智能体,包括提示词生成、工具选择、子智能体和技能配置。
LangChain 发布 LangGraph v0.1,提供对智能体工作流的细粒度控制能力,支持条件分支、循环、人类协作与时间旅行式调试;同时推出 LangGraph Cloud,提供可扩展、容错的部署基础设施,支持一键部署、流式输出、异步任务与定时任务,并集成 LangGraph Studio 用于可视化调试与协作。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
LangChain与NVIDIA联合发布NemoClaw深度智能体蓝图,整合Nemotron 3 Ultra模型、LangChain Deep Agents Code与NVIDIA OpenShell运行时,支持企业构建可治理、可优化的开放智能体系统。在评测中,该方案以$4.48成本达成0.86综合得分,较次优方案降低约10倍推理成本。
推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。
LangChain 与 NVIDIA 联合发布企业级智能体开发平台,整合 LangGraph、Deep Agents 与 NVIDIA Nemotron 模型、NeMo Agent Toolkit、NIM 微服务及 Dynamo,支持从构建、加速、部署到监控的全流程。
推荐理由:原文给出了平台整合的完整能力链,读者可以据此评估其对开发效率和生产部署的影响。
LangChain 宣布 LangGraph Platform 正式上线,提供一键部署、水平扩展、持久化存储和原生 LangGraph Studio 等能力,支持长周期、状态化智能体的生产级运行。该平台提供云、混合和完全自托管三种部署模式,适用于需高可用、可追溯、多团队协作的智能体工作流。
推荐理由:原文给出了部署选项和核心功能,读者可以据此判断它如何支持长周期智能体的生产化落地。
Goodfire 推出的 Silico 平台提供多种工具以解析 AI 模型内部行为,支持用户以自然语言描述需求并自动生成实验计划。该平台已用于解析 Pleiades 表观遗传基础模型,发现其通过 DNA 片段长度模式检测阿尔茨海默病,这是首个通过逆向工程基础模型在自然科学领域取得的重要发现。
Ollobot 推出的 OlloNi SS1 通过主动互动、跌倒检测和持续陪伴功能,填补了现有技术在情感陪伴和安全监测方面的空白。该机器人支持多芯片 AI 4K 视觉模块、跨多种室内表面的移动能力以及坡度 3.5 度的爬坡功能,能够自然地在家庭环境中活动并参与日常互动。其设计聚焦于长期共存与情感共鸣,而非拟人化外观,同时配备物理摄像头遮盖以增强隐私保护。
Ollama 现已支持将 Claude Desktop 配置为第三方网关提供商。开发者可以在 Claude Desktop 中使用 Ollama 托管的开源模型或云端模型,并可在 Anthropic 模型与 Ollama 模型之间轻松切换。Ollama 默认禁用遥测,并执行零数据保留政策。
Meta 发布 MetaRoCE,这是一种专为 AI 工作负载设计的 RDMA 传输协议,适用于大规模以太网环境。MetaRoCE 通过 Open Compute Project (OCP) 开源了协议规范、参考软件实现和合规测试套件。
推荐理由:Meta 开源了专为 AI 规模设计的 RDMA 传输协议 MetaRoCE,包含规范、参考实现和测试套件,可提升分布式训练和推理效率。
Microsoft Research 发布了深度学习密度泛函交换关联泛函 Skala 1.1,其训练数据量是前代版本的 2.5 倍,在 GMTKN55 基准测试的 55 个类别中,有 32 个类别排名第一。Skala 现已集成于 CP2K,并正在整合到 Psi4、FHI-aims、ORCA 和 VASP 等主流电子结构软件中,以扩大其在科学和工业工作流程中的可及性。
Slack 推出 Slack Code 功能,允许 AI 编码智能体在群聊环境中工作。智能体可以创建专用代码频道,团队成员可实时查看其工作、审查代码变更并指导调整。该功能支持 Anthropic 的 Claude、GitHub Copilot 和 OpenAI 的 ChatGPT 等智能体集成,未来将开放 API 支持更多应用场景。
推荐理由:Slack 将 AI 编码智能体引入群聊环境,展示了协作开发的新工作流可能性。
Mistral AI 发布 Agentic Search,这是一种多步骤检索层,让 AI 模型能在复杂文档中导航、阅读和验证信息。它通过五个工具(search、open、navigate、read、grep)在现有索引上工作,无需微调。
Replit 为其平台应用推出了黑盒渗透测试功能,模拟外部攻击者通过网络和浏览器测试应用,无需访问源代码。该功能与现有的白盒代码扫描互补,用户可在项目安全中心运行‘Level 3’扫描同时启动两者。测试显示,两种扫描发现的漏洞重叠率很低,能分别捕捉逻辑缺陷和配置错误等不同安全问题。
推荐理由:原文对比了白盒与黑盒扫描的互补性,并给出了具体操作入口,读者可以据此评估其安全测试流程的完整性。
Replit 发布面向企业的大规模管理功能更新,包括 Admin API、审计日志和工作区设置。Admin API 测试版现已上线,审计日志支持超过 50 种事件并默认保留 30 天,工作区设置的首个功能将于本周末推出。这些更新旨在帮助企业管理员集中管理 AI 工具采用策略、监控活动并实现合规控制。
Mistral 宣布推出 Mistral Regional Endpoints 和 Mistral Priority Tier,以增强推理的区域控制和生产级可靠性。其平台将开始支持第三方开源模型,首个为 Z.ai 的 GLM-5.2。Mistral 还联合企业成立联盟,通过欧洲计算单位(ECUs)来确保欧洲的长期 AI 算力供应,目标是到 2030 年建设高达 1 GW 的算力容量。
推荐理由:Mistral 通过推出区域端点和优先服务层,为欧洲客户提供了符合数据驻留和监管要求的 AI 基础设施选项。
NVIDIA Nemotron 3.5 Lightning 模型已在 Ollama 上提供,这是一个专为长期运行的智能体设计的 300 亿参数开源模型。它采用混合专家架构,每 token 仅激活 30 亿参数,支持高达 100 万 token 的上下文,并针对本地 NVIDIA RTX 设备进行了优化,可实现比同类开源模型高 4 倍的吞吐量。
推荐理由:原文提供了模型的核心架构、性能基准和本地部署优势,读者可以据此评估它是否适合作为长期运行的智能体基座。
开源项目 ShieldFont 发布了一种新型字体,旨在干扰 AI 网络爬虫的数据抓取。该字体利用 OpenType 的 GSUB 功能,在 HTML 源码层面对约四分之一的单词进行同词性替换,使其对人类读者显示正常,但对爬虫呈现为语义混乱的文本。项目提供了在线演示、React 组件及 CSS/CDN 集成方式,默认字体基于 Playtype 的 Optik 修改,文件大小约 800 KB。
Replit 发布新的创意套件 Replit Design,旨在让用户快速将想法转化为设计。它内置 Ambient Intelligence 引导设计流程,支持调用 Claude、GPT-5、Gemini、Kimi 和 GLM 等模型,并集成了 Mobbin UI/UX 参考库和设计系统。该功能现已对所有用户开放。
Perplexity 将其 Model Council 功能扩展至基于云的 Computer 平台,允许用户配置由 2 到 8 个模型组成的“顾问团”并行处理查询,并由一个合成模型生成报告,明确指出共识与分歧。该功能现面向个人 Pro(20 美元/月)和 Max(200 美元/月)用户以及企业层级开放,但需消耗基于使用量的 Computer 积分,复杂任务成本可能较高。
AgentMemory for .NET 是一个独立开发的 .NET 原生实现,与 Neo4j Agent Memory 兼容并通过了全部 178 个测试场景。
Neo4j Virtual Graph 现在进入公测阶段,支持 Snowflake、Databricks 和 Google BigQuery 数据源,采用零拷贝架构实现知识图谱查询。
Together AI 推出专为生产环境设计的开源权重模型推理平台 Together Dedicated Model Inference。该平台每月处理超 400 万亿 tokens 的经验,可为用户提供对模型、性能、成本和功能的完全控制,并实现部署启动速度提升约 4 倍。企业可部署来自 Together 模型平台或自带的开源权重及微调模型,并选择经过优化的硬件配置。
Neo4j 推出 MCP for Aura,该托管 MCP 服务器无需额外成本即可集成到 Free、Professional 和 Business Critical 等层级的 Aura 实例中。
Thinking Machines Lab 发布了多模态专家混合模型 Inkling,支持文本、图像和音频输入,具备可控推理深度和广泛的微调能力。Inkling 采用查询条件相对注意力、短因果卷积和共享专家池 MoE 等架构创新,总参数量 975B,活跃参数量 40B,上下文窗口为 1M token。
推荐理由:原文介绍了新模型的核心架构创新和可控推理特性,读者可以了解其技术路径与现有模型的差异。
Together AI 为其 GPU 集群服务推出了一系列更新,重点提升生产环境中大规模训练和推理任务的可靠性与操作控制。新功能包括被动健康检查、自动节点修复以及基于 Slinky 1.0 重构的 Slurm-on-Kubernetes 2.0 堆栈,能够实时检测硬件故障并推荐修复方案。
FASHN 为时尚品牌提供规模化生成模特图与虚拟试穿的技术方案。其系统支持企业客户并行处理 500 个并发请求,能一次性处理整个产品目录。该方案旨在解决传统摄影的物流限制,并满足品牌对产品纹理、图案和颜色精确呈现的高要求。
开发者 Tarun Gupta 发布了 AI 求职工具 Autopilot-Jobhunt,能根据用户配置自动搜索匹配的职位,并通过 Telegram 通知用户。