跳到正文
8月27日周四
  1. LangChain 博客26

    LangSmith 重构产品首页并推出资源标签以提升组织性

    LangSmith 重构了产品首页并引入资源标签功能,以更好地组织工作区内的资源。首页按可观测性、评估和提示工程三个主要领域重新划分,支持更清晰的开发流程管理。资源标签允许用户按自定义标签或“Application”进行过滤,提升资源分组和访问的灵活性,并将很快支持基于属性的访问控制(ABAC)。

  2. LangChain 博客56

    LangSmith LLM Gateway 公开测试版发布

    LangSmith LLM Gateway 公开测试版上线,提供针对生产环境 Agent 的模型调用治理能力,支持成本控制、速率限制、模型降级和敏感数据保护,可统一管理多模型、多提供商的调用策略,适用于组织、工作区、用户及 API key 级别的控制,并与 OpenAI、Anthropic、Fireworks 等主流模型提供商兼容。

    推荐理由:原文给出了成本控制、速率限制和数据保护等核心功能,读者可据此评估其对生产环境治理的实际影响。

  3. LangChain 博客60

    LangChain 发布 LangGraph v0.1 与 LangGraph Cloud

    LangChain 发布 LangGraph v0.1,提供对智能体工作流的细粒度控制能力,支持条件分支、循环、人类协作与时间旅行式调试;同时推出 LangGraph Cloud,提供可扩展、容错的部署基础设施,支持一键部署、流式输出、异步任务与定时任务,并集成 LangGraph Studio 用于可视化调试与协作。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  4. LangChain 博客65

    LangChain与NVIDIA发布NemoClaw深度智能体蓝图

    LangChain与NVIDIA联合发布NemoClaw深度智能体蓝图,整合Nemotron 3 Ultra模型、LangChain Deep Agents Code与NVIDIA OpenShell运行时,支持企业构建可治理、可优化的开放智能体系统。在评测中,该方案以$4.48成本达成0.86综合得分,较次优方案降低约10倍推理成本。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  5. LangChain 博客61

    LangChain 与 NVIDIA 联合发布企业级智能体开发平台

    LangChain 与 NVIDIA 联合发布企业级智能体开发平台,整合 LangGraph、Deep Agents 与 NVIDIA Nemotron 模型、NeMo Agent Toolkit、NIM 微服务及 Dynamo,支持从构建、加速、部署到监控的全流程。

    推荐理由:原文给出了平台整合的完整能力链,读者可以据此评估其对开发效率和生产部署的影响。

  6. LangChain 博客65

    LangGraph Platform 正式发布,支持长周期状态化智能体的部署与管理

    LangChain 宣布 LangGraph Platform 正式上线,提供一键部署、水平扩展、持久化存储和原生 LangGraph Studio 等能力,支持长周期、状态化智能体的生产级运行。该平台提供云、混合和完全自托管三种部署模式,适用于需高可用、可追溯、多团队协作的智能体工作流。

    推荐理由:原文给出了部署选项和核心功能,读者可以据此判断它如何支持长周期智能体的生产化落地。

8月25日周二
  1. Engineering at Meta57

    Meta 发布专为 AI 规模设计的 RDMA 传输协议 MetaRoCE

    Meta 发布 MetaRoCE,这是一种专为 AI 工作负载设计的 RDMA 传输协议,适用于大规模以太网环境。MetaRoCE 通过 Open Compute Project (OCP) 开源了协议规范、参考软件实现和合规测试套件。

    推荐理由:Meta 开源了专为 AI 规模设计的 RDMA 传输协议 MetaRoCE,包含规范、参考实现和测试套件,可提升分布式训练和推理效率。

  2. Engineering at Meta55

    Meta发布MTIA 300训练芯片:集成NIC和通信卸载引擎

    Meta发布MTIA 300训练芯片,专为推荐和排序模型训练设计,集成12个800 Gbps RDMA NIC芯片,提供1.2 TB/s I/O带宽,通信与计算分离,通过16个专用消息引擎实现通信卸载,与GPU相比通信时间提升3.9倍。芯片支持HCCL通信库,可编译通信操作为独立子图,实现主机无干预执行,适用于PyTorch框架。

    推荐理由:原文详细说明了MTIA 300芯片的通信架构设计和性能提升,读者可据此理解其如何解决推荐模型训练中的通信瓶颈问题。

8月21日周五
  1. Microsoft Research33

    Microsoft Research 的 Skala 1.1 提升预测性密度泛函理论精度并扩大软件集成

    Microsoft Research 发布了深度学习密度泛函交换关联泛函 Skala 1.1,其训练数据量是前代版本的 2.5 倍,在 GMTKN55 基准测试的 55 个类别中,有 32 个类别排名第一。Skala 现已集成于 CP2K,并正在整合到 Psi4、FHI-aims、ORCA 和 VASP 等主流电子结构软件中,以扩大其在科学和工业工作流程中的可及性。

8月20日周四
8月19日周三
  1. Replit 博客31

    Replit 推出免费模式以扩展 AI 的可能性

    Replit 推出 Free Mode,用户可使用 OpenAI 的 GPT-5.6 Luna 模型,在每月订阅费用下创建 30 倍内容,日常任务不再消耗积分。新界面支持从简单聊天到复杂构建的无缝切换,提升效率与创作自由度。Pro 用户相比 Core 用户拥有更高的使用上限,复杂任务可切换至 Power Mode 或 Max Mode。

8月18日周二
  1. Replit 博客54

    Replit 推出黑盒渗透测试功能

    Replit 为其平台应用推出了黑盒渗透测试功能,模拟外部攻击者通过网络和浏览器测试应用,无需访问源代码。该功能与现有的白盒代码扫描互补,用户可在项目安全中心运行‘Level 3’扫描同时启动两者。测试显示,两种扫描发现的漏洞重叠率很低,能分别捕捉逻辑缺陷和配置错误等不同安全问题。

    推荐理由:原文对比了白盒与黑盒扫描的互补性,并给出了具体操作入口,读者可以据此评估其安全测试流程的完整性。

8月17日周一
  1. Replit 博客40

    Replit 推出大规模管理功能:Admin API、审计日志和工作区设置

    Replit 发布面向企业的大规模管理功能更新,包括 Admin API、审计日志和工作区设置。Admin API 测试版现已上线,审计日志支持超过 50 种事件并默认保留 30 天,工作区设置的首个功能将于本周末推出。这些更新旨在帮助企业管理员集中管理 AI 工具采用策略、监控活动并实现合规控制。

8月12日周三
8月11日周二
  1. Mistral AI68

    Mistral 推出区域推理端点、优先服务层并支持第三方开源模型

    Mistral 宣布推出 Mistral Regional Endpoints 和 Mistral Priority Tier,以增强推理的区域控制和生产级可靠性。其平台将开始支持第三方开源模型,首个为 Z.ai 的 GLM-5.2。Mistral 还联合企业成立联盟,通过欧洲计算单位(ECUs)来确保欧洲的长期 AI 算力供应,目标是到 2030 年建设高达 1 GW 的算力容量。

    推荐理由:Mistral 通过推出区域端点和优先服务层,为欧洲客户提供了符合数据驻留和监管要求的 AI 基础设施选项。

  2. Ollama 博客70

    NVIDIA Nemotron 3.5 Lightning 模型在 Ollama 上可用

    NVIDIA Nemotron 3.5 Lightning 模型已在 Ollama 上提供,这是一个专为长期运行的智能体设计的 300 亿参数开源模型。它采用混合专家架构,每 token 仅激活 30 亿参数,支持高达 100 万 token 的上下文,并针对本地 NVIDIA RTX 设备进行了优化,可实现比同类开源模型高 4 倍的吞吐量。

    推荐理由:原文提供了模型的核心架构、性能基准和本地部署优势,读者可以据此评估它是否适合作为长期运行的智能体基座。

7月30日周四
  1. Replit 博客52

    Replit 推出 Replit Design 设计套件

    Replit 发布新的创意套件 Replit Design,旨在让用户快速将想法转化为设计。它内置 Ambient Intelligence 引导设计流程,支持调用 Claude、GPT-5、Gemini、Kimi 和 GLM 等模型,并集成了 Mobbin UI/UX 参考库和设计系统。该功能现已对所有用户开放。

7月25日周六
7月23日周四
  1. Together AI37

    Together AI 推出面向生产环境的开源权重模型推理平台

    Together AI 推出专为生产环境设计的开源权重模型推理平台 Together Dedicated Model Inference。该平台每月处理超 400 万亿 tokens 的经验,可为用户提供对模型、性能、成本和功能的完全控制,并实现部署启动速度提升约 4 倍。企业可部署来自 Together 模型平台或自带的开源权重及微调模型,并选择经过优化的硬件配置。

7月22日周三
7月20日周一
  1. Neo4j 博客32

    Bloom 引入全图投影功能:解锁科学算法与可视化新可能

    Bloom 现在支持在全图投影上运行图算法,提供比局部场景更全面的数据洞察。用户可在不编写代码的情况下,通过界面选择基于整个数据库的投影运行度中心性等算法,结果可写入数据库供后续参考。新功能适用于使用 Graph Data Science 插件或 Aura Graph Analytics 服务的 Neo4j 实例。

7月15日周三
  1. Together AI63

    Thinking Machines Lab 发布多模态 MoE 模型 Inkling

    Thinking Machines Lab 发布了多模态专家混合模型 Inkling,支持文本、图像和音频输入,具备可控推理深度和广泛的微调能力。Inkling 采用查询条件相对注意力、短因果卷积和共享专家池 MoE 等架构创新,总参数量 975B,活跃参数量 40B,上下文窗口为 1M token。

    推荐理由:原文介绍了新模型的核心架构创新和可控推理特性,读者可以了解其技术路径与现有模型的差异。

7月14日周二
7月11日周六
  1. fal 博客37

    FASHN AI:重新构想时尚与摄影

    FASHN 为时尚品牌提供规模化生成模特图与虚拟试穿的技术方案。其系统支持企业客户并行处理 500 个并发请求,能一次性处理整个产品目录。该方案旨在解决传统摄影的物流限制,并满足品牌对产品纹理、图案和颜色精确呈现的高要求。

7月9日周四
7月7日周二
  1. Weights & Biases43

    Tabular ML 没有消亡,只是在等待智能体的崛起

    Weights & Biases 的 tabular 数据智能体在 MLE-bench 表格数据部分取得第一名,获得两个金牌、三个高于中位数的成绩,四次提交全部有效。该智能体展示了在结构化数据任务中的卓越表现,为传统 tabular ML 方法注入了新活力。其开源可用性使开发者能够直接测试和集成该智能体到自己的项目中。

7月2日周四
  1. Weights & Biases19

    Product newsletter: June 2026 更新与新功能汇总

    Weights & Biases 在 2026 年 6 月推出了 ARIA,一款新的 ML 研究助手,并上线了新的 Serverless Inference 模型。新增功能包括支持更高效的推理部署和改进的交互体验。相关产品和功能可通过其官方渠道获取更多信息。

6月29日周一
6月26日周五
6月25日周四
  1. Weaviate 博客30

    Weaviate 1.38 发布:HFresh 向量索引与 MCP 服务器正式上线

    Weaviate 1.38 版本正式上线,HFresh 磁盘向量索引和内置 MCP 服务器达到通用可用状态。HFresh 支持 cosine 和 l2-squared 距离度量,通过压缩存储和增量重平衡机制优化大规模数据的内存和延迟表现。MCP 服务器允许 LLM、IDE 和 AI 智能体直接与 Weaviate 交互,且新增运行时配置功能,无需重启集群即可启用或禁用写入权限。

6月18日周四
  1. Replit 博客50

    Claude 现支持直接使用 Replit 进行开发

    Claude 现在可以直接集成 Replit,用户可通过自然语言设计应用并直接发送至 Replit 继续开发,实现无缝工作流。该功能通过官方 Replit Connector 实现,支持将任何通用开发任务委托给 Replit 完成。无需复制粘贴或切换上下文,Claude 与 Replit 协同工作,缩短创意与实现之间的差距。

6月11日周四
  1. Ollama 博客58

    Ollama 发布 MLX 引擎更新,在 Apple Silicon 上实现最高性能

    Ollama 更新其 MLX 引擎,在 Apple Silicon 上实现了迄今为止的最高性能,支持 NVIDIA 的 NVFP4 量化格式以减少质量损失,并引入快照系统优化 Agent 工作流。新引擎输出速度提升最高达 20%,并允许数据中心优化的模型在桌面端运行。用户可通过下载最新版 Ollama 并使用 `ollama run gemma4:12b-mlx` 命令体验。

    推荐理由:Ollama 官方介绍了其 MLX 引擎在 Apple Silicon 上的多项性能优化,包括支持 NVFP4 量化格式和新的快照系统,对本地部署和 Agent 工作流有直接影响。