跳到正文
8月25日周二
  1. Engineering at Meta57

    Meta 发布专为 AI 规模设计的 RDMA 传输协议 MetaRoCE

    Meta 发布 MetaRoCE,这是一种专为 AI 工作负载设计的 RDMA 传输协议,适用于大规模以太网环境。MetaRoCE 通过 Open Compute Project (OCP) 开源了协议规范、参考软件实现和合规测试套件。

    推荐理由:Meta 开源了专为 AI 规模设计的 RDMA 传输协议 MetaRoCE,包含规范、参考实现和测试套件,可提升分布式训练和推理效率。

8月21日周五
  1. Microsoft Research33

    Microsoft Research 的 Skala 1.1 提升预测性密度泛函理论精度并扩大软件集成

    Microsoft Research 发布了深度学习密度泛函交换关联泛函 Skala 1.1,其训练数据量是前代版本的 2.5 倍,在 GMTKN55 基准测试的 55 个类别中,有 32 个类别排名第一。Skala 现已集成于 CP2K,并正在整合到 Psi4、FHI-aims、ORCA 和 VASP 等主流电子结构软件中,以扩大其在科学和工业工作流程中的可及性。

8月20日周四
  1. The Register · AI/ML62

    Slack 推出 Slack Code 功能,将 AI 编码智能体引入群聊

    Slack 推出 Slack Code 功能,允许 AI 编码智能体在群聊环境中工作。智能体可以创建专用代码频道,团队成员可实时查看其工作、审查代码变更并指导调整。该功能支持 Anthropic 的 Claude、GitHub Copilot 和 OpenAI 的 ChatGPT 等智能体集成,未来将开放 API 支持更多应用场景。

    推荐理由:Slack 将 AI 编码智能体引入群聊环境,展示了协作开发的新工作流可能性。

8月18日周二
  1. Replit 博客54

    Replit 推出黑盒渗透测试功能

    Replit 为其平台应用推出了黑盒渗透测试功能,模拟外部攻击者通过网络和浏览器测试应用,无需访问源代码。该功能与现有的白盒代码扫描互补,用户可在项目安全中心运行‘Level 3’扫描同时启动两者。测试显示,两种扫描发现的漏洞重叠率很低,能分别捕捉逻辑缺陷和配置错误等不同安全问题。

    推荐理由:原文对比了白盒与黑盒扫描的互补性,并给出了具体操作入口,读者可以据此评估其安全测试流程的完整性。

8月17日周一
  1. Replit 博客40

    Replit 推出大规模管理功能:Admin API、审计日志和工作区设置

    Replit 发布面向企业的大规模管理功能更新,包括 Admin API、审计日志和工作区设置。Admin API 测试版现已上线,审计日志支持超过 50 种事件并默认保留 30 天,工作区设置的首个功能将于本周末推出。这些更新旨在帮助企业管理员集中管理 AI 工具采用策略、监控活动并实现合规控制。

8月14日周五
  1. Platformer43

    Town 的 CEO 谈自组织公司的可能性

    Town 的 CEO Jean-Denis Greze 表示,其公司正在开发一种基于用户数据自动构建知识库的自组织公司工具,该工具能从邮件、会议记录和 Slack 中提取信息。Town 的核心功能是名为 Townie 的数字助手,目前个人版收费 $49 至 $59 每月,企业版将禁止雇主读取员工 Townie 对话,并在 15 天后删除会话数据。公司计划很快推出团队版的自写维基功能。

8月11日周二
  1. Mistral AI68

    Mistral 推出区域推理端点、优先服务层并支持第三方开源模型

    Mistral 宣布推出 Mistral Regional Endpoints 和 Mistral Priority Tier,以增强推理的区域控制和生产级可靠性。其平台将开始支持第三方开源模型,首个为 Z.ai 的 GLM-5.2。Mistral 还联合企业成立联盟,通过欧洲计算单位(ECUs)来确保欧洲的长期 AI 算力供应,目标是到 2030 年建设高达 1 GW 的算力容量。

    推荐理由:Mistral 通过推出区域端点和优先服务层,为欧洲客户提供了符合数据驻留和监管要求的 AI 基础设施选项。

  2. Ollama 博客70

    NVIDIA Nemotron 3.5 Lightning 模型在 Ollama 上可用

    NVIDIA Nemotron 3.5 Lightning 模型已在 Ollama 上提供,这是一个专为长期运行的智能体设计的 300 亿参数开源模型。它采用混合专家架构,每 token 仅激活 30 亿参数,支持高达 100 万 token 的上下文,并针对本地 NVIDIA RTX 设备进行了优化,可实现比同类开源模型高 4 倍的吞吐量。

    推荐理由:原文提供了模型的核心架构、性能基准和本地部署优势,读者可以据此评估它是否适合作为长期运行的智能体基座。

7月30日周四
  1. Replit 博客52

    Replit 推出 Replit Design 设计套件

    Replit 发布新的创意套件 Replit Design,旨在让用户快速将想法转化为设计。它内置 Ambient Intelligence 引导设计流程,支持调用 Claude、GPT-5、Gemini、Kimi 和 GLM 等模型,并集成了 Mobbin UI/UX 参考库和设计系统。该功能现已对所有用户开放。

7月29日周三
  1. The Register · AI/ML41

    Perplexity 将 Model Council 扩展至 Computer 平台,支持多模型视角查询

    Perplexity 将其 Model Council 功能扩展至基于云的 Computer 平台,允许用户配置由 2 到 8 个模型组成的“顾问团”并行处理查询,并由一个合成模型生成报告,明确指出共识与分歧。该功能现面向个人 Pro(20 美元/月)和 Max(200 美元/月)用户以及企业层级开放,但需消耗基于使用量的 Computer 积分,复杂任务成本可能较高。

7月25日周六
7月23日周四
  1. Together AI37

    Together AI 推出面向生产环境的开源权重模型推理平台

    Together AI 推出专为生产环境设计的开源权重模型推理平台 Together Dedicated Model Inference。该平台每月处理超 400 万亿 tokens 的经验,可为用户提供对模型、性能、成本和功能的完全控制,并实现部署启动速度提升约 4 倍。企业可部署来自 Together 模型平台或自带的开源权重及微调模型,并选择经过优化的硬件配置。

7月22日周三
7月21日周二
7月15日周三
  1. Together AI63

    Thinking Machines Lab 发布多模态 MoE 模型 Inkling

    Thinking Machines Lab 发布了多模态专家混合模型 Inkling,支持文本、图像和音频输入,具备可控推理深度和广泛的微调能力。Inkling 采用查询条件相对注意力、短因果卷积和共享专家池 MoE 等架构创新,总参数量 975B,活跃参数量 40B,上下文窗口为 1M token。

    推荐理由:原文介绍了新模型的核心架构创新和可控推理特性,读者可以了解其技术路径与现有模型的差异。

7月11日周六
  1. fal 博客37

    FASHN AI:重新构想时尚与摄影

    FASHN 为时尚品牌提供规模化生成模特图与虚拟试穿的技术方案。其系统支持企业客户并行处理 500 个并发请求,能一次性处理整个产品目录。该方案旨在解决传统摄影的物流限制,并满足品牌对产品纹理、图案和颜色精确呈现的高要求。

7月10日周五
7月8日周三
6月30日周二
  1. The Register · AI/ML37

    Microsoft 为 Teams 会议推出“保镖”功能以拦截机器人

    Microsoft 为 Teams 会议引入新机制,通过行为与基础设施信号更准确地区分机器人与人类参与者,并要求人类在“大厅”中手动批准机器人加入。该功能旨在防止第三方服务机器人意外自动加入会议,以应对潜在的安全与隐私风险。微软计划为独立软件供应商提供机器人注册路径,并将在该功能全面部署后停用现有的 CAPTCHA 验证。

6月29日周一
6月24日周三
  1. The Register · AI/ML65

    Anthropic 在 Slack 中推出常驻智能体 Claude Tag

    Anthropic 推出常驻 Slack 的智能体 Claude Tag,取代原有的 Claude for Slack 应用。Claude Tag 可作为团队成员加入频道,根据权限访问频道内的工具、数据和代码库,并能通过持续学习积累上下文,主动更新信息或自主安排任务。现有应用将于 8 月 3 日停服,企业版和团队版客户即日起可迁移,并在 9 月 1 日前迁移可获得最高 25,000 美元的积分。

    推荐理由:原文详细描述了新功能的核心变化、迁移时间表和商业激励,读者可以据此评估其对团队协作流程的实际影响。

6月18日周四
  1. Replit 博客50

    Claude 现支持直接使用 Replit 进行开发

    Claude 现在可以直接集成 Replit,用户可通过自然语言设计应用并直接发送至 Replit 继续开发,实现无缝工作流。该功能通过官方 Replit Connector 实现,支持将任何通用开发任务委托给 Replit 完成。无需复制粘贴或切换上下文,Claude 与 Replit 协同工作,缩短创意与实现之间的差距。

6月17日周三
  1. The Register · AI/ML50

    评测:新版 Siri 如何让 Spotlight 搜索变得繁琐

    作者在 iOS 和 macOS 27 开发者测试版中实测新版 Siri,发现其将 Spotlight 搜索变成了一个以 Siri 为先的界面,导致进行网页搜索需要多次点击。作者认为这类似于 Google 的 AI Overviews,并指出苹果 AI 负责人来自 Google 的背景可能与此有关。作为替代方案,作者通过 Siri 创建了一个可放置在主屏幕的快捷指令来直接进行 Google 搜索。

6月11日周四
  1. Ollama 博客58

    Ollama 发布 MLX 引擎更新,在 Apple Silicon 上实现最高性能

    Ollama 更新其 MLX 引擎,在 Apple Silicon 上实现了迄今为止的最高性能,支持 NVIDIA 的 NVFP4 量化格式以减少质量损失,并引入快照系统优化 Agent 工作流。新引擎输出速度提升最高达 20%,并允许数据中心优化的模型在桌面端运行。用户可通过下载最新版 Ollama 并使用 `ollama run gemma4:12b-mlx` 命令体验。

    推荐理由:Ollama 官方介绍了其 MLX 引擎在 Apple Silicon 上的多项性能优化,包括支持 NVFP4 量化格式和新的快照系统,对本地部署和 Agent 工作流有直接影响。

6月10日周三
  1. Replit 博客47

    Replit 推出 Package Firewall,每日拦截 8000 多个恶意软件包

    Replit 与软件供应链安全公司 Socket 合作推出默认启用的 Package Firewall,在网络层面实时拦截恶意或存在漏洞的软件包安装。该功能自一周前推出以来,每日拦截约 8000 个软件包,有效防范安装时即造成损害的恶意软件。当安装被拦截时,用户会收到明确提示,AI Agent 也能接收到相同信号并建议安全替代方案。

6月5日周五
  1. Ollama 博客58

    Ollama 0.30 发布,提升性能并扩展 GGUF 模型支持

    Ollama 0.30 发布,通过集成 llama.cpp 提升了性能并扩展了对 GGUF 格式模型的兼容性。在 NVIDIA 硬件上,性能提升最高可达 20%;默认启用 Vulkan 支持,使 Ollama 的 GPU 加速能扩展到 AMD 和 Intel 设备。新版本支持更多模型系列,并允许用户通过 Modelfile 直接运行从 Hugging Face 下载的 GGUF 模型文件。

    推荐理由:Ollama 0.30 通过集成 llama.cpp 提升了 NVIDIA 硬件性能并扩展了 GGUF 模型支持,为本地部署提供了更广泛的硬件兼容性和更便捷的模型运行方式。

  2. Replit 博客58

    Replit 发布与 Shopify 集成的智能体功能,可对话创建电商店铺

    Replit 发布与 Shopify 集成的智能体功能,用户可通过对话描述需求,让 Agent 自动生成定制化店铺前端、创建 Shopify 店铺并添加产品。从第一个提示到接收真实订单大约只需十分钟。用户主要在 Replit 内完成店铺设计、产品管理和运营,只需在 Shopify 进行一次性的账户登录、店铺认领和支付设置。

    推荐理由:Replit 与 Shopify 的集成让用户通过对话就能创建并管理完整的电商店铺,降低了从想法到上线的门槛。

6月4日周四
  1. Ollama 博客61

    NVIDIA Nemotron 3 Ultra 模型上线 Ollama 云服务

    NVIDIA Nemotron 3 Ultra 模型已在 Ollama 云服务上线。这是一个 5500 亿参数(每 token 激活 550 亿)的开源模型,专为长流程智能体工作流设计,支持高达 100 万 token 的上下文窗口,并在智能体生产力、指令遵循和长上下文任务上具有领先的准确性和吞吐量。

    推荐理由:原文提供了模型的核心参数、设计目标和性能基准,读者可以据此评估其在长流程智能体任务中的适用性。

  2. The Register · AI/ML55

    微软在 Build 大会上推出 Autopilot 智能体 Scout

    微软在 Build 大会上推出了名为 Autopilot 的新型智能体 AI,其首个智能体 Scout 被描述为‘始终在线、自主工作’的助手。Scout 可跨 Teams、Outlook、OneDrive 和 SharePoint 等应用运行,在后台理解工作流程并自主采取行动,例如自动安排会议、标记重要事项和识别风险。

6月2日周二
  1. Together AI59

    Together AI 详解如何高效推理服务 MiniMax M3 模型

    Together AI 作为 MiniMax M3 的优选云合作伙伴,分享了其针对该模型新特性的推理优化方案。M3 具备 100 万 token 上下文、原生多模态和稀疏注意力架构,Together AI 通过 KV 块主序稀疏注意力、与分页注意力的集成、解码索引评分优化以及网关预处理多模态输入等方法,在代理式流量下将推理性能提升了 81% 至 125%。

    推荐理由:Together AI 分享了其针对 MiniMax M3 模型稀疏注意力等新特性的推理优化细节,包括 KV 块重排、分页注意力集成和网关预处理。

  2. Weights & Biases16

    Product newsletter: May 2026 产品更新与新功能介绍

    May 2026 产品更新包括 CoreWeave Sandboxes 的发布、模型功能的改进以及 iOS 应用的更新。新增的 CoreWeave Sandboxes 提供了更便捷的模型测试环境,模型更新优化了推理效率和可用性,iOS 应用增加了对多模态输入的支持。这些改进提升了用户体验并扩展了产品功能的适用场景。

  3. Replit 博客44

    Microsoft Fabric 与 Replit 集成,开启企业数据应用新开发方式

    Microsoft Fabric 与 Replit 合作推出集成方案,允许企业团队通过 AI 助力开发直接构建并部署应用到 Fabric 平台,实现从数据到生产应用的快速转化。Rayfin SDK 和 CLI 提供自动化的生产级后端架构,包括数据模型、认证和访问策略,无需手动搭建基础设施。该集成使业务团队能减少设置时间,专注于解决问题,同时 IT 团队可维持集中治理与合规。