Meta 发布专为 AI 规模设计的 RDMA 传输协议 MetaRoCE
Meta 发布 MetaRoCE,这是一种专为 AI 工作负载设计的 RDMA 传输协议,适用于大规模以太网环境。MetaRoCE 通过 Open Compute Project (OCP) 开源了协议规范、参考软件实现和合规测试套件。
推荐理由:Meta 开源了专为 AI 规模设计的 RDMA 传输协议 MetaRoCE,包含规范、参考实现和测试套件,可提升分布式训练和推理效率。
Meta 发布 MetaRoCE,这是一种专为 AI 工作负载设计的 RDMA 传输协议,适用于大规模以太网环境。MetaRoCE 通过 Open Compute Project (OCP) 开源了协议规范、参考软件实现和合规测试套件。
推荐理由:Meta 开源了专为 AI 规模设计的 RDMA 传输协议 MetaRoCE,包含规范、参考实现和测试套件,可提升分布式训练和推理效率。
Meta发布MTIA 300训练芯片,专为推荐和排序模型训练设计,集成12个800 Gbps RDMA NIC芯片,提供1.2 TB/s I/O带宽,通信与计算分离,通过16个专用消息引擎实现通信卸载,与GPU相比通信时间提升3.9倍。芯片支持HCCL通信库,可编译通信操作为独立子图,实现主机无干预执行,适用于PyTorch框架。
推荐理由:原文详细说明了MTIA 300芯片的通信架构设计和性能提升,读者可据此理解其如何解决推荐模型训练中的通信瓶颈问题。
Microsoft Research 发布了深度学习密度泛函交换关联泛函 Skala 1.1,其训练数据量是前代版本的 2.5 倍,在 GMTKN55 基准测试的 55 个类别中,有 32 个类别排名第一。Skala 现已集成于 CP2K,并正在整合到 Psi4、FHI-aims、ORCA 和 VASP 等主流电子结构软件中,以扩大其在科学和工业工作流程中的可及性。
Slack 推出 Slack Code 功能,允许 AI 编码智能体在群聊环境中工作。智能体可以创建专用代码频道,团队成员可实时查看其工作、审查代码变更并指导调整。该功能支持 Anthropic 的 Claude、GitHub Copilot 和 OpenAI 的 ChatGPT 等智能体集成,未来将开放 API 支持更多应用场景。
推荐理由:Slack 将 AI 编码智能体引入群聊环境,展示了协作开发的新工作流可能性。
Mistral AI 发布 Agentic Search,这是一种多步骤检索层,让 AI 模型能在复杂文档中导航、阅读和验证信息。它通过五个工具(search、open、navigate、read、grep)在现有索引上工作,无需微调。
Replit 推出 Free Mode,用户可使用 OpenAI 的 GPT-5.6 Luna 模型,在每月订阅费用下创建 30 倍内容,日常任务不再消耗积分。新界面支持从简单聊天到复杂构建的无缝切换,提升效率与创作自由度。Pro 用户相比 Core 用户拥有更高的使用上限,复杂任务可切换至 Power Mode 或 Max Mode。
Replit 为其平台应用推出了黑盒渗透测试功能,模拟外部攻击者通过网络和浏览器测试应用,无需访问源代码。该功能与现有的白盒代码扫描互补,用户可在项目安全中心运行‘Level 3’扫描同时启动两者。测试显示,两种扫描发现的漏洞重叠率很低,能分别捕捉逻辑缺陷和配置错误等不同安全问题。
推荐理由:原文对比了白盒与黑盒扫描的互补性,并给出了具体操作入口,读者可以据此评估其安全测试流程的完整性。
微软将于 2026 年 9 月 14 日停用 Excel 中的 COPILOT() 函数,该功能自 2025 年 8 月预览版推出后仅运行了一年。微软表示,侧边栏 Copilot 界面已能提供类似功能,包括文本摘要、数据分类、内容生成和网络信息检索。此前该函数一直处于预览状态,未正式发布,用户应避免在生产流程中依赖。
Replit 发布面向企业的大规模管理功能更新,包括 Admin API、审计日志和工作区设置。Admin API 测试版现已上线,审计日志支持超过 50 种事件并默认保留 30 天,工作区设置的首个功能将于本周末推出。这些更新旨在帮助企业管理员集中管理 AI 工具采用策略、监控活动并实现合规控制。
Meta 在 WhatsApp 上推出 Scam Alert 功能,通过端侧机器学习模型识别潜在诈骗消息,所有推理在设备本地完成,消息内容不离开设备。模型版本通过第三方透明日志发布,用户可查看透明日志并选择是否共享最后5条消息以帮助改进模型。
Mistral 宣布推出 Mistral Regional Endpoints 和 Mistral Priority Tier,以增强推理的区域控制和生产级可靠性。其平台将开始支持第三方开源模型,首个为 Z.ai 的 GLM-5.2。Mistral 还联合企业成立联盟,通过欧洲计算单位(ECUs)来确保欧洲的长期 AI 算力供应,目标是到 2030 年建设高达 1 GW 的算力容量。
推荐理由:Mistral 通过推出区域端点和优先服务层,为欧洲客户提供了符合数据驻留和监管要求的 AI 基础设施选项。
NVIDIA Nemotron 3.5 Lightning 模型已在 Ollama 上提供,这是一个专为长期运行的智能体设计的 300 亿参数开源模型。它采用混合专家架构,每 token 仅激活 30 亿参数,支持高达 100 万 token 的上下文,并针对本地 NVIDIA RTX 设备进行了优化,可实现比同类开源模型高 4 倍的吞吐量。
推荐理由:原文提供了模型的核心架构、性能基准和本地部署优势,读者可以据此评估它是否适合作为长期运行的智能体基座。
Weaviate 的 Search Mode 新增 effort 参数,可在查询时控制计算资源投入,ultrahigh effort 在 BRIGHT Biology 基准上将 nDCG@10 提升至 57.5,优于 Hybrid Search 的 13.0。
Interconnects 推出了 Artifacts Hub 和 Adoption Dashboard,提供对 Hugging Face 上主流模型的整理视图及下载和衍生模型的实时数据。
开源项目 ShieldFont 发布了一种新型字体,旨在干扰 AI 网络爬虫的数据抓取。该字体利用 OpenType 的 GSUB 功能,在 HTML 源码层面对约四分之一的单词进行同词性替换,使其对人类读者显示正常,但对爬虫呈现为语义混乱的文本。项目提供了在线演示、React 组件及 CSS/CDN 集成方式,默认字体基于 Playtype 的 Optik 修改,文件大小约 800 KB。
Replit 发布新的创意套件 Replit Design,旨在让用户快速将想法转化为设计。它内置 Ambient Intelligence 引导设计流程,支持调用 Claude、GPT-5、Gemini、Kimi 和 GLM 等模型,并集成了 Mobbin UI/UX 参考库和设计系统。该功能现已对所有用户开放。
Perplexity 将其 Model Council 功能扩展至基于云的 Computer 平台,允许用户配置由 2 到 8 个模型组成的“顾问团”并行处理查询,并由一个合成模型生成报告,明确指出共识与分歧。该功能现面向个人 Pro(20 美元/月)和 Max(200 美元/月)用户以及企业层级开放,但需消耗基于使用量的 Computer 积分,复杂任务成本可能较高。
AgentMemory for .NET 是一个独立开发的 .NET 原生实现,与 Neo4j Agent Memory 兼容并通过了全部 178 个测试场景。
Neo4j Virtual Graph 现在进入公测阶段,支持 Snowflake、Databricks 和 Google BigQuery 数据源,采用零拷贝架构实现知识图谱查询。
Together AI 推出专为生产环境设计的开源权重模型推理平台 Together Dedicated Model Inference。该平台每月处理超 400 万亿 tokens 的经验,可为用户提供对模型、性能、成本和功能的完全控制,并实现部署启动速度提升约 4 倍。企业可部署来自 Together 模型平台或自带的开源权重及微调模型,并选择经过优化的硬件配置。
Neo4j 推出 MCP for Aura,该托管 MCP 服务器无需额外成本即可集成到 Free、Professional 和 Business Critical 等层级的 Aura 实例中。
Bloom 现在支持在全图投影上运行图算法,提供比局部场景更全面的数据洞察。用户可在不编写代码的情况下,通过界面选择基于整个数据库的投影运行度中心性等算法,结果可写入数据库供后续参考。新功能适用于使用 Graph Data Science 插件或 Aura Graph Analytics 服务的 Neo4j 实例。
Thinking Machines Lab 发布了多模态专家混合模型 Inkling,支持文本、图像和音频输入,具备可控推理深度和广泛的微调能力。Inkling 采用查询条件相对注意力、短因果卷积和共享专家池 MoE 等架构创新,总参数量 975B,活跃参数量 40B,上下文窗口为 1M token。
推荐理由:原文介绍了新模型的核心架构创新和可控推理特性,读者可以了解其技术路径与现有模型的差异。
Together AI 为其 GPU 集群服务推出了一系列更新,重点提升生产环境中大规模训练和推理任务的可靠性与操作控制。新功能包括被动健康检查、自动节点修复以及基于 Slinky 1.0 重构的 Slurm-on-Kubernetes 2.0 堆栈,能够实时检测硬件故障并推荐修复方案。
Neo4j 推出 Virtual Graph,允许在 Databricks 和 Snowflake 等云数据平台直接运行 Cypher 查询和图算法,无需数据迁移。
FASHN 为时尚品牌提供规模化生成模特图与虚拟试穿的技术方案。其系统支持企业客户并行处理 500 个并发请求,能一次性处理整个产品目录。该方案旨在解决传统摄影的物流限制,并满足品牌对产品纹理、图案和颜色精确呈现的高要求。
开发者 Tarun Gupta 发布了 AI 求职工具 Autopilot-Jobhunt,能根据用户配置自动搜索匹配的职位,并通过 Telegram 通知用户。
Amazon Science 发布 Turnstile,一个用 Rust 编写的代理工具,用于在智能体与模型后端之间捕获生成时的精确 token ID、log probabilities 和 loss mask,确保强化学习训练信号与模型实际经历一致。
MorphMind 公司推出 Academic Humanizer 工具,旨在通过 Claude 技能改写 AI 辅助撰写的学术论文和项目申请书,使其语言更自然、更符合作者个人风格。该工具不生成新内容,仅作为编辑辅助,但无法验证原文论据或证据的可靠性。
Weights & Biases 的 tabular 数据智能体在 MLE-bench 表格数据部分取得第一名,获得两个金牌、三个高于中位数的成绩,四次提交全部有效。该智能体展示了在结构化数据任务中的卓越表现,为传统 tabular ML 方法注入了新活力。其开源可用性使开发者能够直接测试和集成该智能体到自己的项目中。
Weights & Biases 在 2026 年 6 月推出了 ARIA,一款新的 ML 研究助手,并上线了新的 Serverless Inference 模型。新增功能包括支持更高效的推理部署和改进的交互体验。相关产品和功能可通过其官方渠道获取更多信息。
Vector Institute 发布了免费开源 AI 工具 UnBias-Plus,可检测、解释并改写文本和 AI 训练数据中的偏见语言。该工具提供基于浏览器的公开版本(支持最多 750 词)和供开发者集成的安装包,旨在帮助新闻编辑、人力资源、医疗保健和 AI 开发团队识别并修正偏见。
推荐理由:原文给出了工具的具体功能、应用场景和获取方式,读者可以据此评估它如何帮助筛查和改写文本中的偏见。
Microsoft 为 Teams 会议引入新机制,通过行为与基础设施信号更准确地区分机器人与人类参与者,并要求人类在“大厅”中手动批准机器人加入。该功能旨在防止第三方服务机器人意外自动加入会议,以应对潜在的安全与隐私风险。微软计划为独立软件供应商提供机器人注册路径,并将在该功能全面部署后停用现有的 CAPTCHA 验证。
CoreWeave 推出 ARIA,一个用于 AI 研究和迭代的智能体,可自动读取并分析实验数据。ARIA 能够帮助研究人员将每次实验转化为持续改进的过程。该智能体目前尚未明确说明是否开源或提供 API 接口。
Ollama 0.31 为 Gemma 4 模型引入了多 token 预测技术,在 Aider polyglot 基准测试中平均 token 生成速度提升近 90%。
Weaviate 1.38 版本正式上线,HFresh 磁盘向量索引和内置 MCP 服务器达到通用可用状态。HFresh 支持 cosine 和 l2-squared 距离度量,通过压缩存储和增量重平衡机制优化大规模数据的内存和延迟表现。MCP 服务器允许 LLM、IDE 和 AI 智能体直接与 Weaviate 交互,且新增运行时配置功能,无需重启集群即可启用或禁用写入权限。
Anthropic 推出常驻 Slack 的智能体 Claude Tag,取代原有的 Claude for Slack 应用。Claude Tag 可作为团队成员加入频道,根据权限访问频道内的工具、数据和代码库,并能通过持续学习积累上下文,主动更新信息或自主安排任务。现有应用将于 8 月 3 日停服,企业版和团队版客户即日起可迁移,并在 9 月 1 日前迁移可获得最高 25,000 美元的积分。
推荐理由:原文详细描述了新功能的核心变化、迁移时间表和商业激励,读者可以据此评估其对团队协作流程的实际影响。
Claude 现在可以直接集成 Replit,用户可通过自然语言设计应用并直接发送至 Replit 继续开发,实现无缝工作流。该功能通过官方 Replit Connector 实现,支持将任何通用开发任务委托给 Replit 完成。无需复制粘贴或切换上下文,Claude 与 Replit 协同工作,缩短创意与实现之间的差距。
Ollama 更新其 MLX 引擎,在 Apple Silicon 上实现了迄今为止的最高性能,支持 NVIDIA 的 NVFP4 量化格式以减少质量损失,并引入快照系统优化 Agent 工作流。新引擎输出速度提升最高达 20%,并允许数据中心优化的模型在桌面端运行。用户可通过下载最新版 Ollama 并使用 `ollama run gemma4:12b-mlx` 命令体验。
推荐理由:Ollama 官方介绍了其 MLX 引擎在 Apple Silicon 上的多项性能优化,包括支持 NVFP4 量化格式和新的快照系统,对本地部署和 Agent 工作流有直接影响。
Replit 推出 Agent 自定义功能,允许用户通过 Skills 和自定义指令让 AI 智能体适配团队开发规范。Skills 是可复用的指令集,按任务触发,可存储在版本控制中并与团队共享。自定义指令则始终生效,用于设定如不提交密钥、使用 TypeScript 严格模式等全局规则。