跳到正文
7月13日周一
  1. MIT News · 人工智能51

    MIT 等机构提出新方法,无需生成即可检测模型是否被微调用于制作儿童性虐待材料

    MIT、波士顿大学和儿童安全非营利组织 Thorn 的研究人员开发了一种名为高斯探测的新审计方法,无需生成图像即可检测模型是否被 LoRA 微调用于生成儿童性虐待材料。该方法通过分析模型内部表征的变化,在测试中识别有害模型变体的准确率达到 100%。

7月11日周六
7月10日周五
  1. Vector Institute24

    Vector Institute 与欧洲航天局合作推进地球观测 AI

    Vector Institute 与欧洲航天局(ESA)建立合作伙伴关系,共同开发用于地球观测的人工智能新应用。合作初期将重点聚焦于气候科学和北极监测,Vector 学院教员 Evan Shelhamer 已作为访问教授加入 ESA 的 Φ-lab。此次合作旨在利用 AI 处理 ESA Copernicus Sentinel 卫星群产生的大量数据,并将科学开放性和可及性作为核心设计原则。

7月9日周四
7月7日周二
  1. Berkeley AI Research45

    Berkeley AI Research 视角:智能近乎免费时代下,面向、构成与由 AI 智能体驱动的数据系统

    随着 AI 推理成本急剧下降,GPT-4 级别能力的成本已从 2023 年初的每百万 token 约 30 美元降至如今低于 1 美元,部分提供商甚至低于 0.1 美元。这标志着足以胜任大多数知识工作的智能正变得近乎免费,从而催生了数据系统需为 AI 智能体设计、由智能体构成以及由智能体构建的三大新挑战与机遇。

7月3日周五
  1. Vector Institute35

    Vector Institute 研究人员在 ICML 2026 推进生成式 AI、负责任 AI 与科学发现

    Vector Institute 研究人员在第 33届国际机器学习大会(ICML 2026)上展示了73篇被接收论文,涵盖强化学习、后训练、生成式AI、视频生成、多模态系统及AI治理等多个前沿领域。其中11篇被选为焦点论文,创下该研究所在ICML的最佳纪录。研究工作还涉及科学发现应用,包括基因组学、量子化学和材料建模。

6月30日周二
  1. Vector Institute54

    Vector Institute 发布免费开源 AI 工具 UnBias-Plus,用于检测和改写文本偏见

    Vector Institute 发布了免费开源 AI 工具 UnBias-Plus,可检测、解释并改写文本和 AI 训练数据中的偏见语言。该工具提供基于浏览器的公开版本(支持最多 750 词)和供开发者集成的安装包,旨在帮助新闻编辑、人力资源、医疗保健和 AI 开发团队识别并修正偏见。

    推荐理由:原文给出了工具的具体功能、应用场景和获取方式,读者可以据此评估它如何帮助筛查和改写文本中的偏见。

6月29日周一
6月27日周六
  1. Weights & Biases32

    Building an observable robotics data flywheel

    通过 PPO、Weave 和合成遥测技术构建可观察的机器人数据飞轮,记录失败案例并在复杂赛道上重新训练模型,验证模型恢复效果。该方法支持在训练过程中实时监控数据流动,提升模型适应能力。技术方案适用于强化学习场景,强调数据闭环对机器人系统优化的重要性。

6月25日周四
  1. Amazon Science38

    Amazon 投资 TRISO 燃料技术,推动 Xe-100 核反应堆部署以支持 AI 基础设施

    Amazon 正投资 TRISO 燃料技术,支持 Xe-100 核反应堆在华盛顿州的部署,每台机组可提供 80 兆瓦电力,最多可部署 12 台。TRISO 燃料颗粒在 1800°C 下仍保持稳定,失败率低于 6.6×10⁻⁵,具备 10 万年级长期放射性隔离能力。该技术采用高纯度低富集铀(HALEU),兼容氦冷与熔盐冷却,支持模块化、连续换料设计。

6月24日周三
6月19日周五
  1. OpenAI Alignment49

    OpenAI 对齐研究:通过强化学习提升模型广泛有益行为的泛化能力

    OpenAI 发现,在现实场景中针对有益特质进行强化学习,可使模型在多个衡量对齐和有益行为的基准测试中表现更优。这些对齐提升可泛化到训练未涉及的领域,并在对抗性压力下保持稳定。研究构建了一个涵盖健康、教育、科学等领域的现实对话数据集,用于训练和评估模型的诚实、可纠正性、透明度等特质。

6月18日周四
  1. Weaviate 博客62

    Weaviate 大规模数据导入与向量化实践指南

    Weaviate 官方发布大规模数据导入与向量化实践指南,涵盖服务器端批处理、错误处理与重试机制、数据类型选择、多模态数据处理(如 PDF、图像、视频)以及使用 blobHash 降低存储成本的方法。

    推荐理由:原文提供了大规模数据导入的完整实践指南,包括批处理、错误处理、数据类型选择和多模态处理,读者可直接用于优化现有流程。

6月17日周三
6月11日周四
  1. Vector Institute31

    Anne Martel:使用 AI 个性化癌症治疗

    Anne Martel 研究开发 AI 系统,从医学影像和临床文本数据中提取可操作信息,以帮助预测癌症患者对不同治疗方案的反应。她的团队近期在 ICCV 展示了如何通过基因组信息微调病理图像大模型,并结合临床记录文本提升预测准确性。该研究推动医疗影像 AI 从单纯应用计算机科学方法转向产生基础性创新,影响更广泛的 AI 社区。

  2. Replit 博客30

    Replit | Databricks:快速应用构建与细粒度数据治理结合

    Replit 与 Databricks 集成新增用户到机器(U2M)连接器功能,支持基于 Unity Catalog 权限自动控制每个用户的数据访问范围。此次更新还开放了公测预览注册,企业团队可在 Replit 构建应用并直接部署至 Databricks,无需额外配置。Replit 提供静态 IP 支持,便于 IT 团队审批并确保与现有网络策略一致。

6月9日周二
  1. Amazon Science42

    Project Eluna 如何实现物理世界中的智能体对齐

    Project Eluna 是 Amazon 推出的智能体 AI 模型,用于在仓储中心等物理环境中自主执行多步骤任务。该模型通过物理引导深度学习、不确定性感知推理、文本到数值的桥梁构建等方法,确保推理符合物理规律并提升可靠性。其不确定性框架 UQ4CT 在五个基准测试中保持高准确率,同时将预期校准误差降低 25% 以上。

6月3日周三
  1. Amazon Science42

    Amazon Science:Ground truth 是一个过程,而非数据集

    Amazon 的 AGI 团队提出了一种新的评估协议 audit-then-score,用于验证 AI 生成的研究报告中的事实准确性。该协议通过让 AI 检查器质疑基准答案并提供证据,由人工审计员进行比较和修订,使基准本身成为动态过程。在 DeepFact-Bench 上,基于 GPT-4.1 的 DeepFact-Eval 准确率达到 83.4%,优于传统事实核查系统和先前深度研究系统。

5月28日周四
5月26日周二
5月25日周一
  1. Vector Institute21

    Mohamad Moosavi:用 AI 加速气候解决方案的探索

    Mohamad Moosavi 通过深度学习使分子可微分,从而将材料科学中的离散变量转化为连续变量,大幅提升了材料发现和设计的效率。他目前使用拓扑深度学习方法,研究材料三维结构与性能之间的关系,无需逐一合成和测试大量候选材料。这种突破性方法为应对气候变化的可持续技术开发提供了更快的路径,加拿大凭借顶尖科研人才和对可持续发展的重视,正成为该领域创新的重要推动者。

5月19日周二
  1. Vector Institute29

    健康AI实施工具包 2.0:面向2026年的安全战略蓝图

    健康AI实施工具包 2.0 是 Vector Institute 发布的全面指南,用于指导医疗系统在实际部署中负责任地管理整个AI生命周期。该工具包包含三个核心支柱:战略AI治理、偏见缓解与公平性、以及安大略省医院的现实验证案例。工具包新增了持续监控、模型漂移检测和部署后验证等策略,以应对医疗AI在实际应用中可能带来的风险。

5月12日周二
5月8日周五
  1. Berkeley AI Research35

    自适应并行推理:高效推理扩展的下一个范式

    自适应并行推理让推理模型能自行决定何时分解并并行化独立子任务、生成多少并发线程以及如何协调它们。这种方法旨在解决顺序推理因探索路径线性增长而导致的延迟增加、计算密集和上下文窗口受限问题。研究分析了从固定并行到自适应控制的各种方法,指出让模型根据问题自适应决策是提升并行化效果的关键。

5月7日周四
  1. OpenAI Alignment48

    OpenAI 探究在 RL 训练中意外对 CoT 进行评分的后果

    OpenAI 发现部分已发布的 GPT 模型在 RL 训练中意外接受了 CoT 评分,包括 GPT-5.4 Thinking、GPT-5.1 Instant 至 GPT-5.4 Instant、GPT-5.3 mini 和 GPT-5.4 mini。分析显示这些情况未造成 CoT 可监控性显著下降,但存在潜在风险。为防止类似问题,OpenAI 已修复相关奖励路径并加强内部流程与检测系统。

5月6日周三
  1. Weaviate 博客40

    Your LLM Is Only as Good as What It Retrieves

    检索质量是影响大语言模型输出可靠性的关键因素,当检索失败时,模型会生成看似合理但缺乏事实依据的内容。研究发现,在 HaluEval、TruthfulQA 和 FaithDial 等基准测试中,检索层问题始终是幻觉产生的主要来源。五种常见的检索失败模式包括检索漂移、上下文截断、过时索引污染、低相关性 top-k 检索和智能体间误通信,这些问题在多智能体系统中尤为隐蔽且难以检测。

4月30日周四
  1. Together AI34

    Together AI 与 Adaption 合作,在 Adaptive Data 中集成 Together Fine-Tuning

    Together AI 与 Adaption 合作,将 Together Fine-Tuning 集成到 Adaptive Data 平台中。Adaption 平台能帮助团队分析数据集结构、优化训练数据,早期部署平均提升数据质量 82%。用户可在 Adaption 中优化数据集后,直接启动 Together Fine-Tuning 进行微调,并部署到 Together AI 的高性能推理服务上。

4月28日周二
  1. Vector Institute25

    Hassan Ashtiani:通过数学基础构建可信 AI

    Hassan Ashtiani 研究如何通过数学证明确保 AI 系统在面对复杂攻击时仍能保持隐私和可靠性。他提出“黑盒约简”方法,可将现有机器学习技术封装进隐私保障框架,无需重新设计算法。该方法已在 NeurIPS 2018 获得最佳论文奖,有助于加拿大在保护隐私的同时推动 AI 发展。

4月24日周五
  1. Together AI44

    Together AI 发布 distribution-aware speculative decoding 框架,将 RL 训练 rollout 速度提升最高 50%

    Together AI 推出的 distribution-aware speculative decoding (DAS) 框架将 RL 后训练中的 rollout 阶段速度提升了最高 50%,且不影响模型输出质量。该框架包含自适应后缀树草稿器和长度感知调度策略,在 DeepSeek-R1-Distill-Qwen-7B 的数学推理任务中实现了超过 50% 的 rollout 时间缩减。

4月20日周一
  1. Berkeley AI Research49

    GRASP:面向长时程世界模型的梯度规划方法

    伯克利 AI 研究团队提出梯度规划器 GRASP,旨在解决基于学习型世界模型进行长时程规划时面临的优化病态、局部极小值和高维潜在空间失效等难题。该方法通过将轨迹提升至虚拟状态以实现跨时间并行优化,直接向状态迭代添加随机性以增强探索,并重塑梯度以提供清晰的动作信号。GRASP 提升了梯度规划在长时程、高维视觉空间任务中的鲁棒性。

4月18日周六
4月15日周三
4月14日周二
  1. ARC Prize35

    ARC-AGI-3 人类表现数据集发布:458 名参与者完成 25 个抽象推理环境测试

    ARC Prize 发布了 ARC-AGI-3 人类测试数据集,包含 458 名参与者在 25 个抽象推理环境中的表现,所有环境均在无先验训练条件下完成。数据集显示人类完成率从 2/12 到 10/10 不等,其中 lp85 环境有 54 次尝试和 15 次成功解决。该数据集开源,提供每环境的完成次数、解决次数及前 10 名回放得分,用于分析人类解决效率和策略。

4月3日周五
3月18日周三
  1. Together AI56

    Together AI 扩展微调服务,支持工具调用、推理和视觉模型

    Together AI 扩展其微调服务,新增了对工具调用、推理和视觉语言模型的原生支持。服务升级了训练栈,可更高效地处理 100B+ 参数模型,吞吐量提升最高达 6 倍,并支持最大 100GB 的数据集。

    推荐理由:Together AI 的微调服务新增了对工具调用、推理和视觉模型的支持,并提升了大规模模型训练的效率。

3月17日周二
  1. Together AI61

    Together AI 发布 Mamba-3 状态空间模型

    Together AI 联合多所大学的研究人员发布了 Mamba-3,这是一个以推理效率为主要目标的新状态空间模型。Mamba-3 通过更复杂的循环公式、复数值状态跟踪和 MIMO 变体提升了性能,其 SISO 版本在 1.5B 规模上,所有序列长度的预填充+解码延迟均优于 Mamba-2、Gated DeltaNet 和 Llama-3.2-1B。

    推荐理由:Mamba-3 将设计目标从训练效率转向推理效率,并开源了内核,为关注部署性能的开发者提供了新的架构选择。