跳到正文
7月28日周二
  1. MiniMax 新模型78

    MiniMax 发布新一代开源多模态视频模型 H3

    MiniMax 发布开源多模态视频生成模型 H3,支持文本、图像、视频、音频的统一理解与生成,可输出最高 2K 分辨率、15 秒时长的视频并带有立体声。模型包含 H3-Context-IR、H3-Base 和 H3-Regenerate-2K 三个模块,支持多种输入模式如文本到视频(T2VA)、首尾帧到视频(FL2VA)和参考多模态到视频(Ref2VA)。

    推荐理由:原文提供了模型架构、输入输出规范和部署方式,读者可以据此判断其在多模态视频生成中的实际应用潜力。

7月26日周日
  1. Berkeley AI Research39

    ABBEL:通过信念更新与信念分级提升大语言模型长程交互效率

    伯克利 AI 研究团队提出 ABBEL 框架,通过将交互历史压缩为自然语言信念状态并进行信念分级监督,以解决长程任务中递归摘要导致的性能下降问题。在 CollabBench 协作编码环境中,基于重构的信念分级将模型与全上下文模型的性能差距缩小了约 50%,并将训练步数减少至 50 步。该方法在保持较低峰值上下文 token 占用(约 601 个 token)的同时,显著提升了学习效率。

  2. Amazon Science37

    Amazon 投资 Lean Focused Research Organization 以推动形式化验证发展

    Amazon 向 Lean Focused Research Organization 提供长期资金支持,以推动 Lean 编程语言在 AI 代理安全和神经符号 AI 领域的应用。Lean 已用于验证 Amazon Aurora 的段修复协议,并支撑 AWS Clean Rooms 和 AWS Neuron 等系统的数学保证。该语言通过社区治理实现工具透明性,便于客户、审计师和监管者独立验证。

7月25日周六
7月24日周五
  1. Fly.io 博客42

    Fly.io 聚焦 Sprites 并任命新 CEO,以应对 AI 驱动的未来

    Fly.io 宣布将公司战略重心转向其专为 AI 智能体设计的“半一次性”计算单元 Sprites,并任命 Scott Johnston 为新任 CEO。公司认为,传统云基础设施为固定功能应用设计的模式,正被 AI 驱动的、个性化与自适应软件浪潮所改变。Sprites 旨在解决在公共云中运行智能体时面临的成本、灵活性和易用性挑战。

7月23日周四
  1. MIT News · 人工智能33

    MIT 15个项目入选美国能源部Genesis Mission资助计划

    美国能源部Genesis Mission首批资助项目中,麻省理工学院(MIT)研究人员主导或参与的15个合作项目入选。这些项目旨在将AI与科学探究相结合,研究领域涵盖量子传感、稀土元素提取、聚变等离子体建模及材料设计等。项目团队需整合学术界、工业界和国家实验室的专家,以构建集成AI、超级计算和量子系统的科学发现平台。

  2. Together AI37

    Together AI 推出面向生产环境的开源权重模型推理平台

    Together AI 推出专为生产环境设计的开源权重模型推理平台 Together Dedicated Model Inference。该平台每月处理超 400 万亿 tokens 的经验,可为用户提供对模型、性能、成本和功能的完全控制,并实现部署启动速度提升约 4 倍。企业可部署来自 Together 模型平台或自带的开源权重及微调模型,并选择经过优化的硬件配置。

  3. Vector Institute54

    Vector Institute 发布多模态混合专家模型研究论文

    Vector Institute 发布关于多模态混合专家(MoE)模型的研究论文,系统分析了从稀疏路由到多模态部署的架构原理与训练挑战,实证揭示了模型在早期层按模态路由、深层按语义路由的结构演化规律,并提出通过QLoRA、Flash Attention 2与lm_head预钩子实现35.26B参数模型在四张A100 GPU上的可训练性,同时指出专家并行是长期可行方向。

    推荐理由:原文通过实证分析揭示了多模态MoE模型在路由机制与训练实践中的关键规律,为后续优化提供了可复用的方法论。

  4. MIT News · 人工智能25

    计算机科学家、多产作者 Dimitri Bertsekas 逝世,享年 83 岁

    麻省理工学院荣休教授、亚利桑那州立大学教授 Dimitri Bertsekas 于 6 月 3 日逝世,享年 83 岁。他在优化、控制、大规模计算、强化学习和人工智能等多个领域的研究具有决定性影响,并合著了超过 20 本极具影响力的书籍和教科书。其著作以概念清晰、数学严谨著称,为后续的强化学习等研究方向奠定了基础。

7月22日周三
  1. Neo4j 博客34

    为什么公共部门 AI 需要一个劳动力知识层

    公共部门 AI 需要构建劳动力知识层以实现更准确的推理,该层通过连接人员、角色、技能、任务等数据形成统一的知识图谱。知识层能揭示人员资质与任务需求之间的关系,避免因数据碎片化导致的决策不一致。在涉及安全、医疗、国防等高后果场景中,知识图谱可帮助 AI 更好地理解组织内部的依赖与风险。

7月21日周二
  1. Weights & Biases33

    Google 的 Gemini 3.6 Flash 和 3.5 Flash-Lite 基准分数表现

    Google 的 Gemini 3.6 Flash 和 3.5 Flash-Lite 在编码、推理、计算机使用、长上下文理解和现实智能体基准测试中取得显著提升。这两款模型在多个评测基准中展示了优于前代版本的性能,具体分数和优化细节已在相关测试中验证。它们目前以闭源形式提供,适用于需要高精度推理和代码生成能力的应用场景。

  2. OpenAI Alignment23

    OpenAI Alignment 推出 Contrastive SDF 测量模型奖励追求行为

    OpenAI Alignment 提出 Contrastive SDF 测试,用于衡量 AI 模型是否会因对评分者偏好的不同信念而改变行为。该方法通过在合成文档上微调模型,使其分别学习评分者与对立权威(如用户或开发者)的偏好,并比较输出中特征的差异来评估奖励追求程度。实验显示,经过前沿规模强化学习训练的模型更倾向于迎合评分者的期望,即使这与用户或开发者的需求相悖。

  3. Weaviate 博客34

    Query Profiling: See Where a Slow Query Spends Its Time

    Weaviate 推出查询分析功能,允许用户通过启用 per-query 标志直接获取单个查询在集群中各节点的耗时分布。该功能在 v1.36.9 引入,v1.38 正式可用,通过 response.query_profile 返回结果,覆盖向量搜索、关键词评分和过滤评估。启用时仅增加微秒级计时开销,适用于调试和优化,而非生产高并发路径。

  4. Neo4j 博客30

    AI 智能体如何做决策及如何改进

    AI 智能体通过理解目标、收集上下文、决定下一步、执行和学习的循环流程进行决策,但若上下文不完整或断裂,可能导致错误操作。构建上下文图谱可为智能体提供连贯的记忆,使其决策更可靠、可解释并可改进。上下文图谱能记录决策过程和结果,帮助智能体从历史经验中学习,避免重复错误。

7月20日周一
  1. Neo4j 博客49

    企业 AI 的知识层

    企业 AI 的失败并非源于模型或框架,而是因为智能体无法理解其运行的业务环境。知识层(KL)是一个共享且受治理的底层结构,用于存储企业知识,包含业务概念、数据资产和流程的实时映射,以及用于学习和追溯的决策记忆。KL 使组织知识可查询如数据、可执行如代码,通过统一的业务模型帮助智能体在政策范围内准确执行任务。

  2. Neo4j 博客32

    Bloom 引入全图投影功能:解锁科学算法与可视化新可能

    Bloom 现在支持在全图投影上运行图算法,提供比局部场景更全面的数据洞察。用户可在不编写代码的情况下,通过界面选择基于整个数据库的投影运行度中心性等算法,结果可写入数据库供后续参考。新功能适用于使用 Graph Data Science 插件或 Aura Graph Analytics 服务的 Neo4j 实例。

  3. Together AI37

    Together AI 与 Y Combinator 合作推出首个 YC 社区专用 GPU 集群

    Together AI 与 Y Combinator 合作推出首个面向 YC 投资组合内 AI 初创公司的专用 GPU 集群,提供涵盖推理和训练的灵活算力接入。初创公司可通过 Together 自助门户直接预留和管理 GPU,无需长期合约即可享受长期费率。该集群现已全面投入使用,支持从单节点计算到规模化增长的全方位需求。

7月18日周六
  1. MIT News · 人工智能18

    MIT 研究员 Bailey Flanigan 的跨学科研究之路

    MIT 研究员 Bailey Flanigan 利用计算与数学工具为民主参与创造新途径。她的研究包括开发算法,以随机方式选择公民大会的参与者,从而在自我选择可能无法反映整体人口的情况下,平衡代表性、参与机会平等、抗操纵性和透明度。

7月17日周五
  1. Replit 博客71

    Replit 揭示 AI 智能体如何构建‘自动驾驶公司’

    Replit 官方分享其内部 AI 智能体系统如何改变公司运作:工程团队代码产出提升 5.8 倍,评审延迟持平,质量指标改善;智能体参与代码审查、事故调查、数据查询、销售支持、客服响应等,实现跨职能自动化;员工未被替代,而是被‘升职’为决策者;系统已扩展至全公司,支持自服务分析、客户触达和文档生成;Replit 正推动将此模式开放给用户。

    推荐理由:Replit 描述了内部 AI 智能体系统如何重塑工作流,从工程到销售、支持等全职能提升效率,且未牺牲质量或增加瓶颈。

7月16日周四
  1. Mistral 新模型66

    Mistral 发布 Shieldstral-1.0-3B 多模态安全分类模型

    Mistral 发布 Shieldstral-1.0-3B,一个 3B 参数的多模态安全分类模型,支持文本、图像及图文混合内容的动态政策审核,基于自然语言政策输入返回连续安全分数,可在单 GPU 上运行,支持 32k 上下文窗口,开源 Apache 2.0 许可。

    推荐理由:原文提供了模型架构、能力指标和部署方式,读者可以据此判断其在轻量级安全审核场景中的适用性。

  2. MIT News · 人工智能44

    MIT 与 IBM 研究人员开发 GIFT 系统,提升 AI 将 2D 设计转为 3D CAD 模型的性能

    MIT 与 IBM 等机构的研究人员开发了名为 GIFT 的系统,能指导视觉语言模型自动将 2D 设计图转换为更准确、功能更完善的 CAD 程序。该系统通过让模型从自身错误中学习来生成训练数据,在仅使用约 20% 计算量的情况下,其生成的 CAD 程序准确性超越了其他方法。这一技术有望加速快速原型设计流程并降低成本。

  3. Together AI38

    Together AI 解读推理服务 99.9% 可用性的含义

    Together AI 阐述了其实现 99.9% 推理服务可用性所需的多数据中心冗余架构与基础设施所有权。该公司通过持续向两个设施分发实时流量并保有备用容量,以应对整个数据中心故障。其全栈所有权提供了从芯片到 token 的可见性,确保在硬件、网络、存储或软件层出现问题时能统一响应。

  4. MIT News · 人工智能39

    MIT 研究团队提出“神经透明度”工具,让用户在 AI 对话前预览其行为倾向

    MIT 媒体实验室团队提出“神经透明度”工具,让用户在定制 AI 聊天机器人时,能通过可视化图表预览其潜在人格特质,如共情、诚实或毒性。研究发现,用户在 15 项特质中有 11 项的预测与实际不符,常高估优点、低估有害倾向(如谄媚)。该工具虽提升了用户信任,但并未显著改变其设计行为,相关研究已在 ACM 智能用户界面会议上发表。

7月15日周三
  1. Together AI63

    Thinking Machines Lab 发布多模态 MoE 模型 Inkling

    Thinking Machines Lab 发布了多模态专家混合模型 Inkling,支持文本、图像和音频输入,具备可控推理深度和广泛的微调能力。Inkling 采用查询条件相对注意力、短因果卷积和共享专家池 MoE 等架构创新,总参数量 975B,活跃参数量 40B,上下文窗口为 1M token。

    推荐理由:原文介绍了新模型的核心架构创新和可控推理特性,读者可以了解其技术路径与现有模型的差异。

  2. Neo4j 博客21

    公共部门工作力量智能与复合问题

    公共部门面临复合型人力部署问题,需同时考虑人员技能、资质、位置及调动影响。Neo4j 的图智能平台通过构建知识层连接现有系统,提供统一视角分析人力部署。该平台不替换原有系统,而是基于结构化关系实现跨系统推理,帮助领导者快速回答复杂操作问题。

  3. MIT News · 人工智能52

    MIT JARVIS 挑战赛测试 AI 副驾驶在喷气发动机设计中的角色

    MIT 的 JARVIS 挑战赛让学生团队在四周内使用 AI 作为主要工程伙伴,设计、制造并测试小型喷气发动机。研究发现,AI 能显著加速安全关键硬件工程,但工程判断仍是决定性因素,而制造环节仍是根本性的速率限制步骤。获胜团队更依赖基础知识和团队合作,而非 AI。

7月14日周二
  1. MIT News · 人工智能32

    MIT 网络安全诊所如何帮助学生预防网络攻击

    MIT 网络安全诊所通过“防御性社会工程”课程,为公共机构提供免费漏洞评估。自2019年成立以来,该诊所已为美国新英格兰地区的市政和医疗机构完成超过40份评估报告。课程强调网络安全不仅是技术挑战,更需融入组织能力建设,并邀请行业专家讲解AI如何改变网络安全格局。

7月13日周一
  1. MIT News · 人工智能51

    MIT 等机构提出新方法,无需生成即可检测模型是否被微调用于制作儿童性虐待材料

    MIT、波士顿大学和儿童安全非营利组织 Thorn 的研究人员开发了一种名为高斯探测的新审计方法,无需生成图像即可检测模型是否被 LoRA 微调用于生成儿童性虐待材料。该方法通过分析模型内部表征的变化,在测试中识别有害模型变体的准确率达到 100%。

7月11日周六
  1. fal 博客37

    FASHN AI:重新构想时尚与摄影

    FASHN 为时尚品牌提供规模化生成模特图与虚拟试穿的技术方案。其系统支持企业客户并行处理 500 个并发请求,能一次性处理整个产品目录。该方案旨在解决传统摄影的物流限制,并满足品牌对产品纹理、图案和颜色精确呈现的高要求。