跳到正文
8月25日周二
  1. 智谱 GLM 新模型66

    智谱发布 GLM-5.3-Flash 多模态大模型

    智谱发布 GLM-5.3-Flash,为 GLM-5 系列首个原生多模态模型,拥有 320B 总参数和 18B 激活参数,采用稀疏与线性注意力混合架构及 mHC 技术,支持本地部署于 SGLang、vLLM 等框架,推理成本降低至前代十分之一,性能接近 Claude Opus 4.8 在编码与智能体基准上的表现。

    推荐理由:原文提供了模型架构、参数规模、部署框架和基准表现,读者可据此判断其在多模态和推理效率上的实际进展。

  2. 智谱 GLM 新模型77

    智谱 GLM-5.3-BF16 模型发布,强化编码与智能体能力

    智谱发布 GLM-5.3-BF16 模型,基于 GLM-5.2 基座通过后训练提升能力,在编码、长链任务和智能体场景中表现显著增强。在 Z.ai Code Bench 上编码能力提升 50%,在 Terminal Bench 3.0、Agents' Last Exam、DeepSWE 等多个公开基准上达到开源模型 SOTA。

    推荐理由:原文提供了与前代模型的基准对比和本地部署方案,读者可据此判断其在编码和智能体任务中的实际能力提升与应用适配性。

  3. 智谱 GLM 新模型67

    智谱发布 GLM-5.3-Flash 多模态大模型

    智谱发布 GLM-5.3-Flash,为 GLM-5 系列首个原生多模态模型,拥有 320B 总参数和 18B 活跃参数,支持 300,000 token 上下文,采用混合稀疏与线性注意力架构及 mHC 技术,部署框架包括 SGLang、vLLM、TokenSpeed 等,可通过 reasoning_effort 参数控制推理预算,API 服务可在 Z.ai 平台使用。

    推荐理由:原文给出了模型参数、架构创新和部署框架,读者可以据此判断其在多模态和长上下文场景下的实际应用潜力。

  4. 智谱 GLM 新模型64

    智谱 GLM-5.3 发布:开源大模型在编码与智能体任务中取得显著提升

    智谱发布 GLM-5.3 模型,基于 GLM-5.2 的基础模型,通过后训练提升能力,在编码、长链任务和智能体基准上表现显著增强。在 Z.ai Code Bench 上编码能力提升 50%,在 Terminal Bench 3.0、Agents' Last Exam、CyberGym 等多个公开和内部基准中达到开源 SOTA。

    推荐理由:原文提供了与多个主流模型的基准对比数据和本地部署方案,读者可据此判断其在编码和智能体任务中的相对位置与可用性。

  5. Engineering at Meta57

    Meta 发布专为 AI 规模设计的 RDMA 传输协议 MetaRoCE

    Meta 发布 MetaRoCE,这是一种专为 AI 工作负载设计的 RDMA 传输协议,适用于大规模以太网环境。MetaRoCE 通过 Open Compute Project (OCP) 开源了协议规范、参考软件实现和合规测试套件。

    推荐理由:Meta 开源了专为 AI 规模设计的 RDMA 传输协议 MetaRoCE,包含规范、参考实现和测试套件,可提升分布式训练和推理效率。

  6. MIT News · 人工智能41

    MIT 开发无需极端数据的极端事件场景生成工具 η-learning

    MIT 工程师开发了一种名为 η-learning 的机器学习算法,无需依赖历史极端事件数据即可生成未来可能发生的极端天气场景。该方法结合点统计数据和空间地图,能预测如“百年一遇”风暴的持续时间、强度和影响范围等特征。该工具还可应用于机器人导航和金融市场等其他领域,以探索罕见但合理的极端情景。

  7. Engineering at Meta55

    Meta发布MTIA 300训练芯片:集成NIC和通信卸载引擎

    Meta发布MTIA 300训练芯片,专为推荐和排序模型训练设计,集成12个800 Gbps RDMA NIC芯片,提供1.2 TB/s I/O带宽,通信与计算分离,通过16个专用消息引擎实现通信卸载,与GPU相比通信时间提升3.9倍。芯片支持HCCL通信库,可编译通信操作为独立子图,实现主机无干预执行,适用于PyTorch框架。

    推荐理由:原文详细说明了MTIA 300芯片的通信架构设计和性能提升,读者可据此理解其如何解决推荐模型训练中的通信瓶颈问题。

  8. Mistral AI38

    Mistral 与 HUMAIN 宣布战略合作以推进沙特及中东地区主权 AI

    Mistral 与 HUMAIN 宣布达成一项价值数亿欧元的战略合作,共同推进沙特阿拉伯及中东地区的主权 AI。合作将聚焦于 AI 基础设施、先进模型开发及本地化部署,初期重点包括网络安全和语音领域,并计划开发在阿拉伯语表现强劲的前沿模型。双方还将探索利用 HUMAIN 的数据中心基础设施来满足当地不断增长的计算需求。

8月24日周一
  1. IEEE Spectrum · AI36

    自动驾驶汽车如何通过自然语言调整驾驶风格

    研究人员开发了一种系统,利用 OpenAI 的 GPT-4o-mini 模型将自然语言请求如“我迟到了,开快点”转化为对自动驾驶控制系统的参数调整。该系统通过非技术语言向乘客描述行为变化,并在实施前请求确认,使驾驶风格更符合用户偏好。测试显示,系统在模拟环境中能根据提示调整速度和驾驶平滑度,且支持用户后续互动修改。

  2. IEEE Spectrum · AI26

    What It Takes to Be an Adaptable Engineer 的中文标题

    工程师需要具备适应能力以应对 AI 带来的技术变革,但教育和职场培训往往未明确解释其含义。亚利桑那州立大学教授 Samantha Brunhaver 指出,适应性意味着识别变化并有效应对,且在不同行业中表现形式各异。微软研究员 Jenna Butler 表示,软件工程师正面临代码审查增加等挑战,需学习新工具和智能体管理以保持竞争力。

  3. Import AI33

    Import AI 470:AI 在网络安全等领域加速科学发现,SPADE 框架实现环境自动生成

    METR 研究显示,AI 在 2026 年显著加速了网络安全漏洞的发现,对数学研究有轻微加速,但对 AI 研究本身的优化尚无显著影响。SPADE 框架利用 Qwen3-30B 等模型通过自我博弈,自动生成可执行的游戏和工具使用环境,以合成数据训练智能体,在 Reasoning Gym 等基准测试上提升性能。

  4. The Register · AI/ML34

    Canonical 支持用 AI 将大量 C 代码安全转换为 Rust 的研究项目

    Canonical 正在资助一项为期三年的博士研究项目,探索是否能用 AI 将数万行 C 代码分解并转换为安全、行为正确且可维护的 Rust 代码。该项目将在布里斯托大学编程语言研究组进行,重点分析现有源代码到源代码翻译工具的不足,例如保留了 C 的不安全操作和复杂习惯用法。

  5. 千问 Qwen 新模型74

    千问 Qwen3.8-Flash-Next-FP8 模型发布

    千问发布 Qwen3.8-Flash-Next-FP8 模型,为基于 Qwen3.8-Flash-Next 架构的 FP8 量化版本,支持 262,144 令牌上下文,可扩展至 100 万令牌。

    推荐理由:原文公开了新架构的量化模型权重、技术细节和基准结果,读者可据此评估其在长上下文和多模态任务中的效率与性能表现。

8月22日周六
8月21日周五
  1. Together AI65

    GLM-5.3 与 Claude Fable 5 在 DeepSWE 上的对比:成本、编码能力与路由策略

    Together AI 在 DeepSWE 基准上对比 GLM-5.3 与 Claude Fable 5,两者首试准确率分别为 69.0% 和 69.7%,差距在误差范围内。

    推荐理由:在 DeepSWE 基准上,GLM-5.3 与 Claude Fable 5 在首试准确率接近,但前者成本更低、多轮表现更优,且在多数编程语言和任务领域胜出,为开发者提供明确的性价比选择。

  2. Together AI65

    GLM-5.3 与 GPT-5.6 Sol 在 DeepSWE 上的成本、编码与路由策略对比

    Together AI 在 113 项 DeepSWE 任务上对比了 GLM-5.3 (max) 与 GPT-5.6 Sol (max)。GPT-5.6 Sol 在单次尝试准确率(pass@1 72.7% vs 69.0%)、可靠性和速度上保持领先,但每次尝试成本($8.37)是 GLM-5.3($3.99)的两倍多。

    推荐理由:原文通过详尽的基准测试和成本分析,为开发者提供了在不同编程语言和任务类型下选择或组合使用这两个模型的决策依据。

  3. MIT News · 人工智能21

    MIT 研究人员开发预测电化学合成氨催化剂材料的新方法

    MIT 研究人员开发了一种新方法,可预测哪些材料最有潜力成为电化学合成氨的催化剂,以加速寻找能使这种低排放方法与哈伯法竞争的材料。该方法通过识别驱动氨生产催化活性的关键物理性质,指导寻找新的、更有效的催化剂化合物。相关开放获取研究成果已发表在《EES Catalysis》期刊上。

  4. The Pragmatic Engineer30

    The Pulse:我们需要讨论用 AI 进行框架迁移

    The Pulse 报道了 Asana 使用 AI 在两周内完成从 Enzyme 测试框架迁移的案例,AI 显著加速了大规模测试用例重写工作。Airbnb 和 Uber 也有类似经历,表明 AI 在框架迁移中具有显著优势。文章还提到 GitHub 近期宕机事件、Slack 推出 Slack Code、Claude 生成文本将添加水印以及 Uber 开源 SubmitQueue。

  5. Microsoft Research33

    Microsoft Research 的 Skala 1.1 提升预测性密度泛函理论精度并扩大软件集成

    Microsoft Research 发布了深度学习密度泛函交换关联泛函 Skala 1.1,其训练数据量是前代版本的 2.5 倍,在 GMTKN55 基准测试的 55 个类别中,有 32 个类别排名第一。Skala 现已集成于 CP2K,并正在整合到 Psi4、FHI-aims、ORCA 和 VASP 等主流电子结构软件中,以扩大其在科学和工业工作流程中的可及性。

8月20日周四
  1. The Register · AI/ML62

    Slack 推出 Slack Code 功能,将 AI 编码智能体引入群聊

    Slack 推出 Slack Code 功能,允许 AI 编码智能体在群聊环境中工作。智能体可以创建专用代码频道,团队成员可实时查看其工作、审查代码变更并指导调整。该功能支持 Anthropic 的 Claude、GitHub Copilot 和 OpenAI 的 ChatGPT 等智能体集成,未来将开放 API 支持更多应用场景。

    推荐理由:Slack 将 AI 编码智能体引入群聊环境,展示了协作开发的新工作流可能性。

  2. The Pragmatic Engineer30

    Addy Osmani 从 Chrome 开发工具到 AI 工程的历程

    Addy Osmani 谈及从 16 岁开发浏览器到成为 Google 工程总监的经历,并分享了他对 AI 工具在软件工程中应用的看法。他指出 AI 协助开发存在“认知放弃”风险,建议工程师理解 LLM 的关键决策以避免问题。他还提到 Google 工程文化近年变化,如高管在周末进行编码,并认为软件工程师的角色将持续重要,因其在代码责任方面不可替代。

  3. Google 新模型31

    Google 发布 TIPS — g/14 low-res (v1) 模型

    Google 发布了 TIPS — g/14 low-res (v1) 模型,该模型包含 1.1B 视觉参数和 389M 文本参数,支持生成与文本嵌入对齐的图像空间特征。模型使用 224 分辨率,图像编码无需 ImageNet 归一化,文本编码支持最大 64 个 token。模型基于 Apache 2.0 协议开源,适用于零样本分类和空间特征可视化任务。

8月19日周三
  1. Neo4j 博客26

    什么是图技术?以及为何它是企业 AI 的未来

    图技术通过存储和分析数据之间的连接,使 AI 智能体能直接查询、遍历和推理关联数据,从而将模型幻觉率降低 44%。它构建知识图谱,让智能体在回答问题时能追踪多个实体之间的关系路径,而非仅依赖孤立数据片段。图技术作为企业 AI 的知识层,提供记忆、上下文和推理能力,无需替换现有数据库即可实现更准确、可解释和可治理的 AI 应用。

  2. Replit 博客31

    Replit 推出免费模式以扩展 AI 的可能性

    Replit 推出 Free Mode,用户可使用 OpenAI 的 GPT-5.6 Luna 模型,在每月订阅费用下创建 30 倍内容,日常任务不再消耗积分。新界面支持从简单聊天到复杂构建的无缝切换,提升效率与创作自由度。Pro 用户相比 Core 用户拥有更高的使用上限,复杂任务可切换至 Power Mode 或 Max Mode。

  3. MIT News · 人工智能51

    MIT 研究发现:大规模训练下,生成图像常无法溯源至特定训练数据

    MIT CSAIL 的研究团队在《自然·通讯》上发表论文,提出‘归因衰减’现象:当生成模型在大规模数据集上训练时,移除任何单个训练图像或特定艺术家的作品,通常不会改变模型的输出。研究通过构建‘扩散集成’架构,首次实现了对训练数据影响的精确删除验证,而非依赖近似估计。这一发现对生成式 AI 的版权归属、合理使用及模型输出是否构成衍生作品等法律问题提出了新的技术视角。

  4. The Pragmatic Engineer45

    工程领导层大规模离职:AI时代技术高管职业中断现象分析

    2026年多位资深工程领导者在未明确规划下一份工作的情况下选择离职或长期休职,主要因创始人对AI的不切实际期望和过度干预导致工作环境恶化。部分CTO和VPE表示,AI技术被用作裁员工具而非提升工程文化的手段,使得产品质量和战略决策的重要性被削弱。一些初创公司如Ramp、Stripe和Notion被提及为仍能平衡AI与工程质量的例外。

8月18日周二
  1. MIT News · 人工智能23

    MIT 教授 Eugene Fitzgerald 新书探讨创新本质

    MIT 教授 Eugene Fitzgerald 在新书《The Invisible Engine》中提出,创新是市场应用、技术与实施三者的整合,其核心是企业家承担不确定性并创造市场“惊喜”的过程。他基于在 MIT-Masdar 等大型合作研究项目中的十年实践,区分了旨在培养人才的“利他科学”、围绕目标的“战略研究”以及从研究到经济增长的“基础创新”三种不同的研究投资类型。

最多提供 50 页,更早的内容请使用搜索或主题页。