跳到正文
10月4日周日
  1. The Decoder64

    Google 调整 Gemini 订阅策略,免费用户仅限使用 Flash-Lite 模型

    Google 将从 2026 年 10 月起调整个人账户的 Gemini 模型访问权限。免费用户只能使用最小的 Flash-Lite 模型,而不再能访问 Flash 和 Pro 模型;每月 4.99 美元的 AI Plus 订阅用户也将失去 Pro 模型的访问权限。所有三个模型都需要每月 19.99 美元的 AI Pro 或更高级的 AI Ultra 订阅。

    推荐理由:原文对比了新旧免费套餐的模型权限变化,并给出了各订阅档位的具体价格和模型覆盖情况。

  2. 爱范儿51

    OpenAI 前安全负责人发文剖析公司安全文化与迭代部署风险

    OpenAI 前安全透明度负责人 David Robinson 在《大西洋月刊》发文解释离职原因,认为公司追求速度和迭代部署的文化缺乏处理危险技术所需的谦逊与谨慎。他引用董事会成员观点,指出 AI 能力快速提升带来灾难性失控风险,呼吁 AI 行业应像核电、航空业一样建立多层冗余的安全体系,并发展新的对齐科学。文章在 Hacker News 等社区引发了关于离职者动机与 AI 安全现状的广泛讨论。

  3. cnBeta61

    特朗普政府组建“超级智能”特别工作组,120天内评估AI风险与监管边界

    特朗普政府组建了名为“Super Intelligence Force”的AI特别工作组,由国家情报总监Jay Clayton领导,计划在120天内提交报告,系统评估先进AI的风险与机遇,并明确联邦政府的监管角色。工作组将设置三名副主席分别覆盖产业、基础设施和消费者利益,成员包括多名高级官员及外部顾问。政府目前倾向于依靠企业自身安全控制和行业自愿原则,而非建立强制性全面监管制度。

  4. cnBeta28

    AI面试普及引发求职者焦虑,企业为降本增效加速采用

    AI面试官通过数字人进行30-40分钟的程序化答题,依据关键词匹配和微表情分析等量化指标筛选求职者,导致“恐怖谷”体验和广泛吐槽。企业采用AI旨在降本增效,单个AI面试官24小时可处理2500场面试,将初筛周期从数周压缩至数天。中国AI面试市场规模预计从2025年的43亿元增长至2030年的208亿元,北森等供应商的AI产品新签合同额同比暴涨10倍。

  5. cnBeta50

    三星 HBM4 报价超前代 3 倍,挑战 SK 海力士抢占 AI 存储定价权

    三星向主要客户提出的 2027 年 HBM4 供货报价高达每 Gb 4 美元,是当前 HBM3E 价格的约 3 倍。其 HBM4 数据传输速度可达每秒 11.7Gb 至 13Gb,三星希望凭借性能优势在世代交替之际挑战 SK 海力士的市场主导地位并提升盈利能力。TrendForce 预测,受 HBM4 占比提高及供应短缺推动,2027 年 HBM 平均售价将较今年上涨 121%。

  6. cnBeta72

    OpenAI宣布GPT-5.5将于10月14日从ChatGPT等服务中全面下线

    OpenAI宣布GPT-5.5将于2026年10月14日从ChatGPT、Codex及企业版服务中全面下线,用户需迁移至GPT-5.6 Sol或GPT-6 Astra。此次强制清退对深度集成该模型的生产环境造成冲击,可能导致提示词漂移和Agent备用降级循环失效。

    推荐理由:原文详细描述了GPT-5.5下线对开发者和企业工作流的具体冲击,包括提示词漂移和Agent熔断风险。

  7. cnBeta46

    美财长贝森特批评AI大佬生存风险警告:危言耸听,光喊不拿方案

    美国财政部长斯科特·贝森特批评Anthropic CEO达里奥·阿莫代伊、OpenAI负责人萨姆·奥特曼及xAI CEO埃隆·马斯克等人关于AI生存风险的警告是危言耸听且缺乏解决方案。他认为AI行业应加强自我监管,并强调美国必须在确保安全的前提下加速发展以保持对中国的领先优势。

  8. InfoQ · AI/ML60

    AWS 团队开源 AI 智能体后台任务管理工具 Pizza Bot

    AWS 团队开源了 Pizza Bot,这是一个自托管应用,旨在让 AI 智能体在后台运行任务并通过收件箱式界面返回结果。它支持定时或 Webhook 触发的任务,可将工作委派给专用智能体,并在需要时暂停等待人工批准。该工具采用客户端-服务器架构,将智能体状态、线程和日志持久化存储在用户本地文件夹中,数据仅发送至用户配置的模型提供商和明确启用的 MCP 服务器。

    推荐理由:原文介绍了这个开源工具的设计理念、核心功能与本地优先架构,读者可以了解它如何管理异步任务流。

  9. cnBeta65

    Google 因 AI 生成无效报告暂停部分开源漏洞赏金计划

    Google 宣布暂停其开源软件漏洞奖励计划中的产品漏洞提交通道,原因是大量由 AI 生成的无效报告给审核团队带来巨大压力。暂停措施已于 10 月 1 日生效,预计将在 2027 年第一季度提供更新。Google 表示,此次暂停仅针对产品漏洞提交类别,不影响 10 月 1 日之前已提交的报告,供应链安全报告和 Cloud VRP 渠道仍继续接收报告。

    推荐理由:Google 因 AI 生成的无效漏洞报告暂停了开源漏洞赏金计划的部分通道,反映了自动化工具对安全研究流程的实际冲击。

  10. cnBeta45

    OpenAI CEO萨姆·奥特曼称将宗教力量赋予AI是安全问题

    OpenAI CEO萨姆·奥特曼公开表示,将宗教力量赋予AI模型或让人放弃自身判断是真正的安全问题。此番言论紧随《纽约时报》关于Anthropic联合创始人克里斯托弗·奥拉与梵蒂冈讨论Claude等AI模型意识可能性的报道,被视为间接批评。教皇5月发布的通谕则明确主张现有AI系统不具备意识或道德良知,技术应由人类引导。

  11. cnBeta39

    ChromAgeNet:AI通过DNA三维结构破解细胞衰老密码

    研究团队开发的ChromAgeNet系统通过分析细胞核三维图像中的DNA空间组织,能以约77%的准确率区分年轻与衰老的小鼠造血干细胞。该系统关注染色质组织复杂度等过去难以量化的结构特征,并能检测表观遗传药物干预引发的结构变化。团队已公开模型与数据,该技术有望用于高通量药物筛选。

  12. cnBeta60

    KAIST 与微软研发“神经价值对齐”AI 系统,通过脑电波判断意图

    KAIST 与微软的研究团队开发了名为“神经价值对齐”的 AI 系统,利用脑电图监测用户大脑的预测误差信号,以判断 AI 是否理解或执行了用户的真实意图。系统分析奖励预测误差和状态预测误差两类神经信号,能区分错误发生在目标还是执行层面。

    推荐理由:原文介绍了利用脑电信号解决人机意图对齐模糊性的具体方法,为理解下一代交互式智能系统提供了技术视角。

  13. cnBeta33

    WhatsApp 向部分 Android 与 iOS 测试用户推出“受限聊天”功能

    WhatsApp 正在向部分 Android 和 iOS 测试版用户推出“受限聊天”功能,为特定对话增加额外限制。启用后,对话中的媒体不会自动保存、聊天记录无法导出、不能使用 Meta AI 功能,且对话不会同步到关联设备,只能通过主手机进行。该功能目前仅适用于一对一对话,仍处于测试阶段。

  14. 量子位49

    Terafab 芯片制造项目或与台积电合作,马斯克寻求多元供应

    马斯克确认正与台积电讨论其 Terafab 芯片制造项目的合作可能,旨在为 Tesla、SpaceX 和 xAI 确保海量定制芯片供应。该项目一期投资 168 亿美元,长期目标年产约 1TW AI 算力,并已计划采用英特尔的 14A 工艺。此举被视为马斯克在推进这一超大规模项目时,为降低风险、确保产能而寻求多元供应商的策略。

  15. 量子位43

    FDE(前线部署工程师)岗位分析:AI时代的新香饽饽与变体

    FDE(前线部署工程师)已成为AI时代热门岗位,海外年薪中位数约20万美元,国内大厂月薪高达三五万。其核心工作从传统部署转向帮客户梳理业务本体(Ontology)并设计AI应用,沟通需求时间占七成以上。该岗位模式多样,既有大厂推广自家产品的FDE,也有独立接单的“土FDE”,后者业务模式正偏向AI咨询与培训。

  16. 极客公园62

    Tavus 发布实时交互模型 Griffin,近半数测试者未能分辨其为 AI

    美国 AI 视频公司 Tavus 发布实时交互模型 Griffin,在一项一分钟视频通话测试中,54 名参与者中有 26 人认为自己在和真人聊天。Griffin 采用端到端的全双工视频到视频架构,能实时生成语音、表情和手势,平均反应延迟为 0.43 秒。Tavus 表示该模型目前仅向少数受信任的测试者开放,并正在开发主动披露身份的安全功能。

    推荐理由:原文提供了模型的核心能力、技术架构和测试数据,读者可以据此评估其在实时交互领域的突破性。

  17. MarkTechPost61

    DeepSeek Harness v0.2 发布官方桌面应用

    DeepSeek 为其开源智能体框架 DeepSeek Harness (dsh) 发布了 v0.2 预览版,并推出了官方桌面应用,支持 macOS (Apple silicon) 和 Windows (64-bit)。

    推荐理由:作为开源智能体框架,其桌面应用和插件化架构为开发者提供了新的本地部署和扩展选择。

  18. 钛媒体35

    载人机器人:从科幻到现实,为何“载人”设计仍是挑战与机遇?

    载人机器人面临远超静态承重的动态控制与乘员安全挑战,其“老成持重”的动作是保障稳定的底线。这类机器人在伤员转运、无障碍出行及新奇体验等特定场景中,能解决现有设备无法覆盖的复杂地形移动难题。其理想操作方式应高度自主化,让用户无需复杂控制即可完成移动任务。

  19. 钛媒体59

    钛媒体分析:为何中国等不来Muse,以及国内大厂的Agent围墙战

    作者认为,Meta的Muse在美国的成功基于开放的网页生态,而中国互联网服务高度集中在封闭的App内,导致跨平台Agent难以实现。文章分析了字节、腾讯、阿里在Agent领域的布局,指出它们各自受限于自家生态,形成了‘围墙’。同时探讨了豆包手机、华为小艺、阶跃星辰等试图通过系统权限或中立协议破局的路径,并预测了B端、硬件和监管三条可能的破局钥匙。

    推荐理由:作者基于中美互联网生态差异,分析了Muse模式在中国面临的围墙困境,并梳理了国内大厂各自的应对策略与潜在破局路径。

  20. 钛媒体23

    【数智周报】中国大模型首次进入OpenAI企业付费结算体系;AMD斥资82亿美元收购李飞飞世界模型公司;Anthropic上市文件披露对亚马逊、谷歌依赖加深,2025年营收近46亿美元……

    Kimi K3通过美国AI基础设施公司Baseten进入OpenAI企业付费结算体系,企业用户调用费用可直接计入其OpenAI采购额度。这是中国开源模型首次进入该主流企业采购通道。同期,Anthropic提交的IPO文件显示其2025年营收达45.9亿美元,其中近半数依赖亚马逊和谷歌云平台。

  21. 钛媒体79

    AMD以约82亿美元全股票收购李飞飞创办的世界模型公司World Labs

    AMD以约82亿美元全股票收购李飞飞创办的世界模型公司World Labs,李飞飞将出任AMD执行副总裁兼首席科学家。文章分析了世界模型赛道的技术分层、主要玩家、商业化现状及面临的挑战,并指出这笔收购意味着世界模型初创公司与算力巨头深度绑定的趋势加剧。

    推荐理由:文章梳理了世界模型赛道的技术分层、商业落地现状和主要玩家格局,为理解AMD收购World Labs的背景提供了行业地图。

  22. MarkTechPost46

    NVIDIA IsaacTeleop 教程:从手部和控制器追踪到机器人动作的基于图的重定向引擎

    NVIDIA IsaacTeleop 框架通过基于图的重定向引擎,将 XR 手部追踪和运动控制器输入转换为仿真及真实机器人的指令。本教程使用 NumPy 构建所有输入,在普通 Colab CPU 上逐步演示了从生成合成手部与控制器数据、编写可实时调参的重定向器,到驱动内置夹爪和 SE(3) 重定向器并构建完整动作图的全过程。

  23. 钛媒体36

    Edge AI Daily 早报(10月4日)

    arXiv 因 AI 论文暴涨,9月投稿达40363篇,cs.AI类别两年增超6倍,审核被拒率升至10%-12%,并实施每人每月限投2篇的临时措施。Tavus 发布 Griffin 实时视频交互模型,自研实验中48%的参与者在一分钟视频通话后被欺骗。

  24. InfoQ · AI/ML69

    Archestra 开源安全引擎 OpenAPPA,在两大基准测试中实现 0% 攻击成功率

    Archestra 发布了开源安全引擎 OpenAPPA,旨在防止由提示词注入或模型幻觉导致的数据泄露。该引擎在 Bench-Corp 和 AgentThreatBench 安全基准测试中实现了 0% 的攻击成功率,任务完成率为 89%。

    推荐理由:原文提供了开源安全引擎 OpenAPPA 在两大基准测试中的零攻击成功率数据,并与 Claude Code、Microsoft FIDES 进行了对比。

  25. Simon Willison33

    Simon Willison 呼吁 AI 与云服务商默认设置硬性预算上限

    Simon Willison 主张付费 API 和云服务应将硬性预算上限设为默认功能,以防范因 AI 智能体或代码意外运行导致的高额账单。AWS 已于 9 月推出月度支出限制功能,Google Cloud 也在 7 月推出了名为“Spend Caps”的类似服务。作者希望 AI 智能体能主动推荐提供硬性预算上限的服务商,以保护开发者。

  26. Claude Code 版本发布15

    Claude Code v2.1.289 发布

    Claude Code v2.1.289 修复了多个与插件、终端和符号链接相关的问题,包括终端冻结、插件列表显示陈旧信息、本地文件路径绘制异常等。新增了 `agent.spawn` 功能,支持团队成员协作及插件钩子事件中的代理状态管理。此次更新优化了插件在 IDE 中的加载和显示逻辑,提升了用户体验。

  27. Hugging Face Blog62

    Microsoft 与 Hugging Face 发布智能体评测基准 ThinkingBox

    Microsoft 与 Hugging Face 联合发布智能体评测基准 ThinkingBox,通过检查数据库最终状态和副作用而非工具调用来评估智能体。该研究在 507 个有状态工作流上对 12 个 LLM 模型进行了 20 次重复测试,发现模型的一次性成功率(pass@1)与始终正确率(20/20)之间存在巨大差距。

    推荐理由:该研究通过检查数据库最终状态而非工具调用来评估智能体,揭示了模型一次性成功与可靠执行之间的显著差距。

  28. Simon Willison12

    Simon Willison 九月赞助者专属通讯

    Simon Willison 发布了 2026 年 9 月的赞助者专属月度通讯。内容涵盖更多 Fable 类模型、定价战、3D 图形与 LLM 数学应用、意外网络攻击事件、Datasette 安全漏洞以及作者近期的软件发布。赞助者每月支付 10 美元可提前一个月获取内容。