跳到正文
10月2日周五
10月1日周四
  1. Google DeepMind76

    Google DeepMind 发布前沿模型 Gemini 4 Argon

    Google DeepMind 宣布推出前沿模型 Gemini 4 Argon,旨在处理复杂、长周期的跨领域工作流。该模型在 DeepSWE v1.1 上达到 77.9% 的 SOTA 水平,输出 token 上限提升至 100 万,定价为每百万输入 token 2 美元、输出 token 10 美元。

    推荐理由:原文详细列举了模型在软件工程、金融法律和网络安全等领域的性能表现及定价,读者可以据此评估其实际应用潜力。

  2. PyTorch 博客38

    PyTorch Conference North America 2026:聚焦 Ray 的分布式 AI 指南

    PyTorch Conference North America 2026 即将在圣何塞举行,为开源 AI 社区提供交流平台。会议指南重点介绍了多场关于分布式计算框架 Ray 的议题,涵盖其与 Kubernetes 的协同演进、在 LinkedIn 和 Uber 等公司的生产级数据与模型训练应用,以及在模型推理与后训练阶段的关键作用。

  3. Google · Gemini 博客55

    Gemini 在全球聊天中推出 Skills 功能以自动化重复任务

    Google 在全球 Gemini 聊天中推出 Skills 功能,用于保存和复用常用指令以自动化重复任务。Skills 将取代 Gems,并将在未来几周内为 Google Workspace 客户提供,个人账户的 Gems 支持将于 11 月停止。用户可以通过输入‘/’和技能名称来快速调用,并可以组合多个技能或添加参考文件。

    推荐理由:原文明确了从 Gems 到 Skills 的迁移路径和时间表,读者可以据此规划现有工作流的调整。

9月30日周三
  1. Google DeepMind57

    Google DeepMind 发布 SynthID Bio 生物水印技术

    Google DeepMind 发布 SynthID Bio,一种用于合成生物学的生物水印技术,可在不损害蛋白质生物功能的前提下,将不可见水印嵌入蛋白质序列与三维结构中。

    推荐理由:原文给出了水印技术在生物序列和结构上的实现方式与实验验证结果,读者可据此评估其在生物安全中的实际应用潜力。

  2. AWS · AI 博客32

    Amazon Bedrock 引入 Anthropic 模型支持首尔和新加坡区域推理

    Amazon Bedrock 现在支持在首尔和新加坡区域使用 Anthropic 的 Claude Opus 5 和 Claude Sonnet 5 进行本地推理,输入和输出数据全程保留在指定区域。用户可通过 Amazon Bedrock 控制台或 API 调用模型,无需额外配置即可测试不同模型变体。该功能适用于需满足数据本地化要求的金融、医疗及公共部门应用。

9月29日周二
9月28日周一
  1. Hugging Face · 每日论文40

    PersonaDose 通过校准激活控制实现渐进式人格特质调节

    PersonaDose 在 Llama-3.1-8B、Qwen3-8B 和 Gemma-3-4B 上实现渐进式人格特质控制,相比对比激活添加方法,核心特质表达提升 33.2、18.3 和 17.8 点,达到 75 的一致性基线。校准后设置在未见问题上仍保持表达优势,7 个训练特质的平均目标误差为 4.7–6.2 点,28 个目标中有 14–22 个可达到。

9月25日周五
  1. Google Research56

    Google 发布多代理框架实现连贯长视频生成

    Google 研究团队提出 AI 视频协导演框架,基于 Gemini 和 Veo 构建统一多代理系统,通过全局优化、视觉记忆追踪、自回归生成与闭环质量评估,解决长视频生成中的语义漂移、特征漂移和内容坍缩问题。

    推荐理由:原文系统性地提出了多代理框架解决长视频生成中的连贯性问题,提供了可复现的技术路径和基准测试结果。

  2. Google DeepMind54

    Gemini 3.8 Live 与 Live Avatar 功能上线

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,通过低延迟视频流与语音同步,实现企业级虚拟代理的近实时视觉交互。该功能支持多语言无缝切换、异步工具调用与持续对话,具备精确唇形同步与自然表情,企业可通过参考图像定制专属动画形象,目前仅对 Gemini Enterprise 用户开放。所有生成内容均嵌入 SynthID 水印以确保可追溯性。

    推荐理由:原文给出了功能组合和企业可用性,读者可以据此判断其在交互场景中的部署价值。

9月24日周四
  1. NVIDIA Blog57

    NVIDIA 联合 Google DeepMind 等机构开源 2800 多种病毒的蛋白复合物结构预测数据集

    NVIDIA 联合 Google DeepMind、EMBL-EBI 等全球研究机构,在 AlphaFold 数据库中开源了超过 2800 种病毒的蛋白复合物 3D 结构预测数据集。

    推荐理由:原文提供了数据集规模、生成方法和开放访问细节,读者可以了解 AI 如何加速病毒蛋白结构预测以应对未来疫情。

  2. Google · AI Blog30

    Google Beam 扩展至新区域并新增合作伙伴与客户

    Google Beam 宣布将其全球覆盖范围扩展至美国、加拿大、英国、法国、德国和日本六个国家。一项为期八周的内部研究显示,使用 Beam 的 Google 团队感觉彼此联系紧密程度提升了 50%,并减少了 21% 的后续会议需求。Google 还与 Industrious 合作创建首个 Beam 扩展网络,并已获得 Netflix 等首批客户。

  3. Google · Gemini 博客39

    Gemini 推出连接应用新功能

    Gemini 开始推出连接应用功能,用户可在单一界面管理项目、设计创意资产和规划健身计划。此次更新支持连接 Airtable、Linear、Adobe 等多个领域的工具,涵盖生产力、创意和生活方式类应用。用户可通过设置或在聊天中使用 @ 提及或直接提问来调用这些应用。

9月23日周三
9月18日周五
  1. Google · AI Blog43

    Google 与联合国推出 AI 就绪的 UN System Data Commons 平台

    联合国系统与 Google 合作推出开源平台 UN System Data Commons,整合了全球关键统计数据。该平台基于 Google 的 Data Commons 构建,提供自然语言搜索和交互式可视化功能,并支持通过 Model Context Protocol (MCP) 让 AI 智能体直接获取权威数据。平台目标是到 2027 年纳入 80% 的联合国系统统计数据集。

9月17日周四
  1. Vercel 博客62

    Vercel AI Gateway 2026年9月生产指数:开源模型处理56%的token量,Astra支出是Fable 5.1的两倍

    Vercel AI Gateway 2026年9月生产指数显示,8月开源模型首次处理了网关56%的token量,而2025年12月这一比例还不到10%。平均token价格连续第三个月下降,8月环比下降23.2%。

    推荐理由:基于网关生产数据的月度分析,揭示了开源模型在用量上首次反超闭源模型、以及用户在不同模型间迁移的成本驱动模式。

9月16日周三
  1. Google · Gemini 博客21

    Gemini:4 种方式帮你应对家务琐事

    Gemini 可通过 4 种方式帮助用户处理家务,如家电维修指导、定制化饮食计划、家庭支出跟踪和大型购物比较。用户可通过上传收据、使用 Gemini Live 拍摄冰箱内容或询问汽车对比信息,获得即时分析与建议。该功能基于 Google AI & Economy ATLAS v1.0 研究,显示超过 86% 的对话式 AI 交互发生在非工作场景。

  2. Google · AI Blog18

    Google AI 如何助力社会影响

    Google AI 正通过与全球社区和研究人员的合作,将 AI 工具应用于疾病防治、自然灾害预测、教育扩展和创造经济机会等关键领域。这些合作旨在将 AI 突破转化为可衡量的现实影响,确保更多人能共享 AI 带来的机遇。

9月15日周二
  1. Google · AI Blog41

    Google AI & Economy ATLAS 发布新数据可视化与科学家使用 AI 的研究洞察

    Google 的 AI & Economy ATLAS 项目发布了新的交互式开放数据体验,并基于与 MIT FutureTech 的合作研究揭示了科学家使用 AI 的情况。近半数受访科学家每天使用 AI,每周平均节省近 7 小时;LLM(如 Gemini)与专用模型在不同科学任务中被广泛使用。数据还显示,印度创意产业和美国技术职业的 AI 使用率分别达到全球平均的 1.6 倍和 2 倍。

  2. Google · AI Blog23

    Google AI 博客对话:宇航员 Christina Koch 与 James Manyika 探讨太空、技术与发现

    NASA 宇航员 Christina Koch 与 Google 高级副总裁 James Manyika 在最新一期“技术与社会的对话”系列中,讨论了从国际空间站的 328 天驻留、历史性的首次全女性太空行走到 Artemis II 绕月任务等经历。他们探讨了从 25 万英里外将地球视为“生命方舟”的视角,以及宇航员、机器人与 AI 之间的重要伙伴关系。

9月11日周五
  1. Google · AI Blog15

    Google Search 的 3 种方式助你备战下一场大赛

    Google Search 的 AI 功能可帮助跑者制定个性化训练计划、创建定制播放列表和选购合适装备。用户可通过 AI Mode 中的 Canvas 工具生成包含交叉训练和力量训练的详细日程,并连接 YouTube Music 账户获取跑步歌单。此外,借助涵盖超 600 亿产品列表的 Shopping Graph,Search 能提供符合预算等限制条件的装备推荐与比价。

9月10日周四
  1. Google · AI Blog31

    Google DeepMind 与电影人合作 AI 重现 70 年爱情故事

    Google DeepMind 与电影制作团队合作,在短片《Love, Rendered》中利用生成式 AI 技术重现了一对夫妇未曾被记录的初遇记忆。团队结合图像修复模型与表演捕捉模型,将老照片复原并映射了当事人当下的细微神态。该项目展示了 AI 作为艺术媒介的潜力,相关照片修复功能已集成至 Gemini 应用中。

  2. Google · AI Blog30

    Google Search 推出全新美式橄榄球赛季功能

    Google Search 为美式橄榄球赛季推出多项新功能,包括实时比赛动态、更详细的球员与联盟统计数据,并支持关联 Yahoo Fantasy 或 Sleeper 账户以获取 AI 定制的阵容建议。实时动态功能目前在美国移动端提供,关联梦幻足球账户功能也仅限美国英语用户。

9月5日周六
  1. Google · Gemini 博客49

    Gemini 中现可创作最佳音轨:Lyria 3.5 可用

    Google 的音乐生成模型 Lyria 3.5 已在 Gemini 应用和 Gemini API 中面向全球用户推出。该模型提供更具表现力的人声和更丰富的编曲,用户可在应用内选择流派、人声/器乐风格,并使用新模板快速创作。Lyria 3.5 也通过 Google Flow Music、Google AI Studio 和 Google Vids 提供给艺术家、开发者和技术人员使用。

9月3日周四
  1. Google DeepMind66

    Google DeepMind 发布 WeatherNext 3 全球气象AI模型

    Google DeepMind 发布 WeatherNext 3,引入实时卫星数据、每小时更新、5公里分辨率,提升降水预测精度,并集成至 Search、Gemini、Maps 等产品。该模型通过直接学习观测数据,实现更精准的局部天气预测,尤其改善了拉丁美洲、非洲和亚太地区覆盖。

    推荐理由:原文给出了实时卫星数据接入、小时级更新和分辨率提升等关键变化,读者可据此评估其对气象服务的影响。

9月2日周三
  1. Google · AI Blog43

    Google 推出 Fairwind 计划,为政府和企业提供主动网络防御

    Google 启动 Fairwind 计划,为政府机构和可信合作伙伴提供其最先进的网络防御能力。该计划首先提供 Gemini 3.8 Flash Cyber 模型与 CodeMender 工具,帮助防御者自主发现并修复漏洞,在数分钟内生成已验证的、可部署的补丁。全球已有超过 650 家合作伙伴参与该计划。

  2. Google · Gemini 博客73

    Google 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber

    Google 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber 两款新模型,前者在编码与智能体任务中性能显著提升,后者在漏洞检测与自动修复方面达到前沿水平,均以 Flash 级别的速度和成本提供,其中 3.8 Flash Cyber 通过 Fairwind 程序向受信任的防御方开放。

    推荐理由:原文给出了能力变化和开放入口,读者可以据此判断它会怎样改变现有工作流。

  3. Google · AI Blog34

    Google 2026 年 8 月 AI 新闻汇总:发布 Gemini 3.7 Flash、Gemini 3.5 Transcribe 及 Pixel 11 系列

    Google 在 2026 年 8 月发布了多款 AI 产品,包括面向编程和智能体的高效模型 Gemini 3.7 Flash,以及专为实时转录设计的 Gemini 3.5 Transcribe。同期推出的 Pixel 11 系列设备搭载了 Google Tensor G6 芯片和最新的 Gemini Nano 模型。此外,Gemini 应用的月活用户已超过 10 亿。

  4. Google · Gemini 博客62

    Google 为 Gemini Flash 系列模型推出智能体视频理解功能

    Google 为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型推出了智能体视频理解功能。该功能通过动态搜索视频片段,将分析成本降低高达 66%,token 消耗减少高达 88%,同时将准确性提升高达 7%。

    推荐理由:原文给出了新功能在成本、效率和准确性上的具体提升数据,以及支持的模型和开放入口,读者可以据此评估其对视频分析工作流的影响。