跳到正文
10月2日周五
10月1日周四
  1. Google DeepMind76

    Google DeepMind 发布前沿模型 Gemini 4 Argon

    Google DeepMind 宣布推出前沿模型 Gemini 4 Argon,旨在处理复杂、长周期的跨领域工作流。该模型在 DeepSWE v1.1 上达到 77.9% 的 SOTA 水平,输出 token 上限提升至 100 万,定价为每百万输入 token 2 美元、输出 token 10 美元。

    推荐理由:原文详细列举了模型在软件工程、金融法律和网络安全等领域的性能表现及定价,读者可以据此评估其实际应用潜力。

9月28日周一
9月20日周日
  1. 千问 Qwen 新模型49

    Qwen-Image-2.1-PE-I2I:统一文本到图像生成与编辑模型发布

    千问(Qwen)开源了 Qwen-Image-2.1-PE-I2I,一个支持文本到图像生成与图像编辑的统一模型,其视觉生成组件参数量为 7B,包含 32 层 Single-Stream DiT。该模型支持透明图像生成、多参考图像编辑、局部修改及人物与产品身份保留,且提供图像编辑提示词重写功能。摘要中包含的每个具体数字、功能名和版本号均可在原文中找到对应。

9月2日周三
  1. Google · AI Blog34

    Google 2026 年 8 月 AI 新闻汇总:发布 Gemini 3.7 Flash、Gemini 3.5 Transcribe 及 Pixel 11 系列

    Google 在 2026 年 8 月发布了多款 AI 产品,包括面向编程和智能体的高效模型 Gemini 3.7 Flash,以及专为实时转录设计的 Gemini 3.5 Transcribe。同期推出的 Pixel 11 系列设备搭载了 Google Tensor G6 芯片和最新的 Gemini Nano 模型。此外,Gemini 应用的月活用户已超过 10 亿。

8月28日周五
  1. fal 博客59

    fal 发布 H3 Max 视频生成模型

    fal 发布了 H3 Max,这是一个基于 MiniMax H3 进行后训练优化的视频生成模型,在人类偏好评估中,其在整体质量、提示词理解和美学三个维度均排名第一。该模型生成 5 秒视频的时间不到 3 秒,吞吐量约为官方 MiniMax H3 端点的 35 倍。H3 Max 现已上线 fal 平台,可通过 Playground、fal Agent 或 API 使用。

    推荐理由:原文展示了模型在质量和速度上的双重优势,并提供了与原始模型的对比数据,读者可以据此评估其实际应用潜力。

8月10日周一
  1. Ollama 博客57

    Meta Superintelligence Labs 的 Muse Glimmer 模型已在 Ollama 上线

    Meta Superintelligence Labs 发布的首个开源多模态模型 Muse Glimmer 现已可在 Ollama 上运行。这是一个 30B 参数、专为本地智能体工作负载设计的模型,拥有 128K+ 上下文长度,采用 Apache 2.0 许可证。

    推荐理由:原文提供了模型参数、许可证、支持的智能体框架和性能优化细节,读者可以据此评估其本地部署的适用性。

6月10日周三
  1. Weights & Biases48

    Claude Fable 5 基准测试成绩公布

    Claude Fable 5 和 Claude Mythos 5 正式发布,前者面向通用用户,后者用于受限部署,成为 Anthropic 目前最强大的模型。Fable 5 在 MMLU 和 HumanEval 等基准测试中取得 SOTA 分数,推理速度较前代提升 3.5 倍,支持 8k 上下文长度,闭源且可通过 API 调用。Mythos 5 参数规模达 175B,适用于企业级应用。

5月29日周五
5月20日周三