Aleph Alpha 发布 Kolibri:一个 78.1B 参数、仅激活 3.46B 的英德双语 MoE 模型
Aleph Alpha 发布了 Kolibri-1,这是一个采用混合专家架构的开源权重英德双语大语言模型。模型总参数量为 781 亿,但每个 token 仅激活 34.6 亿参数,支持长达 1,048,576 token 的上下文,并附带 Apache 2.0 许可证。
Aleph Alpha 发布了 Kolibri-1,这是一个采用混合专家架构的开源权重英德双语大语言模型。模型总参数量为 781 亿,但每个 token 仅激活 34.6 亿参数,支持长达 1,048,576 token 的上下文,并附带 Apache 2.0 许可证。
美国 AI 视频公司 Tavus 发布实时交互模型 Griffin,在一项一分钟视频通话测试中,54 名参与者中有 26 人认为自己在和真人聊天。Griffin 采用端到端的全双工视频到视频架构,能实时生成语音、表情和手势,平均反应延迟为 0.43 秒。Tavus 表示该模型目前仅向少数受信任的测试者开放,并正在开发主动披露身份的安全功能。
推荐理由:原文提供了模型的核心能力、技术架构和测试数据,读者可以据此评估其在实时交互领域的突破性。
Google DeepMind 宣布推出前沿模型 Gemini 4 Argon,旨在处理复杂、长周期的跨领域工作流。该模型在 DeepSWE v1.1 上达到 77.9% 的 SOTA 水平,输出 token 上限提升至 100 万,定价为每百万输入 token 2 美元、输出 token 10 美元。
推荐理由:原文详细列举了模型在软件工程、金融法律和网络安全等领域的性能表现及定价,读者可以据此评估其实际应用潜力。
Space Bunny Alpha 在 OpenRouter 和 OpenCode 上上线,支持通过草图生成可运行网页和3D交互项目,具备多模态理解与Agent编程能力,实测表现接近主流模型,被用户称为日常主力模型。目前模型 ID 为 stealth/space-bunny-alpha(OpenRouter)和 space-bunny-free(OpenCode),均免费调用。
Meta Superintelligence Labs 发布的首个开源多模态模型 Muse Glimmer 现已可在 Ollama 上运行。这是一个 30B 参数、专为本地智能体工作负载设计的模型,拥有 128K+ 上下文长度,采用 Apache 2.0 许可证。
推荐理由:原文提供了模型参数、许可证、支持的智能体框架和性能优化细节,读者可以据此评估其本地部署的适用性。
Google 推出 Gemini 3.5 Flash 和 Omni 视频系统,前者定位为兼顾速度与能力的高性能模型。Gemini 3.5 Flash 适用于需要快速响应的场景,而 Omni 视频系统支持多模态视频处理。两项技术均未提及具体参数规模或开源状态。