彭博:DeepSeek新模型发力 中美顶尖AI跑分差距缩至3%
彭博行业研究称,DeepSeek V4.1 Flash发布后,中国顶尖AI模型在基准测试中与美国领先模型的性能差距缩至3%,较5月的9%和年初的15%显著收窄。DeepSeek在LiveBench上得分为81.1,排名第六,仅次于Anthropic的83.4分。该报告认为中国模型进步得益于AI能力深化和国产硬件优化,对美国科技主导地位构成挑战。
彭博行业研究称,DeepSeek V4.1 Flash发布后,中国顶尖AI模型在基准测试中与美国领先模型的性能差距缩至3%,较5月的9%和年初的15%显著收窄。DeepSeek在LiveBench上得分为81.1,排名第六,仅次于Anthropic的83.4分。该报告认为中国模型进步得益于AI能力深化和国产硬件优化,对美国科技主导地位构成挑战。
DeepSeek弹性计算团队正在大量招聘资深工程师,其技术报告《DeepSeek弹性计算(DSec):面向大规模Agent训练的沙盒基础设施》披露了相关细节。DSec是支撑DeepSeek-V4系列模型训练、评测和数据预处理的沙盒基础设施,目前一个扩展分片包含约160台服务器,每天服务约300万个沙盒,高峰期同时在线沙盒超过38万个。
Vercel AI Gateway 2026年9月生产指数显示,8月开源模型首次处理了网关56%的token量,而2025年12月这一比例还不到10%。平均token价格连续第三个月下降,8月环比下降23.2%。
推荐理由:基于网关生产数据的月度分析,揭示了开源模型在用量上首次反超闭源模型、以及用户在不同模型间迁移的成本驱动模式。
Zvi Mowshowitz 解读 Anthropic 发布的 AI 滥用报告,披露 2025 年 12 月至 2026 年 8 月间阻止的七类恶意行为,包括网络攻击、影响力操作和模型蒸馏。报告特别指出中国实验室系统性蒸馏 Claude 的行为,涉及深度求索、月之暗面和小米等机构通过虚假账户转发用户查询。作者认为尽管存在威胁,但当前滥用规模仍属可控,同时警示蒸馏行为可能加剧中美 AI 竞争。
推荐理由:作者基于 Anthropic 滥用报告,分析了 AI 模型在安全领域的实际威胁格局与中美科技竞争态势。