跳到正文
Weights & Biases· Brett Young·· 2026-05-21AI 评分36

Qwen3.7-Max 基准测试成绩发布

Qwen3.7-Max Benchmark Scores

AI 导读

阿里巴巴 Qwen 团队推出了 Qwen3.7-Max,该模型专注于代码智能体、自主执行和长时程推理。模型在多个基准测试中取得优异成绩,包括在 HumanEval 和 SWE-bench 上的高分表现。Qwen3.7-Max 支持 8k 上下文长度,可通过 API 调用,适用于需要复杂推理和代码生成的场景。

来源:Weights & Biases · wandb.ai