跳到正文
fal 博客· Dogac Eldenk·· 2026-07-08AI 评分52

fal 团队如何利用 DSpark 为 Ideogram V4 Prompt Expander 实现约 1000 tok/s 和 16 倍吞吐量

How We Achieved ~1000 tok/s and 16x Throughput with DSpark for Ideogram V4 Prompt Expander

AI 导读

fal 团队分享了为 Ideogram V4 的提示词扩展器优化 Qwen3.6 推理性能的实践。他们选择了 Qwen 3.5 35B MoE 模型,通过 PEFT 微调和知识蒸馏来平衡性能与速度。

来源:fal 博客 · blog.fal.ai