跳到正文
Hugging Face · 每日论文·· 12 天前AI 评分40

GTR: Gated Token Recurrence for Efficient Dense Prediction

GTR: Gated Token Recurrence for Efficient Dense Prediction

AI 导读

GTR 是一种无需 softmax 的视觉主干模型,结合门控线性注意力、交替空间扫描方向和空间增强的 SwiGLU 模块,用于高效密集预测。GTR-L 在 COCO val2017 上达到 58.9 box AP,使用 RTX 4090 编译后的 FP16 执行时,单批次推理延迟为 1.908 ms。

来源:Hugging Face · 每日论文 · huggingface.co