← 返回目录 论文 ·Hacker News 热门(buzzing.cc 中文翻译) Kimi Linear:一种表现力强且高效的注意力架构 论文 ·2026-07-28 23:21 ·查看原文 ↗ 月之暗面推出 Kimi Linear,一种混合线性注意力架构,首次在短上下文、长上下文和强化学习场景下全面超越全注意力机制。其 3B 激活参数模型在所有评估任务上显著优于全 MLA,同时将 KV cache 使用量降低最多 75%,并在 1M 上下文下实现最高 6 倍解码吞吐量。月之暗面已开源 KDA 内核、vLLM 实现及模型权重。 查看原文 → ← 回到目录