月之暗面推出 Kimi Linear,一种混合线性注意力架构,首次在短上下文、长上下文和强化学习场景下全面超越全注意力机制。其 3B 激活参数模型在所有评估任务上显著优于全 MLA,同时将 KV cache 使用量降低最多 75%,并在 1M 上下文下实现最高 6 倍解码吞吐量。月之暗面已开源 KDA 内核、vLLM 实现及模型权重。
查看原文:https://arxiv.org/abs/2510.26692
来源:Hacker News 热门(buzzing.cc 中文翻译)
未经允许不得转载:AI之家 » Kimi Linear:一种表现力强且高效的注意力架构



