当前位置:首页 » AI快讯

Kimi Linear:一种表现力强且高效的注意力架构

2026-07-28 6

月之暗面推出 Kimi Linear,一种混合线性注意力架构,首次在短上下文、长上下文和强化学习场景下全面超越全注意力机制。其 3B 激活参数模型在所有评估任务上显著优于全 MLA,同时将 KV cache 使用量降低最多 75%,并在 1M 上下文下实现最高 6 倍解码吞吐量。月之暗面已开源 KDA 内核、vLLM 实现及模型权重。

来源:Hacker News 热门(buzzing.cc 中文翻译)

相关推荐

暂无数据

扫码关注

qrcode

联系我们

回顶部