当前位置:首页 » AI资讯 » AI快讯

DeepSeek-V4.1-Flash 发布:552B MoE 多模态模型主打 KV cache 压缩

2026-09-18 4

DeepSeek 发布 DeepSeek-V4.1-Flash,一个 552B 参数的多模态 MoE 模型,支持最长 100 万 token 上下文,模型权重已在 Hugging Face 开放。

来源:HuggingFace Daily Papers(社区热门论文)

相关推荐

扫码关注

qrcode

联系我们

回顶部