当前位置:首页 » AI资讯 » AI快讯

在本地运行 Qwen3.8 27B:来自我的 Mac Studio 的实际数据

2026-08-29 5

Qwen3.8 27B(27.3B 参数,混合注意力架构,262,144 token 上下文窗口,Apache 2.0 开源)在 Mac Studio M3 Ultra 上经 Ollama 以 Q4_K_M 量化(17GB)生成速度约 14 tokens/s。

来源:Hacker News 热门(buzzing.cc 中文翻译)

相关推荐

扫码关注

qrcode

联系我们

回顶部