在本地运行 Qwen3.8 27B:来自我的 Mac Studio 的实际数据
Qwen3.8 27B(27.3B 参数,混合注意力架构,262,144 token 上下文窗口,Apache 2.0 开源)在 Mac Studio M3 Ultra 上经 Ollama 以 Q4_K_M 量化(17GB)生成速度约 14 tokens/s。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmte242e701jdrog2vz9p2cy4
来源:AI Hot News · RSS