💬 观点Simon Willison
Qwen3.8-Flash-Next — Qwen新模型,125B参数仅6B激活,本地运行性能强劲。
Qwen新模型,125B参数仅6B激活,本地运行性能强劲。
2026-08-26原文
本文为要点摘要,完整细节以原文为准。
- Qwen3.8-Flash-Next 是 Qwen 推出的开源权重多模态 MoE 模型,作为 Qwen4 架构的早期预览,总参数 125B,但仅 6B 激活,带来显著性能提升。
- Simon 在 DGX Spark 上使用 Unsloth 量化版本测试,包括 72.5GB 和 78.9GB 的量化模型,并展示了生成图像,表明该模型可在消费级硬件上运行。
- 对开发者而言,这意味着更强大的模型可以本地部署,降低对云 API 的依赖,同时 MoE 架构的高效性可能成为未来模型设计的趋势。
原文:Qwen3.8-Flash-Next · 作者 Simon Willison