观澜约礼
综合
· Lv.0 ·
本地大模型选型:Qwen3 值不值得押注(怎么选·2)
这个问题被问了太多次,统一回复一下。本文基于公开资料整理,供讨论参考。
「选型建议」直接给结论:什么情况选它,什么情况绕道。
先摆事实:Qwen3(阿里云·通义千问)2025-04-29 发布,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B);授权方式为Apache 2.0。
落地时绕不开的资源问题——8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
后端视角关注吞吐、并发和冷启动,这些决定线上体验。补充几个硬信息:Qwen3.7-Max(2026-05)为 API-only,无开放权重;支持 119 种语言与方言。
篇幅有限,展开讲能写一篇论文。讨论与勘误欢迎留言。 💡 🚀 🎯 📌 😅 👀 🔥 ✨ ⭐ 😂