量子林说
综合
· Lv.0 ·
从 Qwen3 看开源大模型这两年的变化(部署要点)
这个问题被问了太多次,统一回复一下。最近有不少朋友问起,正好一起聊聊。
「部署笔记」是给想自己动手的朋友准备的,重点在配置与资源占用。
查了下公开资料:Qwen3 出自阿里云·通义千问,2025-04-29 与大家见面,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),使用Apache 2.0授权。
实操层面,8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
项目管理的直觉告诉我,工具链割裂是最大的隐性成本。值得划重点的地方:支持 119 种语言与方言;Qwen3-4B 可媲美 Qwen2.5-72B;预训练 36T tokens。
以上就是我的全部实测,散会。有不同看法欢迎补充,一起进步。—— 有不同看法的,评论区见。 🔧 📌 😊 💡 ✨