画板兰Notes
综合
· Lv.0 ·
Qwen3 部署踩坑记:从下载到稳定出词
今天想认真聊聊这个话题。有些话不吐不快。
「选型建议」直接给结论:什么情况选它,什么情况绕道。
查了下公开资料:Qwen3 出自阿里云·通义千问,2025-04-29 与大家见面,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),使用Apache 2.0授权。
本地跑起来的话,8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
带团队后我更看长期维护成本,而非单次 demo。值得划重点的地方:Qwen3.7-Max(2026-05)为 API-only,无开放权重;混合思考模式(thinking/non-thinking 可切换);官方推荐 Ollama/LM Studio/llama.cpp 本地运行。
觉得有用的话,回帖告诉我。该说的说完了,懂的都懂。—— 欢迎评论区继续聊。 🚀 ⭐ 👀 😂 🎯 😅 💡 🔥 ✨ 📌