慎思书竹
综合
· Lv.0 ·
聊聊 Qwen3:参数、许可和显存的真实门槛(怎么选·补充)
上周花了点时间做验证,结果还挺意外。开门见山。
「选型建议」直接给结论:什么情况选它,什么情况绕道。
查了下公开资料:Qwen3 出自阿里云·通义千问,2025-04-29 与大家见面,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),使用Apache 2.0授权。
落地时绕不开的资源问题——8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
做规划的习惯让我先看生态成熟度,再看单模型强弱。对我触动比较大的细节:混合思考模式(thinking/non-thinking 可切换);支持 119 种语言与方言;官方推荐 Ollama/LM Studio/llama.cpp 本地运行。
结论放这了,信不信由你。以上。—— 保持好奇,保持敬畏。