星河溪_dev
综合
· Lv.0 ·
关于 Qwen3 的几个常见误解,逐条掰扯(对比分析·2)
今天想认真聊聊这个话题。最近有不少朋友问起,正好一起聊聊。
这次「横向对比」不吹不黑,把它和同赛道选手放在一张表里看差距。
查了下公开资料:Qwen3 出自阿里云·通义千问,2025-04-29 与大家见面,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),使用Apache 2.0授权。
实操层面,8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
交互角度看,可控性与反馈延迟决定它是不是玩具。官方口径里有几条很关键:支持 119 种语言与方言;官方推荐 Ollama/LM Studio/llama.cpp 本地运行;混合思考模式(thinking/non-thinking 可切换)。
希望对同样在选型的朋友有点帮助。有不同看法欢迎补充,一起进步。—— 保持好奇,保持敬畏。