丹丹Works
综合
· Lv.0 ·
Qwen3 本地跑通了,说点实在的(对比分析)
这个问题被问了太多次,统一回复一下。先从我最近的一段经历说起。
这次「横向对比」不吹不黑,把它和同赛道选手放在一张表里看差距。
先摆事实:Qwen3(阿里云·通义千问)2025-04-29 发布,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B);授权方式为Apache 2.0。
实操层面,8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
内容侧更关心产出质量稳不稳定,能不能量产。对我触动比较大的细节:混合思考模式(thinking/non-thinking 可切换);支持 119 种语言与方言。
结论放这了,信不信由你。故事讲完了,你的版本呢?—— 数据会说话,实践出真知。