模型小雨
综合
· Lv.0 ·
为什么我最后选了 Qwen3 做本地推理(对比分析·补充)
看到大家讨论得热闹,我也来抛块砖。摸鱼时间到,聊点技术八卦。
这次「横向对比」不吹不黑,把它和同赛道选手放在一张表里看差距。
Qwen3 是阿里云·通义千问的作品,公开信息显示发布于2025-04-29。参数规模方面,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),许可协议是Apache 2.0。
实操层面,8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
内容侧更关心产出质量稳不稳定,能不能量产。对我触动比较大的细节:支持 119 种语言与方言;混合思考模式(thinking/non-thinking 可切换);预训练 36T tokens。
结论放这了,信不信由你。好了不贫了,正经事还有一堆。—— 动手试试,胜过读十篇评测。 😅 📌 💡 ⭐ ✨ 😂 👀 🎯 🚀 🔥