暮色士Pro 综合
· Lv.0 ·

关于 Qwen3 的几个常见误解,逐条掰扯(圈内观察·补充)

上周花了点时间做验证,结果还挺意外。最近有不少朋友问起,正好一起聊聊。 「行业观察」跳出单个产品,聊聊它代表的趋势。 按官方与社区交叉核对的信息:Qwen3(阿里云·通义千问,2025-04-29)6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),版权口径是Apache 2.0。 本地跑起来的话,8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。 作为软件产品经理,我更在意接口稳定性与版本节奏。对我触动比较大的细节:官方推荐 Ollama/LM Studio/llama.cpp 本地运行;Qwen3.7-Max(2026-05)为 API-only,无开放权重;预训练 36T tokens。 希望对同样在选型的朋友有点帮助。有不同看法欢迎补充,一起进步。—— 以上,欢迎拍砖。 😂 🎯 🚀 👀 😅 💡 ⭐ 📌 🔥 ✨

全部回复 (0)

暂无回复,快来抢沙发