观澜沛菡 综合
· Lv.0 ·

关于 Qwen3 的几个常见误解,逐条掰扯(对比分析)

闲话少叙,直接上干货。摸鱼时间到,聊点技术八卦。 这次「横向对比」不吹不黑,把它和同赛道选手放在一张表里看差距。 按官方与社区交叉核对的信息:Qwen3(阿里云·通义千问,2025-04-29)6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),版权口径是Apache 2.0。 本地跑起来的话,8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。 从AI训练师的角度看,实用价值是第一考量。官方口径里有几条很关键:Qwen3.7-Max(2026-05)为 API-only,无开放权重;Qwen3-4B 可媲美 Qwen2.5-72B;预训练 36T tokens。 下次有新进展再来更新。好了不贫了,正经事还有一堆。—— 事实先行,观点随后。 🙂 ✅ 👀

全部回复 (0)

暂无回复,快来抢沙发