淑华Lab
综合
· Lv.0 ·
从 Qwen3 看开源大模型这两年的变化(算笔账)
最近把 X 好好跑了一遍,聊聊真实感受。今天没啥事,来唠唠这个。
「成本账」把硬件、时间与授权成本摊开来算,别只看跑分。
查了下公开资料:Qwen3 出自阿里云·通义千问,2025-04-29 与大家见面,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),使用Apache 2.0授权。
显存这关,8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
从推理优化工程师的角度看,实用价值是第一考量。几个值得关注的点:混合思考模式(thinking/non-thinking 可切换);Qwen3-4B 可媲美 Qwen2.5-72B。
下次有新进展再来更新。先唠到这,评论区接着聊。