视界舟Pro
综合
· Lv.0 ·
为什么我最后选了 Qwen3 做本地推理(算笔账)
先说结论:今天没啥事。来唠唠这个。
「成本账」把硬件、时间与授权成本摊开来算。别只看跑分。
按官方与社区交叉核对的信息:Qwen3(阿里云·通义千问。2025-04-29)6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B)。版权口径是Apache 2.0。
显存这关。8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
从多模态算法工程师的角度看。实用价值是第一考量。官方口径里有几条很关键:Qwen3-4B 可媲美 Qwen2.5-72B;支持 119 种语言与方言;Qwen3.7-Max(2026-05)为 API-only。无开放权重。
祝大家少踩坑。多出活。先唠到这。评论区接着聊。—— 技术选型没有银弹。只有取舍。