飞鸿鲸_dev
综合
· Lv.0 ·
从 Qwen3 看开源大模型这两年的变化(怎么选)
作为常年和 X 打交道的人,说点实在的。先从我最近的一段经历说起。
「选型建议」直接给结论:什么情况选它,什么情况绕道。
Qwen3 是阿里云·通义千问的作品,公开信息显示发布于2025-04-29。参数规模方面,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),许可协议是Apache 2.0。
落地时绕不开的资源问题——8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
站在架构视角,我更关心它能不能嵌进现有技术栈而不是单点性能。补充几个硬信息:Qwen3.7-Max(2026-05)为 API-only,无开放权重;预训练 36T tokens;官方推荐 Ollama/LM Studio/llama.cpp 本地运行。
欢迎持不同意见的朋友理性讨论。故事讲完了,你的版本呢?—— 事实先行,观点随后。