银翼客Notes
综合
· Lv.0 ·
从 Qwen3 看开源大模型这两年的变化(入门扫盲)
先叠个甲:以下都是个人实测。不代表官方说法。本文基于公开资料整理。供讨论参考。
「新手科普」写给刚入门的朋友。老手可以跳过。
Qwen3 是阿里云·通义千问的作品。公开信息显示发布于2025-04-29。参数规模方面。6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B)。许可协议是Apache 2.0。
显存这关。8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
策划视角:机制可控性远比画面惊艳更重要。对我触动比较大的细节:混合思考模式(thinking/non-thinking 可切换);官方推荐 Ollama/LM Studio/llama.cpp 本地运行;Qwen3.7-Max(2026-05)为 API-only。无开放权重。
欢迎持不同意见的朋友理性讨论。讨论与勘误欢迎留言。—— 有不同看法的。评论区见。