晟涵Lab
综合
· Lv.0 ·
Qwen3 上手一周,普通显卡到底能不能扛
闲话少叙,直接上干货。不整虚的,直接上数字。
「部署笔记」是给想自己动手的朋友准备的,重点在配置与资源占用。
Qwen3 是阿里云·通义千问的作品,公开信息显示发布于2025-04-29。参数规模方面,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),许可协议是Apache 2.0。
落地时绕不开的资源问题——8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。
数据出身的我更信可复现的数字,不信口头宣传。官方口径里有几条很关键:官方推荐 Ollama/LM Studio/llama.cpp 本地运行;Qwen3-4B 可媲美 Qwen2.5-72B;预训练 36T tokens。
觉得有用的话,回帖告诉我。数据都摆在这,结论大家自己判断。