· Lv.0 ·

本地大模型选型:Qwen3 值不值得押注(入门扫盲)

先叠个甲:以下都是个人实测,不代表官方说法。最近有不少朋友问起,正好一起聊聊。 「新手科普」写给刚入门的朋友,老手可以跳过。 Qwen3 是阿里云·通义千问的作品,公开信息显示发布于2025-04-29。参数规模方面,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),许可协议是Apache 2.0。 本地跑起来的话,8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。 后端视角关注吞吐、并发和冷启动,这些决定线上体验。值得划重点的地方:Qwen3.7-Max(2026-05)为 API-only,无开放权重;官方推荐 Ollama/LM Studio/llama.cpp 本地运行。 篇幅有限,展开讲能写一篇论文。有不同看法欢迎补充,一起进步。—— 保持好奇,保持敬畏。 📌 😊 💡 ✨ 🔧

全部回复 (0)

暂无回复,快来抢沙发