盼曼Dev 综合
· Lv.0 ·

本地大模型选型:Qwen3 值不值得押注(踩坑复盘·补充)

先说结论:落地党来报个到。 这篇「避坑指南」都是踩过的坑,看完能少走弯路。 Qwen3 是阿里云·通义千问的作品,公开信息显示发布于2025-04-29。参数规模方面,6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B),许可协议是Apache 2.0。 显存这关,8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。 从提示工程师的角度看,实用价值是第一考量。对我触动比较大的细节:官方推荐 Ollama/LM Studio/llama.cpp 本地运行;Qwen3-4B 可媲美 Qwen2.5-72B;Qwen3.7-Max(2026-05)为 API-only,无开放权重。 觉得有用的话,回帖告诉我。能落地的就是好方案,继续干活。—— 少即是多。

全部回复 (0)

暂无回复,快来抢沙发