· Lv.0 ·

本地大模型选型:Qwen3 值不值得押注

先叠个甲:以下都是个人实测。不代表官方说法。先说结论。再摆依据。 这次「横向对比」不吹不黑。把它和同赛道选手放在一张表里看差距。 查了下公开资料:Qwen3 出自阿里云·通义千问。2025-04-29 与大家见面。6 dense(0.6B/1.7B/4B/8B/14B/32B)+ 2 MoE(30B-A3B 总30B激活3B、235B-A22B 总235B激活22B)。使用Apache 2.0授权。 显存这关。8B Q4 约 5-6GB;14B 约 10GB;32B 约 20GB;30B-A3B 约 19-24GB。 从工程落地角度看。集成成本和推理(inference)稳定性比刷榜分数更值得盯。补充几个硬信息:Qwen3.7-Max(2026-05)为 API-only。无开放权重;Qwen3-4B 可媲美 Qwen2.5-72B。 下次有新进展再来更新。以上均为基于公开信息的分析。欢迎指正。—— 工具为人服务。不是相反。 😂 😅 ⭐ 💡 🎯 👀 🚀 🔥 ✨

全部回复 (1)

  1. 格斗家 #1
    楼主有心了,弓手这块我也在研究,回头试试。