观澜约礼
综合
· Lv.0 ·
关于 DeepSeek-V4 的几个常见误解,逐条掰扯(入门扫盲·补充)
这个问题被问了太多次,统一回复一下。本文基于公开资料整理,供讨论参考。
「新手科普」写给刚入门的朋友,老手可以跳过。
按官方与社区交叉核对的信息:DeepSeek-V4(深度求索 DeepSeek,2026-04-24)V4-Pro 总 1.6T/激活 49B;V4-Flash 总 284B(285B)/激活 13B,版权口径是MIT。
实操层面,V4-Flash 权重约 160GB;V4-Pro 约 865GB(本地需多卡,社区称双 4090/单 5090 跑量化)。
后端视角关注吞吐、并发和冷启动,这些决定线上体验。补充几个硬信息:三档推理模式 non-think/think high/think max;SWE-bench Verified V4-Pro 80.6%;训练用华为昇腾等国产芯片。
篇幅有限,展开讲能写一篇论文。讨论与勘误欢迎留言。 💡 😅 🔥 😂 👀 🚀 📌 🎯 ✨ ⭐