概念 ›FP4(4位浮点量化)
FP4(4-bit Floating Point)是使用 4 位浮点数表示模型权重的量化格式,大幅减少模型存储和推理内存需求。
在 V4 中的应用
DeepSeek-V4 采用 FP4 + FP8 混合精度:
| 参数类型 | 精度 | 说明 |
|---|---|---|
| MoE expert 参数 | FP4 | 大量但每次只激活少量 |
| 其他参数 | FP8 | 共享层、注意力等 |
效果:V4-Pro 从理论 ~3.2TB 压缩到 ~865GB。
量化精度演进
FP32 → FP16 → BF16 → FP8 → FP4,每一步精度降低但效率提升。
关联
来源
DeepSeek V4最大的遗憾raw/articles/量子位-DeepSeek-V4最大的遗憾-2026.md