DeepSeek系列模型推理性能对比:V4-Pro与V4-Flash资源效率及多版本横向比较

DeepSeek模型推理性能

DeepSeek模型推理性能图1

DeepSeek模型推理性能图2

DeepSeek-V4-Pro 以 16 卡 H20(双倍资源),总吞吐仅 479 tok/s、最大并发仅 8,而 V4-Flash 仅用 8 卡就达到 15,517 tok/s 和 256 并发,Pro 在资源效率和 serving 能力上均被碾压。

DeepSeek Base模型对比

DeepSeek-V3.2-Base、DeepSeek-V4-Flash-Base、DeepSeek-V4-Pro-Base模型对比

DeepSeek V4 不同尺寸模型对比

不同尺寸和模式的DeepSeek-V4系列比较

不同尺寸和模式的DeepSeek-V4系列比较(来源:Artificial Analysis)

DeepSeek模型对比

不同尺寸和模式的DeepSeek-V4系列比较(来源:Arena AI)

本文结束 感谢您的阅读