NVIDIA · Ada Lovelace · 2024
RTX 4070 Ti Super(16GB)跑什么大模型 · 完整规格
16GB GDDR6X · 672 GB/s · 以下为常见开源模型在 8K 上下文、batch 1 下的推理判定。
完整规格
| 显存 | 16 GB GDDR6X |
| 显存带宽 | 672 GB/s |
| 位宽 | 256-bit |
| FP32 | 44.1 TFLOPS |
| FP16 Tensor | 176.4 TFLOPS |
| FP8 Tensor | 352.8 TFLOPS |
| TDP | 285 W |
| 架构 / 年份 | Ada Lovelace · 2024 |
| 发布价 | $799 |
常见模型判定(8K 上下文 · batch 1)
| 模型 · 量化 | 显存需求 | 判定 |
|---|---|---|
| Qwen3-8B · FP16 / BF16 | 17.4 GiB | 能跑 · 需 2 卡 |
| Qwen3-32B · GGUF Q4_K_M | 22.3 GiB | 能跑 · 需 2 卡 |
| Llama 3.3 70B · GGUF Q4_K_M | 44.1 GiB | 勉强 · 需 3 卡 |
| DeepSeek-V4-Flash · FP8 (E4M3) | 273.1 GiB | 跑不动 · 需 18 卡 |
| gpt-oss-120b · MXFP4(gpt-oss 原生) | 59.9 GiB | 勉强 · 需 4 卡 |
「能跑」= 按所需最少卡数总显存占用 ≤85%;「勉强」≤100%。单卡装不下时标注需 N 卡(上限 8 卡,超出判「跑不动」)。速度与并发请打开计算器查看。