AMD · RDNA 3 · 2022
RX 7900 XTX(24GB)跑什么大模型 · 完整规格
24GB GDDR6 · 960 GB/s · 以下为常见开源模型在 8K 上下文、batch 1 下的推理判定。
完整规格
| 显存 | 24 GB GDDR6 |
| 显存带宽 | 960 GB/s |
| 位宽 | 384-bit |
| FP32 | 61.44 TFLOPS |
| FP16 Tensor | 122.9 TFLOPS |
| TDP | 355 W |
| 架构 / 年份 | RDNA 3 · 2022 |
| 发布价 | $999 |
常见模型判定(8K 上下文 · batch 1)
| 模型 · 量化 | 显存需求 | 判定 |
|---|---|---|
| Qwen3-8B · FP16 / BF16 | 17.4 GiB | 能跑 |
| Qwen3-32B · GGUF Q4_K_M | 22.3 GiB | 勉强 |
| Llama 3.3 70B · GGUF Q4_K_M | 44.1 GiB | 勉强 · 需 2 卡 |
| DeepSeek-V4-Flash · FP8 (E4M3) | 273.1 GiB | 跑不动 · 需 12 卡 |
| gpt-oss-120b · MXFP4(gpt-oss 原生) | 59.9 GiB | 能跑 · 需 3 卡 |
「能跑」= 按所需最少卡数总显存占用 ≤85%;「勉强」≤100%。单卡装不下时标注需 N 卡(上限 8 卡,超出判「跑不动」)。速度与并发请打开计算器查看。