APPLE · Apple M4 · 2024
Apple M4(32GB)跑什么大模型 · 完整规格
32GB LPDDR5X 统一内存 · 120 GB/s · 以下为常见开源模型在 8K 上下文、batch 1 下的推理判定。
完整规格
| 显存 | 32 GB LPDDR5X 统一内存 |
| 显存带宽 | 120 GB/s |
| FP32 | 4.5 TFLOPS |
| 架构 / 年份 | Apple M4 · 2024 |
常见模型判定(8K 上下文 · batch 1)
| 模型 · 量化 | 显存需求 | 判定 |
|---|---|---|
| Qwen3-8B · FP16 / BF16 | 17.4 GiB | 能跑 |
| Qwen3-32B · GGUF Q4_K_M | 22.3 GiB | 能跑 |
| Llama 3.3 70B · GGUF Q4_K_M | 44.1 GiB | 能跑 · 需 2 卡 |
| DeepSeek-V4-Flash · FP8 (E4M3) | 273.1 GiB | 跑不动 · 需 9 卡 |
| gpt-oss-120b · MXFP4(gpt-oss 原生) | 59.9 GiB | 勉强 · 需 2 卡 |
「能跑」= 按所需最少卡数总显存占用 ≤85%;「勉强」≤100%。单卡装不下时标注需 N 卡(上限 8 卡,超出判「跑不动」)。速度与并发请打开计算器查看。