Can I run Qwen3.8-27B-TWIN-TURBO-Fable-Cold-Fusion-709-ULTRA-HERETIC-Uncensored-NM-DAU-NEO-MTP-GGUF on an RTX 4060?
No
Even its smallest file (IQ2_M, 12.1 GB) is more than an RTX 4060 can hold (7.20 GB usable): it needs 2 of them.
Files and context on RTX 4060
Each file of Qwen3.8-27B-TWIN-TURBO-Fable-Cold-Fusion-709-ULTRA-HERETIC-Uncensored-NM-DAU-NEO-MTP-GGUF (and of GGUF versions the site has analyzed), and how much context fits next to it, with the context cache in 16-bit or 8-bit.
| File | Size | On RTX 4060 | Context (16-bit) | Context (8-bit) |
|---|---|---|---|---|
| Q8_0 | 30.2 GB | Doesn't fit | — | — |
| Qwen3.8-27B-TTURBO-Fable-C-Fusion-709-U-Httic-Uncen-NM-DAU-NEO-MAX-Q8_0 | 29.8 GB | Doesn't fit | — | — |
| Qwen3.8-27B-TTURBO-Fable-C-Fusion-709-U-Httic-Uncen-NM-DAU-NEO-MAX-MTP-Q6_K | 24.0 GB | Doesn't fit | — | — |
| Qwen3.8-27B-TTURBO-Fable-C-Fusion-709-U-Httic-Uncen-NM-DAU-NEO-MAX-Q6_K | 23.6 GB | Doesn't fit | — | — |
| Q6_K | 22.4 GB | Doesn't fit | — | — |
| Q5_K_M | 21.2 GB | Doesn't fit | — | — |
| Q5_K_S | 20.6 GB | Doesn't fit | — | — |
| Q4_K_M | 18.5 GB | Doesn't fit | — | — |
| Qwen3.8-27B-TTURBO-Fable-C-Fusion-709-U-Httic-Uncen-NM-DAU-NEO-MAX-Q4_K_M | 18.0 GB | Doesn't fit | — | — |
| IQ4_NL | 17.8 GB | Doesn't fit | — | — |
| Q4_K_S | 17.5 GB | Doesn't fit | — | — |
| Qwen3.8-27B-TTURBO-Fable-C-Fusion-709-U-Httic-Uncen-NM-DAU-NEO-MAX-MTP-IQ4_XS | 17.0 GB | Doesn't fit | — | — |
| Qwen3.8-27B-TTURBO-Fable-C-Fusion-709-U-Httic-Uncen-NM-DAU-NEO-MAX-IQ4_XS | 16.6 GB | Doesn't fit | — | — |
| IQ4_XS | 15.3 GB | Doesn't fit | — | — |
| Qwen3.8-27B-TTURBO-Fable-C-Fusion-709-U-Httic-Uncen-NM-DAU-NEO-MAX-MTP-IQ3_M | 14.5 GB | Doesn't fit | — | — |
| IQ3_M | 14.1 GB | Doesn't fit | — | — |
| IQ2_M | 12.1 GB | Doesn't fit | — | — |