GeForce RTX 5070 12GB : compatibilité modèles Ollama | LocalAIReady
← Tous les GPU NVIDIA

Compatibilité GPU NVIDIA

GeForce RTX 5070 12GB

À 8k de contexte avec 32 Go de RAM système, 9 des 15 variantes Ollama listées tiennent dans l’enveloppe full-GPU ou ont un test full-GPU exact.

12.0 GB VRAM physique CUDA backend Ollama 8k tokens contexte de comparaison
Vérifier une RAM ou un contexte personnalisé →

Modèles Ollama disponibles

Modèle exact Poids Contexte Statut Limitation principale
Phi-4 mini phi4-mini:3.8b-q4_K_M · Q4_K_M 2.32 GB 8k Estimé Probablement full GPU physical test data
Qwen3.5 4B qwen3.5:4b-q4_K_M · Q4_K_M 3.16 GB 8k Estimé Probablement full GPU physical test data
Qwen3 qwen3:4b-instruct-2507-q4_K_M · Q4_K_M 2.33 GB 8k Estimé Probablement full GPU physical test data
Gemma 3 4B gemma3:4b · Q4_K_M 3.11 GB 8k Estimé Probablement full GPU physical test data
Qwen2.5 Coder qwen2.5-coder:7b-instruct-q4_K_M · Q4_K_M 4.36 GB 8k Estimé Probablement full GPU physical test data
DeepSeek-R1 8B deepseek-r1:8b · Q4_K_M 4.87 GB 8k Estimé Probablement full GPU physical test data
Qwen3.5 9B qwen3.5:9b-q4_K_M · Q4_K_M 6.14 GB 8k Estimé Probablement full GPU physical test data
Mistral Nemo mistral-nemo:12b-instruct-2407-q4_K_M · Q4_K_M 6.96 GB 8k Estimé Probablement full GPU physical test data
DeepSeek-R1 14B deepseek-r1:14b · Q4_K_M 8.37 GB 8k Estimé Probablement full GPU physical test data
Gemma 3 12B gemma3:12b · Q4_K_M 7.59 GB 8k Estimé Probablement offload CPU/GPU VRAM
GPT-OSS gpt-oss:20b · MXFP4 12.8 GB 8k Estimé Probablement offload CPU/GPU VRAM
Qwen3.5 27B qwen3.5:27b-q4_K_M · Q4_K_M 16.2 GB 8k Estimé Probablement offload CPU/GPU VRAM
Gemma 3 27B gemma3:27b · Q4_K_M 16.2 GB 8k Estimé Probablement offload CPU/GPU VRAM
DeepSeek-R1 32B deepseek-r1:32b · Q4_K_M 18.5 GB 8k Estimé Probablement offload CPU/GPU VRAM
Qwen3.5 35B-A3B qwen3.5:35b-a3b-q4_K_M · Q4_K_M 22.2 GB 8k Estimé Probablement offload CPU/GPU VRAM

Les résultats estimés utilisent une marge de planification mémoire prudente et ne sont pas des tests physiques. Modifiez la RAM ou le contexte dans le vérificateur pour un résultat personnalisé.

Comment lire cette page

Méthode et limites

Les poids et le cache KV 8k sélectionné sont comparés à la VRAM physique. La RAM système n’est considérée que pour un éventuel offload CPU/GPU. La surcharge runtime, les différences de pilotes et la pression mémoire actuelle peuvent changer un run réel : une estimation ne devient jamais un test.