gemma3:12b : prérequis GPU NVIDIA | LocalAIReady
← Tous les modèles Ollama

Variante Ollama exacte

Gemma 3 12B

Cette page évalue le blob de modèle immuable derrière gemma3:12b. Les résultats ci-dessous utilisent 8k de contexte et 32 Go de RAM système.

Q4_K_M quantification 7.59 GB blob de modèle exact 128k contexte déclaré

Version exacte du modèle vérifiée

Détails techniques

Digest SHA-256: sha256:e8ad13eff07a78d89926e9e8b882317d082ef5bf9768ad7b50fcdbbcd63748de

Exécuter avec Ollamaollama run gemma3:12b
Vérifier une configuration matérielle personnalisée →

Comparaison du matériel NVIDIA

GPU exact VRAM Contexte Statut Limitation principale
GeForce RTX 3060 Laptop GPU 6GB 6.00 GB 8k Estimé Probablement offload CPU/GPU VRAM
GeForce RTX 4060 8GB 8.00 GB 8k Estimé Probablement offload CPU/GPU VRAM
GeForce RTX 3060 12GB 12.0 GB 8k Estimé Probablement offload CPU/GPU VRAM
GeForce RTX 5070 12GB 12.0 GB 8k Estimé Probablement offload CPU/GPU VRAM
GeForce RTX 4060 Ti 16GB 16.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 5060 Ti 16GB 16.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 3090 24GB 24.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 4090 24GB 24.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 5090 32GB 32.0 GB 8k Estimé Probablement full GPU physical test data

Testé signifie que le GPU, le digest, le runtime et le contexte exacts ont été testés physiquement. Estimé ne signifie jamais testé.

Méthode

Ce qui est inclus

La comparaison inclut le blob de modèle exact, une estimation explicite du cache KV 8k, une marge de planification prudente et un éventuel offload via la RAM système. Elle ne prédit pas la vitesse ni ne revendique un test physique là où il n’en existe pas.