qwen3:4b-instruct-2507-q4_K_M : prérequis GPU NVIDIA | LocalAIReady
← Tous les modèles Ollama

Variante Ollama exacte

Qwen3

Cette page évalue le blob de modèle immuable derrière qwen3:4b-instruct-2507-q4_K_M. Les résultats ci-dessous utilisent 8k de contexte et 32 Go de RAM système.

Q4_K_M quantification 2.33 GB blob de modèle exact 256k contexte déclaré

Version exacte du modèle vérifiée

Détails techniques

Digest SHA-256: sha256:85e4a5b7b8ef0e48af0e8658f5aaab9c2324c76c1641493f4d1e25fce54b18b9

Exécuter avec Ollamaollama run qwen3:4b-instruct-2507-q4_K_M
Vérifier une configuration matérielle personnalisée →

Comparaison du matériel NVIDIA

GPU exact VRAM Contexte Statut Limitation principale
GeForce RTX 3060 Laptop GPU 6GB 6.00 GB 8k Testé Fonctionne entièrement sur le GPU Aucun bloqueur observé
GeForce RTX 4060 8GB 8.00 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 3060 12GB 12.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 5070 12GB 12.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 4060 Ti 16GB 16.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 5060 Ti 16GB 16.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 3090 24GB 24.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 4090 24GB 24.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 5090 32GB 32.0 GB 8k Estimé Probablement full GPU physical test data

Testé signifie que le GPU, le digest, le runtime et le contexte exacts ont été testés physiquement. Estimé ne signifie jamais testé.

Méthode

Ce qui est inclus

La comparaison inclut le blob de modèle exact, une estimation explicite du cache KV 8k, une marge de planification prudente et un éventuel offload via la RAM système. Elle ne prédit pas la vitesse ni ne revendique un test physique là où il n’en existe pas.