qwen3.5:27b-q4_K_M : prérequis GPU NVIDIA | LocalAIReady
← Tous les modèles Ollama

Variante Ollama exacte

Qwen3.5 27B

Cette page évalue le blob de modèle immuable derrière qwen3.5:27b-q4_K_M. Les résultats ci-dessous utilisent 8k de contexte et 32 Go de RAM système.

Q4_K_M quantification 16.2 GB blob de modèle exact 256k contexte déclaré

Version exacte du modèle vérifiée

Détails techniques

Digest SHA-256: sha256:d4b8b4f4c350f5d322dc8235175eeae02d32c6f3fd70bdb9ea481e3abb7d7fc4

Exécuter avec Ollamaollama run qwen3.5:27b-q4_K_M
Vérifier une configuration matérielle personnalisée →

Comparaison du matériel NVIDIA

GPU exact VRAM Contexte Statut Limitation principale
GeForce RTX 3060 Laptop GPU 6GB 6.00 GB 8k Estimé Probablement offload CPU/GPU VRAM
GeForce RTX 4060 8GB 8.00 GB 8k Estimé Probablement offload CPU/GPU VRAM
GeForce RTX 3060 12GB 12.0 GB 8k Estimé Probablement offload CPU/GPU VRAM
GeForce RTX 5070 12GB 12.0 GB 8k Estimé Probablement offload CPU/GPU VRAM
GeForce RTX 4060 Ti 16GB 16.0 GB 8k Estimé Probablement offload CPU/GPU VRAM
GeForce RTX 5060 Ti 16GB 16.0 GB 8k Estimé Probablement offload CPU/GPU VRAM
GeForce RTX 3090 24GB 24.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 4090 24GB 24.0 GB 8k Estimé Probablement full GPU physical test data
GeForce RTX 5090 32GB 32.0 GB 8k Estimé Probablement full GPU physical test data

Testé signifie que le GPU, le digest, le runtime et le contexte exacts ont été testés physiquement. Estimé ne signifie jamais testé.

Méthode

Ce qui est inclus

La comparaison inclut le blob de modèle exact, une estimation explicite du cache KV 8k, une marge de planification prudente et un éventuel offload via la RAM système. Elle ne prédit pas la vitesse ni ne revendique un test physique là où il n’en existe pas.