phi4-mini:3.8b-q4_K_M: requisitos de GPU NVIDIA | LocalAIReady
← Todos los modelos Ollama

Variante exacta de Ollama

Phi-4 mini

Esta página evalúa el blob de modelo inmutable detrás de phi4-mini:3.8b-q4_K_M. Los resultados siguientes usan 8k de contexto y 32 GB de RAM del sistema.

Q4_K_M cuantización 2.32 GB blob exacto del modelo 128k contexto declarado

Versión exacta del modelo verificada

Detalles técnicos

Digest SHA-256: sha256:3c168af1dea0a414299c7d9077e100ac763370e5a98b3c53801a958a47f0a5db

Ejecutar con Ollamaollama run phi4-mini:3.8b-q4_K_M
Comprobar una configuración de hardware personalizada →

Comparación de hardware NVIDIA

GPU exacta VRAM Contexto Estado Limitación principal
GeForce RTX 3060 Laptop GPU 6GB 6.00 GB 8k Probado Se ejecuta enteramente en la GPU Sin bloqueo observado
GeForce RTX 4060 8GB 8.00 GB 8k Estimado Probablemente full GPU physical test data
GeForce RTX 3060 12GB 12.0 GB 8k Estimado Probablemente full GPU physical test data
GeForce RTX 5070 12GB 12.0 GB 8k Estimado Probablemente full GPU physical test data
GeForce RTX 4060 Ti 16GB 16.0 GB 8k Estimado Probablemente full GPU physical test data
GeForce RTX 5060 Ti 16GB 16.0 GB 8k Estimado Probablemente full GPU physical test data
GeForce RTX 3090 24GB 24.0 GB 8k Estimado Probablemente full GPU physical test data
GeForce RTX 4090 24GB 24.0 GB 8k Estimado Probablemente full GPU physical test data
GeForce RTX 5090 32GB 32.0 GB 8k Estimado Probablemente full GPU physical test data

Probado significa que la GPU, el digest, el runtime y el contexto exactos se probaron físicamente. Estimado nunca significa probado.

Método

Qué se incluye

La comparación incluye el blob exacto del modelo, una estimación explícita de la caché KV 8k, un margen de planificación conservador y un posible offload con RAM del sistema. No predice velocidad ni afirma una prueba física donde no exista.