GeForce RTX 5060 Ti 16GB: compatibilidad con modelos Ollama | LocalAIReady
← Todas las GPU NVIDIA

Compatibilidad de GPU NVIDIA

GeForce RTX 5060 Ti 16GB

A 8k de contexto con 32 GB de RAM del sistema, 11 de 15 variantes Ollama listadas caben en el sobre full-GPU o tienen una prueba full-GPU exacta.

16.0 GB VRAM física CUDA backend Ollama 8k tokens contexto de comparación
Comprobar una RAM o un contexto personalizado →

Modelos Ollama disponibles

Modelo exacto Pesos Contexto Estado Limitación principal
Phi-4 mini phi4-mini:3.8b-q4_K_M · Q4_K_M 2.32 GB 8k Estimado Probablemente full GPU physical test data
Qwen3.5 4B qwen3.5:4b-q4_K_M · Q4_K_M 3.16 GB 8k Estimado Probablemente full GPU physical test data
Qwen3 qwen3:4b-instruct-2507-q4_K_M · Q4_K_M 2.33 GB 8k Estimado Probablemente full GPU physical test data
Gemma 3 4B gemma3:4b · Q4_K_M 3.11 GB 8k Estimado Probablemente full GPU physical test data
Qwen2.5 Coder qwen2.5-coder:7b-instruct-q4_K_M · Q4_K_M 4.36 GB 8k Estimado Probablemente full GPU physical test data
DeepSeek-R1 8B deepseek-r1:8b · Q4_K_M 4.87 GB 8k Estimado Probablemente full GPU physical test data
Qwen3.5 9B qwen3.5:9b-q4_K_M · Q4_K_M 6.14 GB 8k Estimado Probablemente full GPU physical test data
Mistral Nemo mistral-nemo:12b-instruct-2407-q4_K_M · Q4_K_M 6.96 GB 8k Estimado Probablemente full GPU physical test data
DeepSeek-R1 14B deepseek-r1:14b · Q4_K_M 8.37 GB 8k Estimado Probablemente full GPU physical test data
Gemma 3 12B gemma3:12b · Q4_K_M 7.59 GB 8k Estimado Probablemente full GPU physical test data
GPT-OSS gpt-oss:20b · MXFP4 12.8 GB 8k Estimado Probablemente full GPU physical test data
Qwen3.5 27B qwen3.5:27b-q4_K_M · Q4_K_M 16.2 GB 8k Estimado Probablemente offload CPU/GPU VRAM
Gemma 3 27B gemma3:27b · Q4_K_M 16.2 GB 8k Estimado Probablemente offload CPU/GPU VRAM
DeepSeek-R1 32B deepseek-r1:32b · Q4_K_M 18.5 GB 8k Estimado Probablemente offload CPU/GPU VRAM
Qwen3.5 35B-A3B qwen3.5:35b-a3b-q4_K_M · Q4_K_M 22.2 GB 8k Estimado Probablemente offload CPU/GPU VRAM

Los resultados estimados usan un margen de planificación de memoria conservador y no son pruebas físicas. Cambia la RAM o el contexto en el comprobador para un resultado personalizado.

Cómo leer esta página

Método y limitaciones

Los pesos y la caché KV 8k seleccionada se comparan con la VRAM física. La RAM del sistema solo se considera para un posible offload CPU/GPU. La sobrecarga del runtime, las diferencias de drivers y la presión de memoria actual pueden cambiar un run real, así que una estimación nunca se convierte en una prueba.