Qwen3.5 9B: requisitos de hardware y compatibilidad GPU en local
← Todos los modelos

Modelo de IA local

Qwen3.5 9B

de Alibaba Qwen

Los pesos caben enteros en la memoria del acelerador en 16 de 22 máquinas de referencia. La caché KV o el estado del runtime no están modelados del todo: es un mínimo de memoria, no un veredicto de «funciona».

9.7B Parámetros 256k Contexto máximo 2 Cuantización Parcial Cobertura de compatibilidad
Comprobar mi PC

Resumen

Editor
Alibaba Qwen
Familia
Qwen
Serie
Qwen3.5
Tarea
Multimodal
Arquitectura
denso · qwen3_5_text
Parámetros
9.7B
Contexto máximo
262.144 tokens
Licencia
apache-2.0
Publicación
2026-02-27
Formatos
gguf, safetensors
Caché KV por token (f16)
32.768 B · solo capas de atención: estado recurrente no incluido
Cobertura de compatibilidad
Parcial: solo mínimo de memoria
Repositorio de origen
Qwen/Qwen3.5-9B
Página oficial
https://qwen.ai/

Cuantizaciones y tamaños de archivo

Cuantización Runtime Pesos Mínimo de memoria a 4k Identidad
Q4_K_Mgguf ollamaollama run qwen3.5:9b 6.14 GB 6.27 GB digest verificado
Q8_0gguf ollamaollama run qwen3.5:9b-q8_0 9.97 GB 10.1 GB digest verificado

Los tamaños proceden del registro del runtime o del listado del repositorio. El mínimo de memoria suma la caché KV de 4.096 tokens cuando esa cifra no puede sobrestimar; es una estimación, no un requisito.

Runtimes

Compatibilidad en máquinas de referencia

Contexto 8k, 32 GB de RAM del sistema, mejor cuantización catalogada por máquina.

Máquina Memoria Respuesta Datos conocidos
Radeon RX 7600 8GB 8.00 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 8.00 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 4060 8GB 8.00 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 8.00 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 3080 10GB 10.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 10.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 3060 12GB 12.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 12.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 4070 12GB 12.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 12.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 5070 12GB 12.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 12.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
Radeon RX 7800 XT 16GB 16.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 16.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
Radeon RX 9070 XT 16GB 16.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 16.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 4060 Ti 16GB 16.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 16.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 4080 16GB 16.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 16.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 5060 Ti 16GB 16.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 16.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 5080 16GB 16.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 16.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
Radeon RX 7900 XTX 24GB 24.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 24.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 3090 24GB 24.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 24.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 4090 24GB 24.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 24.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 5090 32GB 32.0 GB VRAM Potencial: los pesos caben sin verificar · Q4_K_M Pesos 6.14 GB frente a 32.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
GeForce RTX 3060 Laptop GPU 6GB 6.00 GB VRAM Potencial: pesos con descarga sin verificar · Q4_K_M Pesos 6.14 GB frente a 6.00 GB VRAM: no cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
Intel Arc B580 12GB 12.0 GB VRAM Datos insuficientes sin verificar · Q4_K_M Pesos 6.14 GB frente a 12.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluidosoporte del runtime en esta máquina: unknown
Intel Arc A770 16GB 16.0 GB VRAM Datos insuficientes sin verificar · Q4_K_M Pesos 6.14 GB frente a 16.0 GB VRAM: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluidosoporte del runtime en esta máquina: unknown
Mac mini M4 24GB 24.0 GB unificada Datos insuficientes sin verificar · Q4_K_M Pesos 6.14 GB frente a 24.0 GB unificada: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
Mac mini M4 Pro 24GB 24.0 GB unificada Datos insuficientes sin verificar · Q4_K_M Pesos 6.14 GB frente a 24.0 GB unificada: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido
MacBook Pro 14-inch M4 Max 36GB 36.0 GB unificada Datos insuficientes sin verificar · Q4_K_M Pesos 6.14 GB frente a 36.0 GB unificada: cabenCaché KV a 8k: solo capas de atención: estado recurrente no incluido

Las respuestas definitivas («funciona», «no cabe») salen del motor calibrado o de una prueba física. Las filas «potencial» solo comparan los pesos con la memoria: el resto del requisito no está modelado, así que no son veredictos. Desconocido nunca es un fallo.

Hardware para este modelo

Hacen falta al menos 8 GB de VRAM solo para cargar los pesos más pequeños (6.14 GB). El requisito completo es mayor y aún no está modelado.

  • Artefacto catalogado más pequeño: 6.14 GB de pesos (Q4_K_M).
  • Una GPU con al menos 8 GB de VRAM contiene esos pesos.
  • Aún sin modelar: solo capas de atención: estado recurrente no incluido.
Estos enlaces abren una búsqueda por categoría de hardware, no una recomendación de producto concreto. Affiliate link — I may earn a commission from qualifying purchases. Estos enlaces nunca cambian una respuesta de compatibilidad. Siguen la memoria que los datos justifican, no la comisión.

Fuentes y evidencias

0 campos medidos, 34 con fuente, 4 estimados y 6 desconocidos.

Ficha de catálogo verificada el 2026-09-16.

¿Qué más puede ejecutar tu PC?

Elige tu GPU y tu RAM para ver cada modelo catalogado que cabe, con respuestas probadas, estimadas y potenciales por separado.

Comprobar mi PC