DeepSeek-Coder-V2-Lite Base : configuration requise et compatibilité GPU en local
← Tous les modèles

Modèle d’IA locale

DeepSeek-Coder-V2-Lite Base

par DeepSeek

7 des 22 machines de référence l’exécutent entièrement en mémoire accélérateur en contexte 8k, et 6 de plus avec délestage CPU.

15.7B Paramètres 160k Contexte maximal 1 Quantification Complète Couverture de compatibilité
Tester mon PC

Vue d’ensemble

Éditeur
DeepSeek
Famille
Deepseek
Série
DeepSeek-Coder-V2
Tâche
Code
Architecture
mixture d’experts · deepseek_v2
Paramètres
15.7B
Contexte maximal
163 840 tokens
Licence
deepseek-license
Publication
2024-06-14
Formats
gguf, safetensors
Cache KV par token (f16)
276 480 B · majorant (fenêtre glissante, MLA ou attention croisée)
Couverture de compatibilité
Complète : verdicts calculés
Dépôt source
deepseek-ai/DeepSeek-Coder-V2-Lite-Base
Page officielle
https://www.deepseek.com/

Quantifications et tailles de fichiers

Quantification Runtime Poids Plancher mémoire à 4k Identité
Q4_0gguf ollamaollama run deepseek-coder-v2:16b-lite-base-q4_0 8.29 GB 8.29 GB digest vérifié

Les tailles proviennent du registre du runtime ou du listing du dépôt. Le plancher mémoire ajoute le cache KV pour 4 096 tokens quand ce chiffre ne peut pas surestimer ; c’est une estimation, pas une exigence.

Runtimes

Compatibilité sur les machines de référence

Contexte 8k, 32 Go de RAM système, meilleure quantification cataloguée par machine.

Machine Mémoire Réponse Faits connus
GeForce RTX 4060 Ti 16GB 16.0 GB VRAM Tient entièrement en mémoire estimé · Q4_0 Poids 8.29 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 4080 16GB 16.0 GB VRAM Tient entièrement en mémoire estimé · Q4_0 Poids 8.29 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 5060 Ti 16GB 16.0 GB VRAM Tient entièrement en mémoire estimé · Q4_0 Poids 8.29 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 5080 16GB 16.0 GB VRAM Tient entièrement en mémoire estimé · Q4_0 Poids 8.29 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 3090 24GB 24.0 GB VRAM Tient entièrement en mémoire estimé · Q4_0 Poids 8.29 GB vs 24.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 4090 24GB 24.0 GB VRAM Tient entièrement en mémoire estimé · Q4_0 Poids 8.29 GB vs 24.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 5090 32GB 32.0 GB VRAM Tient entièrement en mémoire estimé · Q4_0 Poids 8.29 GB vs 32.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 3060 Laptop GPU 6GB 6.00 GB VRAM Fonctionne avec délestage CPU estimé · Q4_0 Poids 8.29 GB vs 6.00 GB VRAM : ne tiennent pasCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 4060 8GB 8.00 GB VRAM Fonctionne avec délestage CPU estimé · Q4_0 Poids 8.29 GB vs 8.00 GB VRAM : ne tiennent pasCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 3080 10GB 10.0 GB VRAM Fonctionne avec délestage CPU estimé · Q4_0 Poids 8.29 GB vs 10.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 3060 12GB 12.0 GB VRAM Fonctionne avec délestage CPU estimé · Q4_0 Poids 8.29 GB vs 12.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 4070 12GB 12.0 GB VRAM Fonctionne avec délestage CPU estimé · Q4_0 Poids 8.29 GB vs 12.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
GeForce RTX 5070 12GB 12.0 GB VRAM Fonctionne avec délestage CPU estimé · Q4_0 Poids 8.29 GB vs 12.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
Radeon RX 7800 XT 16GB 16.0 GB VRAM Potentiel : les poids tiennent non vérifié · Q4_0 Poids 8.29 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
Radeon RX 9070 XT 16GB 16.0 GB VRAM Potentiel : les poids tiennent non vérifié · Q4_0 Poids 8.29 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
Radeon RX 7900 XTX 24GB 24.0 GB VRAM Potentiel : les poids tiennent non vérifié · Q4_0 Poids 8.29 GB vs 24.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
Radeon RX 7600 8GB 8.00 GB VRAM Potentiel : poids avec délestage non vérifié · Q4_0 Poids 8.29 GB vs 8.00 GB VRAM : ne tiennent pasCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
Intel Arc B580 12GB 12.0 GB VRAM Données insuffisantes non vérifié · Q4_0 Poids 8.29 GB vs 12.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))prise en charge du runtime sur cette machine : unknown
Intel Arc A770 16GB 16.0 GB VRAM Données insuffisantes non vérifié · Q4_0 Poids 8.29 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))prise en charge du runtime sur cette machine : unknown
Mac mini M4 24GB 24.0 GB unifiée Données insuffisantes non vérifié · Q4_0 Poids 8.29 GB vs 24.0 GB unifiée : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
Mac mini M4 Pro 24GB 24.0 GB unifiée Données insuffisantes non vérifié · Q4_0 Poids 8.29 GB vs 24.0 GB unifiée : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))
MacBook Pro 14-inch M4 Max 36GB 36.0 GB unifiée Données insuffisantes non vérifié · Q4_0 Poids 8.29 GB vs 36.0 GB unifiée : tiennentCache KV à 8k : 2.11 GB (majorant (fenêtre glissante, MLA ou attention croisée))

Les réponses définitives (« fonctionne », « ne tient pas ») viennent du moteur calibré ou d’un test physique. Les lignes « potentiel » comparent seulement les poids à la mémoire : le reste du besoin n’est pas modélisé, ce ne sont donc pas des verdicts. Inconnu n’est jamais un échec.

Matériel pour ce modèle

Les GPU de référence avec 16 Go de VRAM ou plus l’exécutent entièrement en mémoire en contexte 8k : GeForce RTX 4060 Ti 16GB, GeForce RTX 4080 16GB, GeForce RTX 5060 Ti 16GB, GeForce RTX 5080 16GB.

  • Plus petit artefact catalogué : 8.29 GB de poids (Q4_0).
  • Un GPU d’au moins 16 Go de VRAM contient ces poids.
Ces liens ouvrent une recherche par catégorie de matériel, pas une recommandation de produit précis. Affiliate link — I may earn a commission from qualifying purchases. Ces liens ne modifient jamais une réponse de compatibilité. Ils suivent la mémoire que les données justifient, pas la commission.

Sources et preuves

0 champs mesurés, 26 sourcés, 4 estimés et 2 inconnus.

Fiche catalogue vérifiée le 2026-09-17.

Que peut faire tourner votre PC ?

Choisissez votre GPU et votre RAM pour voir chaque modèle catalogué qui tient, en séparant réponses testées, estimées et potentielles.

Tester mon PC