jina-embeddings-v5-text-nano text-matching : configuration requise et compatibilité GPU en local
← Tous les modèles

Modèle d’IA locale

jina-embeddings-v5-text-nano text-matching

par Jina AI

13 des 22 machines de référence l’exécutent entièrement en mémoire accélérateur en contexte 8k, et 0 de plus avec délestage CPU.

212M Paramètres 8k Contexte maximal 2 Quantification Complète Couverture de compatibilité
Tester mon PC

Vue d’ensemble

Éditeur
Jina AI
Famille
Jina-embeddings
Série
jina-embeddings-v5
Tâche
Embeddings
Architecture
dense · eurobert
Paramètres
212M
Contexte maximal
8 192 tokens
Licence
cc-by-nc-4.0
Publication
2026-02-10
Formats
gguf, safetensors
Cache KV par token (f16)
0 B · pas de cache KV autorégressif (encodeur)
Couverture de compatibilité
Complète : verdicts calculés
Dépôt source
jinaai/jina-embeddings-v5-text-nano-text-matching
Page officielle
https://jina.ai/

Quantifications et tailles de fichiers

Quantification Runtime Poids Plancher mémoire à 4k Identité
Q4_K_Mgguf llama.cppjinaai/jina-embeddings-v5-text-nano-text-matching-GGUF/v5-nano-text-matching-Q4_K_M.gguf 0.15 GB 0.15 GB digest vérifié
Q8_0gguf llama.cppjinaai/jina-embeddings-v5-text-nano-text-matching-GGUF/v5-nano-text-matching-Q8_0.gguf 0.22 GB 0.22 GB digest vérifié

Les tailles proviennent du registre du runtime ou du listing du dépôt. Le plancher mémoire ajoute le cache KV pour 4 096 tokens quand ce chiffre ne peut pas surestimer ; c’est une estimation, pas une exigence.

Runtimes

Compatibilité sur les machines de référence

Contexte 8k, 32 Go de RAM système, meilleure quantification cataloguée par machine.

Machine Mémoire Réponse Faits connus
GeForce RTX 3060 Laptop GPU 6GB 6.00 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 6.00 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 4060 8GB 8.00 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 8.00 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 3080 10GB 10.0 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 10.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 3060 12GB 12.0 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 12.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 4070 12GB 12.0 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 12.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 5070 12GB 12.0 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 12.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 4060 Ti 16GB 16.0 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 4080 16GB 16.0 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 5060 Ti 16GB 16.0 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 5080 16GB 16.0 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 3090 24GB 24.0 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 24.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 4090 24GB 24.0 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 24.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
GeForce RTX 5090 32GB 32.0 GB VRAM Tient entièrement en mémoire estimé · Q8_0 Poids 0.22 GB vs 32.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)
Radeon RX 7600 8GB 8.00 GB VRAM Données insuffisantes non vérifié · Q4_K_M Poids 0.15 GB vs 8.00 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)prise en charge du runtime sur cette machine : unknown
Intel Arc B580 12GB 12.0 GB VRAM Données insuffisantes non vérifié · Q4_K_M Poids 0.15 GB vs 12.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)prise en charge du runtime sur cette machine : unknown
Radeon RX 7800 XT 16GB 16.0 GB VRAM Données insuffisantes non vérifié · Q4_K_M Poids 0.15 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)prise en charge du runtime sur cette machine : unknown
Radeon RX 9070 XT 16GB 16.0 GB VRAM Données insuffisantes non vérifié · Q4_K_M Poids 0.15 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)prise en charge du runtime sur cette machine : unknown
Intel Arc A770 16GB 16.0 GB VRAM Données insuffisantes non vérifié · Q4_K_M Poids 0.15 GB vs 16.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)prise en charge du runtime sur cette machine : unknown
Radeon RX 7900 XTX 24GB 24.0 GB VRAM Données insuffisantes non vérifié · Q4_K_M Poids 0.15 GB vs 24.0 GB VRAM : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)prise en charge du runtime sur cette machine : unknown
Mac mini M4 24GB 24.0 GB unifiée Données insuffisantes non vérifié · Q4_K_M Poids 0.15 GB vs 24.0 GB unifiée : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)prise en charge du runtime sur cette machine : unknown
Mac mini M4 Pro 24GB 24.0 GB unifiée Données insuffisantes non vérifié · Q4_K_M Poids 0.15 GB vs 24.0 GB unifiée : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)prise en charge du runtime sur cette machine : unknown
MacBook Pro 14-inch M4 Max 36GB 36.0 GB unifiée Données insuffisantes non vérifié · Q4_K_M Poids 0.15 GB vs 36.0 GB unifiée : tiennentCache KV à 8k : pas de cache KV autorégressif (encodeur)prise en charge du runtime sur cette machine : unknown

Les réponses définitives (« fonctionne », « ne tient pas ») viennent du moteur calibré ou d’un test physique. Les lignes « potentiel » comparent seulement les poids à la mémoire : le reste du besoin n’est pas modélisé, ce ne sont donc pas des verdicts. Inconnu n’est jamais un échec.

Matériel pour ce modèle

Les GPU de référence avec 8 Go de VRAM ou plus l’exécutent entièrement en mémoire en contexte 8k : GeForce RTX 3060 Laptop GPU 6GB, GeForce RTX 4060 8GB, GeForce RTX 3080 10GB, GeForce RTX 3060 12GB.

  • Plus petit artefact catalogué : 0.15 GB de poids (Q4_K_M).
  • Un GPU d’au moins 8 Go de VRAM contient ces poids.
Ces liens ouvrent une recherche par catégorie de matériel, pas une recommandation de produit précis. Affiliate link — I may earn a commission from qualifying purchases. Ces liens ne modifient jamais une réponse de compatibilité. Ils suivent la mémoire que les données justifient, pas la commission.

Sources et preuves

0 champs mesurés, 37 sourcés, 4 estimés et 5 inconnus.

Fiche catalogue vérifiée le 2026-09-17.

Même famille

Taille proche, même tâche

Que peut faire tourner votre PC ?

Choisissez votre GPU et votre RAM pour voir chaque modèle catalogué qui tient, en séparant réponses testées, estimées et potentielles.

Tester mon PC