Ollama (local AI) : configuration matérielle
Exécute des LLM en local — chat, complétion de code, IA privée.
Paliers matériels
| Niveau | CPU | RAM | Stockage | GPU | VRAM | Réseau |
|---|---|---|---|---|---|---|
| Minimum sensé | 8 cœurs | 16 GB | 1 TB (ssd) | ai | 12 Go de VRAM | 1 GbE |
| Recommandé | 12 cœurs | 32 GB | 1 TB (ssd) | ai | 16 Go de VRAM | 2.5 GbE |
| Confortable | 16 cœurs | 64 GB | 2 TB (ssd) | ai | 24 Go de VRAM | 10 GbE |
| Overkill | 26 cœurs | 103 GB | 4 TB (ssd) | ai | 24 Go de VRAM | 10 GbE |
- Minimum sensé: Le plus petit système qui fonctionne vraiment — compact, ciblé, sans fioritures.
- Recommandé: Le juste milieu : gère le service plus les services secondaires habituels.
- Confortable: De vraies marges — ce service ne sera jamais le goulot d'étranglement.
- Overkill: Plus que ce que tu utiliseras jamais pour ce seul service — dépense cet argent ailleurs.
Au-delà de Confortable — 16 cœurs, 64 Go de RAM, 2 To : des marges que tu n'utiliseras jamais pour ce seul service.
Dimensionner au juste
Choisissez le modèle à exécuter — le besoin VRAM est calculé, pas deviné.
Il faut environ 8 Go de VRAM pour ceci.
Fonctionne bien avec
Génération d'images, Expérimentation IA, Bases de données
Questions fréquentes
De combien de RAM Ollama (local AI) a-t-il besoin ?
16 Go est le minimum raisonnable, 32 Go couvrent la plupart des installations réelles, et 64 Go offrent une marge confortable.
De combien de cœurs CPU Ollama (local AI) a-t-il besoin ?
8 cœurs sont le minimum, 12 cœurs le juste milieu, et 16 cœurs confortables en partage avec d'autres services.
Puis-je exécuter plusieurs services sur une seule machine ?
Oui — la plupart des services partagent les ressources. Utilise le planificateur et sélectionne plusieurs services ; le moteur additionne et chevauche les exigences au lieu de les empiler.
Et si j'ai déjà du matériel ?
Enregistre-le dans Mon matériel et l'analyse montre exactement quels services ton système actuel peut exécuter confortablement — y compris un honnête « ne fais rien ».