Local AI inference : guide des exigences matérielles
Running LLMs or other models locally (Ollama, vLLM, llama.cpp).
Exigences matérielles par niveau
Trois niveaux pour chaque charge : le minimum qui fonctionne, le juste milieu recommandé et le niveau de marge confortable. Ce sont les mêmes niveaux que le moteur de décision WisePC utilise quand il planifie un build autour de ton objectif.
| Niveau | Cœurs CPU | RAM | Stockage | GPU | Réseau |
|---|---|---|---|---|---|
| Minimum | 8 cores | 16 GB | 1 TB (ssd) | ai | 1 GbE |
| Recommandé | 12 cores | 32 GB | 1 TB (ssd) | ai | 2.5 GbE |
| Confortable | 16 cores | 64 GB | 2 TB (ssd) | ai | 10 GbE |
De quel niveau as-tu besoin ?
- Choisis Minimum (8 cœurs, 16 Go de RAM) uniquement pour une machine mono-usage avec un budget serré — attends peu de marge.
- Recommandé (12 cœurs, 32 Go de RAM) est le juste milieu : assez pour la charge plus les services annexes habituels, sans dépenser trop.
- Choisis Confortable (16 cœurs, 64 Go de RAM) quand cette charge partage la machine avec d'autres ou va croître — tu paies pour la marge, pas pour l'anxiété.
- Règle GPU pour cette charge : ai.
Questions fréquentes
De combien de RAM local ai inference a-t-il besoin ?
16 Go est le minimum sensé, 32 Go couvre la plupart des configurations réelles, et 64 Go offre une marge confortable pour la croissance et les services supplémentaires.
De combien de cœurs CPU local ai inference a-t-il besoin ?
Un CPU de 8 cœurs est le minimum, 12 cœurs est le juste milieu recommandé, et 16 cœurs est confortable quand il partage la machine avec d'autres charges.
local ai inference a-t-il besoin d'un GPU dédié ?
Un GPU dédié est fortement recommandé — cette charge fait du calcul IA.
Quel stockage et quel réseau local ai inference attend-il ?
Stockage : 1 To de SSD est la base recommandée (1 To minimum, 2 To confortable). Réseau : 2.5 GbE est la base recommandée.
Qu'est-ce qui fonctionne bien à côté de local ai inference ?
Il s'associe naturellement avec : Image generation, AI experimentation, Databases.