Ollama (local AI): cerințe hardware
Rulează LLM-uri local — chat, completare cod, AI privat.
Niveluri hardware
| Nivel | CPU | RAM | Stocare | GPU | VRAM | Rețea |
|---|---|---|---|---|---|---|
| Minimum sensibil | 8 nuclee | 16 GB | 1 TB (ssd) | ai | 12 GB VRAM | 1 GbE |
| Recomandat | 12 nuclee | 32 GB | 1 TB (ssd) | ai | 16 GB VRAM | 2.5 GbE |
| Confortabil | 16 nuclee | 64 GB | 2 TB (ssd) | ai | 24 GB VRAM | 10 GbE |
| Overkill | 26 nuclee | 103 GB | 4 TB (ssd) | ai | 24 GB VRAM | 10 GbE |
- Minimum sensibil: Cel mai mic sistem care funcționează cu adevărat — compact, concentrat, fără risipă.
- Recomandat: Punctul optim: face față serviciului plus serviciilor secundare uzuale.
- Confortabil: Rezervă reală — acest serviciu nu va fi niciodată blocajul.
- Overkill: Mai mult decât vei folosi vreodată doar pentru acest serviciu — cheltuie banii în altă parte.
Dincolo de Confortabil — 16 nuclee, 64 GB RAM, 2 TB: rezervă pe care n-o vei folosi niciodată doar pentru acest serviciu.
Dimensionează exact
Alege modelul pe care vrei să-l rulezi — necesarul de VRAM e calculat, nu ghicit.
Ai nevoie de ~8 GB VRAM pentru asta.
Merge bine cu
Generare de imagini, Experimentare AI, Baze de date
Întrebări frecvente
Cât RAM îi trebuie lui Ollama (local AI)?
16 GB e minimul sensibil, 32 GB acoperă majoritatea configurațiilor reale, iar 64 GB oferă rezervă confortabilă.
Câte nuclee CPU îi trebuie lui Ollama (local AI)?
8 nuclee sunt minimul, 12 nuclee punctul optim, iar 16 nuclee confortabil când e partajat cu alte servicii.
Pot rula mai multe servicii pe o singură mașină?
Da — majoritatea serviciilor împart resursele. Folosește planificatorul și selectează mai multe servicii; motorul însumează și suprapune cerințele în loc să le stivuiască.
Ce fac dacă am deja hardware?
Înregistrează-l la Hardware-ul meu și analiza îți arată exact ce servicii poate rula confortabil sistemul tău actual — inclusiv un „nu face nimic” cinstit.