7 min citire

Cum rulezi un model AI local pe un workstation (Ollama, LM Studio)

Pas cu pas: de la instalarea Ollama sau LM Studio până la primul model care rulează pe stația ta HP Z, cu sfaturi de alegere a modelului potrivit plăcii video.

Ce îți trebuie ca să pornești

Ca să rulezi un model AI local ai nevoie de trei lucruri: o placă video cu VRAM suficient pentru modelul dorit (vezi ghidul despre VRAM), un program care rulează modelul, și modelul propriu-zis (se descarcă o singură dată). Nu e nevoie de cunoștințe de programare pentru a începe.

Cele mai simple două programe sunt Ollama (linie de comandă, ușor de automatizat) și LM Studio (interfață grafică, prietenos pentru început). Ambele sunt gratuite și rulează pe Windows, direct pe un workstation HP Z.

Varianta cu interfață grafică: LM Studio

  • Descarcă și instalează LM Studio de pe site-ul oficial.
  • În aplicație, caută un model potrivit plăcii tale (ex. un model 7B–14B cuantizat pentru o placă de 16–20 GB).
  • Apasă „Download", apoi „Load" — modelul se încarcă în VRAM.
  • Scrie în fereastra de chat: rulezi deja AI local, fără internet și fără cont.

Varianta linie de comandă: Ollama

Ollama e ideal dacă vrei să automatizezi sau să conectezi modelul la alte aplicații. După instalare, rulezi o singură comandă în terminal ca să descarci și să pornești un model — de exemplu un model de dimensiune medie. Ollama descarcă automat varianta cuantizată potrivită și îl pornește.

Odată pornit, Ollama expune modelul și ca un mic server local, la care se pot conecta editoare de cod, aplicații proprii sau agenți. Practic transformi workstation-ul într-un „mini-furnizor de AI" pentru tine sau pentru echipă.

Cum alegi modelul potrivit plăcii tale

Regula e simplă: alege un model care încape confortabil în VRAM, cu o rezervă pentru context. Pe o placă de 16–20 GB rulezi bine modele 7B–14B; pe 32 GB urci la 32B; pe 48 GB rulezi 70B cuantizat. Dacă modelul e prea mare, viteza scade drastic.

Pentru sarcini de cod alege modele specializate pe programare; pentru documente în română, modele multilingve bune. Te ajutăm să potrivim modelul, placa și fluxul tău — și îți livrăm un workstation HP Z gata configurat pentru AI local.

Întrebări frecvente

Am nevoie de cunoștințe de programare ca să rulez AI local?

Nu pentru a începe. Cu LM Studio (interfață grafică) descarci un model și scrii în chat, exact ca într-o aplicație obișnuită. Ollama cere o comandă simplă, dar e util dacă vrei să automatizezi.

Ollama și LM Studio sunt gratuite?

Da, ambele sunt gratuite și rulează pe Windows, direct pe un workstation. Modelele open-source pe care le rulezi sunt și ele gratuite — le descarci o singură dată.

Rulează fără internet?

Da. După ce ai descărcat modelul o dată, totul rulează local, fără conexiune la internet. Datele tale nu părăsesc stația.

Vrei să începi cu AI local?

Îți dimensionăm un workstation exact pe modelul și fluxul tău. Consultanță gratuită.

Consultanță gratuită

Alte ghiduri