Interfaccia grafica per scaricare ed eseguire modelli di IA in locale, senza dover usare la riga di comando.
Ollama
GratuitoWebWindowsmacOSLinux
Strumento open source per eseguire modelli di linguaggio sul computer; distingue i modelli locali dalle funzioni cloud opzionali.
Presente inModelli locali
Se ti serve Ollama, esistono anche 2 alternative reali
Tutte con fonte ufficiale
App per Mac che trascrive audio e video in locale usando Whisper, senza caricare i file su un server esterno né pagare un abbonamento mensile.
Scegli la tua piattaforma
Non ospitiamo installer né mirror.
- Usa la versione web ufficiale — Versione Web
Versione Web
Sito ufficiale del brand
ollama.com · rev. ago 2026
- Scarica installer ufficiale — Desktop per Windows
Desktop per Windows
Installer ufficiale diretto
ollama.com · rev. ago 2026
- Scarica installer ufficiale — Desktop per macOS
Desktop per macOS
Installer ufficiale diretto
ollama.com · rev. ago 2026
- Vedi la documentazione tecnica — Desktop per Linux
Desktop per Linux
Documentazione ufficiale API/Dev
ollama.com · rev. ago 2026
Ideale per Ollama
- Eseguire modelli di linguaggio in locale per mantenere i dati sul proprio dispositivo
- Sperimentare con modelli open source come Llama, Gemma, Mistral o Phi senza abbonamenti
- Integrare modelli locali in applicazioni proprie tramite l'API compatibile con OpenAI
- Lavorare in modalità solo locale con modelli scaricati quando i dati non possono lasciare il computer
Cosa dovresti sapere prima di usare Ollama
Ollama è diventato uno dei modi più diretti per eseguire modelli di linguaggio sul proprio computer, riducendo l'installazione e la gestione dei modelli a pochi comandi. Questa scheda rimanda solo al canale ufficiale, evidenziando che si tratta di una soluzione tecnica pensata per chi vuole controllo e privacy sui propri dati.
Scritto e verificato da Redazione FuenteAI Vedi la metodologia completa
Verifichiamo ogni canale ufficiale prima di pubblicarlo e aggiorniamo la scheda quando uno strumento cambia nome, dominio o disponibilità.
Guida all'uso di Ollama in sicurezza
Cos'è Ollama e a cosa serve
Ollama permette di scaricare ed eseguire modelli di linguaggio direttamente sul computer. Con un modello locale, la documentazione del progetto dichiara che prompt e risposte non vengono inviati a ollama.com. Esistono però anche modelli cloud, elaborati dal servizio di Ollama e accessibili con un account: le due modalità non vanno confuse.
A differenza di ChatGPT, Claude o Gemini, Ollama non è un'interfaccia di chat: è uno strumento da terminale che può gestire modelli locali o invocare una variante `:cloud` scelta dall'utente. Se cerchi un'app semplice da usare nel browser, probabilmente stai cercando un'altra scheda. Se vuoi far girare Llama, Mistral, Gemma o Phi sul tuo hardware, scegli una variante locale e, quando il percorso dei dati è vincolante, attiva la modalità solo locale documentata dal progetto.
Installazione dalla fonte ufficiale
Ollama si distribuisce da ollama.com, che è l'unico canale ufficiale per gli installer. Il programma è disponibile per macOS, Windows e Linux. Su macOS l'installazione avviene come una normale app; su Windows è un eseguibile di installazione; su Linux è documentato uno script ufficiale. Il processo è ben documentato e non richiede configurazioni complesse per iniziare.
Il punto di attenzione specifico con Ollama è dato proprio dalla sua natura open source e popolare: esistono fork, mirror e redistribuzioni che non sono il progetto ufficiale. La referenza corretta è sempre ollama.com per gli installer e github.com/ollama/ollama per il codice sorgente. Qualsiasi eseguibile che non proviene da queste due fonti va trattato con cautela.
Primi passi: scaricare un modello
Una volta installato, Ollama funziona come un server locale che gestisce i modelli. Con un comando come `ollama run llama3` puoi scaricare ed eseguire il modello Llama 3 direttamente sulla tua macchina. Il catalogo disponibile include modelli di Meta, Google, Microsoft, Mistral AI e molti altri, in varianti di dimensioni diverse in base alla memoria disponibile.
Ollama espone anche un'API locale compatibile con il formato di OpenAI. Questo significa che puoi collegarlo a client desktop come Open WebUI per avere un'interfaccia grafica, oppure integrarlo in applicazioni proprie che già usano l'API di ChatGPT. Quella compatibilità lo rende una componente flessibile per chi costruisce su modelli di linguaggio.
Modelli locali, cloud e percorso dei dati
Con i modelli eseguiti in locale, Ollama dichiara di non vedere prompt o risposte. Con i modelli cloud, invece, il servizio elabora prompt e risposte per fornire il risultato. La modalità solo locale disabilita sia i modelli cloud sia la ricerca web ed è la scelta da configurare quando il materiale non può uscire dal dispositivo.
La configurazione del server ascolta normalmente su localhost. Se la modifichi per accedere da un altro dispositivo, puoi rendere il servizio raggiungibile senza autenticazione: in quel caso usa un proxy inverso o un gateway con autenticazione invece di esporre direttamente la porta di Ollama.
Ollama o LM Studio?
Ollama e LM Studio coprono lo stesso caso d'uso — eseguire modelli locali — ma con approcci diversi. Ollama è pensato per chi è a suo agio con la riga di comando e vuole un server leggero, integrabile con altri strumenti. LM Studio offre invece un'interfaccia grafica completa, utile per chi preferisce non digitare comandi.
Puoi anche usarli insieme: alcuni utenti gestiscono i modelli con Ollama e poi li consumano attraverso interfacce di terze parti. Entrambi hanno canali ufficiali di download che questa scheda rimanda. La scelta dipende dal tuo livello di familiarità con la riga di comando e da quanto controllo vuoi avere sul backend.
Sicurezza e Download
- Scarica Ollama solo da ollama.com o dal repository ufficiale github.com/ollama/ollama.
- Non usare installer di terze parti. I modelli locali richiedono risorse hardware: verifica i requisiti prima di installarli.
- Se esponi Ollama oltre il tuo computer locale, proteggilo con un proxy inverso e autenticazione.
Limitazioni e avvertenze
- È uno strumento a riga di comando: non ha un'interfaccia grafica pronta all'uso senza configurazioni aggiuntive.
- Le prestazioni dipendono fortemente dall'hardware; i modelli grandi richiedono molta RAM o una GPU dedicata.
- Non include un'app ufficiale per dispositivi mobili.
Domande frequenti sul download
Serve una GPU per usare Ollama?
Ollama può usare CPU o GPU: le prestazioni dipendono dal modello e dall'hardware. I modelli piccoli girano anche con 8 GB di RAM, mentre quelli grandi richiedono GPU dedicate o molta memoria. Verifica i requisiti nella documentazione ufficiale.
Ollama è gratuito?
Sì, Ollama è open source e gratuito. Non richiede account né abbonamento per installarlo o eseguire modelli. I dettagli sui termini sono sul sito ufficiale.
I miei dati restano sul mio PC?
Con un modello locale, Ollama dichiara di non ricevere prompt o risposte. I modelli cloud e la ricerca web usano servizi esterni; per escluderli devi attivare la modalità solo locale (`disable_ollama_cloud` oppure `OLLAMA_NO_CLOUD=1`).
Dove scarico Ollama in modo sicuro?
L'unico canale ufficiale è ollama.com. Il codice sorgente è disponibile su github.com/ollama/ollama. Non usare eseguibili da repository non elencati sul sito ufficiale.
Continua a esplorare il catalogo
Altri strumenti verificati con fonte ufficiale, scelti in base a ciò di cui parla questa pagina.
Il traduttore IA più naturale per l'italiano, con app desktop e mobile, traduzione diretta di PDF/Word/PowerPoint e sede in Germania soggetta al GDPR.
Chatbot IA cinese con modelli di ragionamento aperti (R1), completamente gratuito tramite web, Android e iOS.
Assistente per riunioni che registra, trascrive e riassume le conversazioni per trasformarle in attività e decisioni concrete.
Assistente IA per trascrivere, riassumere e analizzare riunioni e audio, con supporto dichiarato per l'italiano e ricerca nei testi.