Blog · 24 settembre 2026 · 7 min di lettura
Quale modello AI usare in locale per l'italiano (settembre 2026)
Il modello è il "cervello" dell'AI locale e la scelta più importante dopo l'hardware. I modelli open escono a ritmo continuo: ecco quelli che valutiamo oggi per le aziende italiane, con i criteri per scegliere.
In breve: al 24 settembre 2026, per un'azienda che lavora in italiano i modelli open più interessanti sono Qwen3.8 27B (18 GB) e Gemma 4 (12B da 7,6 GB, 26B da 19 GB), entrambi con licenza Apache 2.0 che permette l'uso commerciale. Con 64 GB o più di memoria si può usare gpt-oss 120B (65 GB). Prima di scegliere, prova due o tre modelli sulle tue domande reali: la classifica generale conta meno del risultato sui tuoi documenti.
I criteri che contano davvero
- Memoria: il modello deve stare tutto nella memoria del computer, con margine per il contesto.
- Qualità in italiano: scrittura corretta, comprensione di documenti tecnici e amministrativi, terminologia del settore.
- Velocità: una risposta che arriva dopo un minuto non verrà usata. I modelli MoE (mixture of experts) attivano solo una parte dei parametri e sono più veloci a parità di dimensione.
- Licenza: deve permettere l'uso commerciale nella tua azienda, e nell'Unione Europea.
- Funzioni extra: lettura di immagini e PDF scansionati (visione), contesto lungo per documenti corposi.
I modelli open da provare oggi
| Modello | Download su Ollama (4 bit) | Licenza | Quando sceglierlo |
|---|---|---|---|
| Gemma 4 12B | 7,6 GB | Apache 2.0 | Computer con 16 GB, compiti d'ufficio, prove |
| Gemma 4 26B (MoE) | 19 GB | Apache 2.0 | Buon equilibrio tra qualità e velocità con 32 GB |
| Qwen3.8 27B | 18 GB | Apache 2.0 | Qualità alta con 32 GB, contesto lungo, visione |
| Qwen3.6 35B (MoE) | 23 GB | Apache 2.0 | Risposte veloci su macchine da 32–48 GB |
| gpt-oss 20B | 14 GB | Apache 2.0 | Ragionamento su macchine da 16–24 GB |
| gpt-oss 120B | 65 GB | Apache 2.0 | Mac o server con 96 GB e oltre |
| Mistral Small 24B | 14 GB | Apache 2.0 | Alternativa europea compatta |
Le dimensioni sono quelle dei file scaricati da Ollama e sono un buon riferimento per la memoria minima; in uso ne serve un po' di più. Su Mac, molti modelli hanno anche una variante -mlx ottimizzata per Apple Silicon (per esempio qwen3.8:27b-mlx).
E i modelli italiani?
Esistono modelli addestrati con molti testi in italiano, come Minerva (Sapienza NLP, 7B, Apache 2.0) e Velvet (Almawave, 14B e 2B, Apache 2.0). Sono progetti importanti e utili per compiti specifici, ma per un assistente d'ufficio generico oggi i modelli multilingue più grandi elencati sopra danno in genere risultati migliori anche in italiano.
Attenzione alle licenze: alcuni modelli italiani recenti sono rilasciati solo per uso non commerciale. Leggi sempre la licenza sulla pagina del modello prima di metterlo in produzione.
Per un confronto oggettivo esistono classifiche dedicate all'italiano, come la Evalita-LLM leaderboard.
Licenze: un dettaglio che conta per le aziende europee
Non tutti i modelli "open" sono uguali. Quelli con licenza Apache 2.0 o MIT si possono usare commercialmente senza particolari vincoli. Altri hanno licenze proprie: per esempio la licenza di Llama 4 esclude le aziende con sede nell'Unione Europea dai diritti sulle funzioni multimodali. Per un'azienda italiana è un motivo in più per preferire modelli con licenze standard.
Come fare il test in pratica
- Prepara 10 domande reali: due email da scrivere, un documento da riassumere, una domanda su una procedura interna, un testo da tradurre, un dato da estrarre da un PDF.
- Scarica due o tre modelli compatibili con la tua memoria, per esempio
ollama pull gemma4:12beollama pull qwen3.8:27b. - In Open WebUI puoi porre la stessa domanda a più modelli affiancati e confrontare le risposte.
- Valuta qualità, errori e tempi di risposta, e fai votare chi userà davvero l'AI.
Tip: ripeti il test ogni pochi mesi. I modelli migliorano rapidamente e, con un'installazione locale, cambiare modello è questione di un download.
Quando conviene farsi aiutare
Vuoi tutto in un PDF da stampare o girare ai colleghi? Scarica gratis la guida completa: hardware, modelli, installazione, sicurezza e checklist in 20 punti.
Una prova su un computer si fa in un pomeriggio. Portarla in produzione per un'azienda è un altro lavoro: account e permessi per reparto, accesso sicuro da remoto, backup, aggiornamenti, collegamento ai gestionali e formazione del personale (utile anche per l'AI Act).
Se la prova ti ha convinto e vuoi un'installazione affidabile, scrivici: partiamo da quello che hai già provato. La consulenza Dabryx parte da €100 l'ora.
Fonti
- Ollama – libreria dei modelli
- Ollama – Gemma 4 (dimensioni e varianti)
- Google Open Source Blog – Gemma 4 con licenza Apache 2.0
- Ollama – Qwen3.8
- Ollama – Qwen3.6
- Ollama – gpt-oss
- Sapienza NLP – Minerva-7B (Hugging Face)
- Almawave – Velvet-14B (Hugging Face)
- Evalita-LLM leaderboard (modelli valutati in italiano)
- The Decoder – Llama 4 e le limitazioni per le aziende UE
Domande frequenti
Qual è il miglior modello AI locale in italiano?
Non esiste un vincitore assoluto: dipende da memoria, compiti e velocità richiesta. A settembre 2026 Qwen3.8 27B e Gemma 4 sono ottimi punti di partenza per un'azienda italiana, entrambi con licenza Apache 2.0.
I modelli open si possono usare gratis in azienda?
Molti sì: quelli con licenza Apache 2.0 o MIT si possono usare commercialmente senza costi di licenza. Altri hanno licenze con limitazioni, per esempio per le aziende europee o per l'uso commerciale: va controllato modello per modello.
Ogni quanto conviene cambiare modello?
Conviene rivalutare ogni pochi mesi. Con un'installazione locale il cambio è semplice: si scarica il nuovo modello, lo si prova sulle stesse domande e lo si rende disponibile solo se è davvero migliore.
Vuoi una stima per la tua azienda?
Raccontaci quante persone useranno l'AI e per cosa: ti diciamo quale configurazione serve.
Tempi di risposta
Entro 2 ore nei giorni feriali (9:00–18:00) per i clienti con contratto di assistenza.
Consulenza AI
A partire da €100 l'ora, su server o Mac della tua azienda.
Dove lavoriamo
In tutta Italia, da remoto e in sede dal cliente.