Blog · 24 septembre 2026 · 7 min de lecture
Quel modèle d'IA utiliser en local pour l'italien (septembre 2026)
Le modèle est le « cerveau » de l'IA locale et le choix le plus important après le matériel. Les modèles open sortent à un rythme soutenu : voici ceux que nous évaluons aujourd'hui pour les entreprises italiennes, avec les critères pour choisir.
En bref : au 24 septembre 2026, pour une entreprise qui travaille en italien, les modèles open les plus intéressants sont Qwen3.8 27B (18 GB) et Gemma 4 (12B de 7,6 GB, 26B de 19 GB), tous deux sous licence Apache 2.0 qui autorise l'usage commercial. Avec 64 GB de mémoire ou plus, on peut utiliser gpt-oss 120B (65 GB). Avant de choisir, testez deux ou trois modèles sur vos vraies questions : le classement général compte moins que le résultat sur vos documents.
Les critères qui comptent vraiment
- Mémoire : le modèle doit tenir entièrement dans la mémoire de l'ordinateur, avec une marge pour le contexte.
- Qualité en italien : rédaction correcte, compréhension de documents techniques et administratifs, terminologie du secteur.
- Vitesse : une réponse qui arrive au bout d'une minute ne sera pas utilisée. Les modèles MoE (mixture of experts) n'activent qu'une partie de leurs paramètres et sont plus rapides à taille égale.
- Licence : elle doit autoriser l'usage commercial dans votre entreprise, et dans l'Union européenne.
- Fonctions supplémentaires : lecture d'images et de PDF scannés (vision), contexte long pour les documents volumineux.
Les modèles open à tester aujourd'hui
| Modèle | Téléchargement sur Ollama (4 bits) | Licence | Quand le choisir |
|---|---|---|---|
| Gemma 4 12B | 7,6 GB | Apache 2.0 | Ordinateur avec 16 GB, tâches bureautiques, tests |
| Gemma 4 26B (MoE) | 19 GB | Apache 2.0 | Bon équilibre entre qualité et vitesse avec 32 GB |
| Qwen3.8 27B | 18 GB | Apache 2.0 | Haute qualité avec 32 GB, contexte long, vision |
| Qwen3.6 35B (MoE) | 23 GB | Apache 2.0 | Réponses rapides sur des machines de 32–48 GB |
| gpt-oss 20B | 14 GB | Apache 2.0 | Raisonnement sur des machines de 16–24 GB |
| gpt-oss 120B | 65 GB | Apache 2.0 | Mac ou serveur avec 96 GB et plus |
| Mistral Small 24B | 14 GB | Apache 2.0 | Alternative européenne compacte |
Les tailles sont celles des fichiers téléchargés depuis Ollama et donnent une bonne référence pour la mémoire minimale ; à l'usage, il en faut un peu plus. Sur Mac, de nombreux modèles ont aussi une variante -mlx optimisée pour Apple Silicon (par exemple qwen3.8:27b-mlx).
Et les modèles italiens ?
Il existe des modèles entraînés sur de nombreux textes en italien, comme Minerva (Sapienza NLP, 7B, Apache 2.0) et Velvet (Almawave, 14B et 2B, Apache 2.0). Ce sont des projets importants et utiles pour des tâches spécifiques, mais pour un assistant de bureau généraliste, les grands modèles multilingues cités plus haut donnent aujourd'hui généralement de meilleurs résultats, y compris en italien.
Attention aux licences : certains modèles italiens récents ne sont publiés que pour un usage non commercial. Lisez toujours la licence sur la page du modèle avant de le mettre en production.
Pour une comparaison objective, il existe des classements dédiés à l'italien, comme l'Evalita-LLM leaderboard.
Licences : un détail qui compte pour les entreprises européennes
Tous les modèles « open » ne se valent pas. Ceux sous licence Apache 2.0 ou MIT peuvent être utilisés commercialement sans contraintes particulières. D'autres ont leur propre licence : par exemple, la licence de Llama 4 exclut les entreprises établies dans l'Union européenne des droits sur les fonctions multimodales. Pour une entreprise italienne, c'est une raison de plus de préférer des modèles sous licences standard.
Comment faire le test en pratique
- Préparez 10 questions réelles : deux e-mails à rédiger, un document à résumer, une question sur une procédure interne, un texte à traduire, une donnée à extraire d'un PDF.
- Téléchargez deux ou trois modèles compatibles avec votre mémoire, par exemple
ollama pull gemma4:12betollama pull qwen3.8:27b. - Dans Open WebUI, vous pouvez poser la même question à plusieurs modèles côte à côte et comparer les réponses.
- Évaluez la qualité, les erreurs et les temps de réponse, et faites voter ceux qui utiliseront vraiment l'IA.
Astuce : refaites le test tous les quelques mois. Les modèles progressent rapidement et, avec une installation locale, changer de modèle n'est qu'une question de téléchargement.
Quand se faire aider
Vous voulez tout dans un PDF à imprimer ou à transmettre à vos collègues ? Téléchargez gratuitement le guide complet : matériel, modèles, installation, sécurité et checklist en 20 points.
Un essai sur un ordinateur se fait en un après-midi. Le passer en production pour une entreprise est un autre travail : comptes et permissions par service, accès sécurisé à distance, sauvegardes, mises à jour, connexion aux logiciels de gestion et formation du personnel (utile aussi pour l'AI Act).
Si l'essai vous a convaincu et que vous voulez une installation fiable, écrivez-nous : nous partirons de ce que vous avez déjà testé. Le conseil Dabryx démarre à 100 € de l'heure.
Sources
- Ollama – bibliothèque de modèles
- Ollama – Gemma 4 (tailles et variantes)
- Google Open Source Blog – Gemma 4 sous licence Apache 2.0
- Ollama – Qwen3.8
- Ollama – Qwen3.6
- Ollama – gpt-oss
- Sapienza NLP – Minerva-7B (Hugging Face)
- Almawave – Velvet-14B (Hugging Face)
- Evalita-LLM leaderboard (modèles évalués en italien)
- The Decoder – Llama 4 et les restrictions pour les entreprises de l'UE
Questions fréquentes
Quel est le meilleur modèle d'IA locale en italien ?
Il n'y a pas de vainqueur absolu : cela dépend de la mémoire, des tâches et de la vitesse souhaitée. En septembre 2026, Qwen3.8 27B et Gemma 4 sont d'excellents points de départ pour une entreprise italienne, tous deux sous licence Apache 2.0.
Les modèles open peuvent-ils être utilisés gratuitement en entreprise ?
Beaucoup, oui : ceux sous licence Apache 2.0 ou MIT peuvent être utilisés commercialement sans frais de licence. D'autres ont des licences avec des restrictions, par exemple pour les entreprises européennes ou pour l'usage commercial : il faut vérifier modèle par modèle.
À quelle fréquence faut-il changer de modèle ?
Mieux vaut réévaluer tous les quelques mois. Avec une installation locale, le changement est simple : on télécharge le nouveau modèle, on le teste sur les mêmes questions et on ne le met à disposition que s'il est vraiment meilleur.
Vous voulez une estimation pour votre entreprise ?
Dites-nous combien de personnes utiliseront l'IA et pour quoi faire : nous vous dirons quelle configuration il vous faut.
Délais de réponse
Sous 2 heures les jours ouvrés (9h00–18h00) pour les clients sous contrat d'assistance.
Conseil IA
À partir de 100 € de l'heure, sur les serveurs ou les Mac de votre entreprise.
Où nous travaillons
Dans toute l'Italie, à distance et sur site.