Blog · 24 de septiembre de 2026 · 7 min de lectura

Qué modelo de IA usar en local para el italiano (septiembre de 2026)

El modelo es el "cerebro" de la IA local y la decisión más importante después del hardware. Los modelos abiertos salen a un ritmo continuo: estos son los que evaluamos hoy para las empresas italianas, con los criterios para elegir.

En resumen: a 24 de septiembre de 2026, para una empresa que trabaja en italiano los modelos abiertos más interesantes son Qwen3.8 27B (18 GB) y Gemma 4 (12B de 7,6 GB, 26B de 19 GB), ambos con licencia Apache 2.0, que permite el uso comercial. Con 64 GB o más de memoria se puede usar gpt-oss 120B (65 GB). Antes de elegir, prueba dos o tres modelos con tus preguntas reales: la clasificación general importa menos que el resultado con tus documentos.

Gratis Guía PDF · 9 páginas · actualizada a septiembre de 2026

¿Quieres una IA solo tuya, dentro de la empresa? Te explicamos cómo.

  • Qué hardware hace falta de verdad (Mac o servidor) y cuánto cuesta
  • Los mejores modelos en italiano y cómo instalarlos paso a paso
  • Seguridad, RGPD y una checklist de 20 puntos
Descarga la guía gratis →

La recibes por email en pocos segundos. Sin spam.

Los criterios que de verdad importan

  1. Memoria: el modelo debe caber entero en la memoria del ordenador, con margen para el contexto.
  2. Calidad en italiano: redacción correcta, comprensión de documentos técnicos y administrativos, terminología del sector.
  3. Velocidad: una respuesta que llega al cabo de un minuto no se usará. Los modelos MoE (mixture of experts) activan solo una parte de los parámetros y son más rápidos a igual tamaño.
  4. Licencia: debe permitir el uso comercial en tu empresa y en la Unión Europea.
  5. Funciones extra: lectura de imágenes y PDF escaneados (visión), contexto largo para documentos extensos.

Los modelos abiertos que probar hoy

ModeloDescarga en Ollama (4 bits)LicenciaCuándo elegirlo
Gemma 4 12B7,6 GBApache 2.0Ordenador con 16 GB, tareas de oficina, pruebas
Gemma 4 26B (MoE)19 GBApache 2.0Buen equilibrio entre calidad y velocidad con 32 GB
Qwen3.8 27B18 GBApache 2.0Alta calidad con 32 GB, contexto largo, visión
Qwen3.6 35B (MoE)23 GBApache 2.0Respuestas rápidas en equipos de 32–48 GB
gpt-oss 20B14 GBApache 2.0Razonamiento en equipos de 16–24 GB
gpt-oss 120B65 GBApache 2.0Mac o servidor con 96 GB o más
Mistral Small 24B14 GBApache 2.0Alternativa europea compacta

Los tamaños son los de los archivos descargados desde Ollama y son una buena referencia para la memoria mínima; en uso se necesita algo más. En Mac, muchos modelos tienen también una variante -mlx optimizada para Apple Silicon (por ejemplo qwen3.8:27b-mlx).

¿Y los modelos italianos?

Existen modelos entrenados con muchos textos en italiano, como Minerva (Sapienza NLP, 7B, Apache 2.0) y Velvet (Almawave, 14B y 2B, Apache 2.0). Son proyectos importantes y útiles para tareas específicas, pero para un asistente de oficina genérico hoy los modelos multilingües más grandes citados arriba suelen dar mejores resultados, también en italiano.

Cuidado con las licencias: algunos modelos italianos recientes se publican solo para uso no comercial. Lee siempre la licencia en la página del modelo antes de ponerlo en producción.

Para una comparación objetiva existen clasificaciones dedicadas al italiano, como la Evalita-LLM leaderboard.

Licencias: un detalle importante para las empresas europeas

No todos los modelos "open" son iguales. Los que tienen licencia Apache 2.0 o MIT se pueden usar comercialmente sin restricciones particulares. Otros tienen licencias propias: por ejemplo, la licencia de Llama 4 excluye a las empresas con sede en la Unión Europea de los derechos sobre las funciones multimodales. Para una empresa italiana es un motivo más para preferir modelos con licencias estándar.

Cómo hacer la prueba en la práctica

  1. Prepara 10 preguntas reales: dos correos que redactar, un documento que resumir, una pregunta sobre un procedimiento interno, un texto que traducir, un dato que extraer de un PDF.
  2. Descarga dos o tres modelos compatibles con tu memoria, por ejemplo ollama pull gemma4:12b y ollama pull qwen3.8:27b.
  3. En Open WebUI puedes hacer la misma pregunta a varios modelos en paralelo y comparar las respuestas.
  4. Evalúa la calidad, los errores y los tiempos de respuesta, y haz que voten quienes de verdad usarán la IA.

Consejo: repite la prueba cada pocos meses. Los modelos mejoran rápidamente y, con una instalación local, cambiar de modelo es cuestión de una descarga.

Cuándo conviene pedir ayuda

¿Quieres todo en un PDF para imprimir o pasar a tus compañeros? Descarga gratis la guía completa: hardware, modelos, instalación, seguridad y checklist de 20 puntos.

Una prueba en un ordenador se hace en una tarde. Llevarla a producción para una empresa es otro trabajo: cuentas y permisos por departamento, acceso remoto seguro, copias de seguridad, actualizaciones, conexión con los programas de gestión y formación del personal (útil también para el AI Act).

Si la prueba te ha convencido y quieres una instalación fiable, escríbenos: partimos de lo que ya has probado. La consultoría de Dabryx empieza desde 100 € la hora.

Preguntas frecuentes

¿Cuál es el mejor modelo de IA local en italiano?

No hay un ganador absoluto: depende de la memoria, las tareas y la velocidad necesaria. En septiembre de 2026, Qwen3.8 27B y Gemma 4 son excelentes puntos de partida para una empresa italiana, ambos con licencia Apache 2.0.

¿Los modelos abiertos se pueden usar gratis en la empresa?

Muchos sí: los que tienen licencia Apache 2.0 o MIT se pueden usar comercialmente sin coste de licencia. Otros tienen licencias con limitaciones, por ejemplo para las empresas europeas o para el uso comercial: hay que comprobarlo modelo por modelo.

¿Cada cuánto conviene cambiar de modelo?

Conviene reevaluarlo cada pocos meses. Con una instalación local el cambio es sencillo: se descarga el nuevo modelo, se prueba con las mismas preguntas y se pone a disposición solo si es realmente mejor.

¿Quieres una estimación para tu empresa?

Cuéntanos cuántas personas usarán la IA y para qué: te diremos qué configuración necesitas.

Tiempos de respuesta

En menos de 2 horas en días laborables (9:00–18:00) para clientes con contrato de asistencia.

Consultoría de IA

Desde 100 € la hora, en los servidores o Mac de tu empresa.

Dónde trabajamos

En toda Italia, en remoto y en tus instalaciones.