Blog · 24 de septiembre de 2026 · 9 min de lectura

Cómo crear una IA local en la empresa: guía paso a paso (2026)

Una IA local no es un proyecto de investigación: con las herramientas de código abierto actuales puedes tener un asistente parecido a ChatGPT en un ordenador de la empresa en pocas horas. Estos son los pasos que usamos también nosotros, con los comandos y las trampas que hay que evitar.

En resumen: hacen falta tres piezas. 1) Ollama, el programa que descarga y ejecuta los modelos (versión estable a 24 de septiembre de 2026: 0.34.4). 2) Un modelo abierto adecuado a la memoria del ordenador, por ejemplo Gemma 4 12B (7,6 GB) o Qwen3.8 27B (18 GB). 3) Open WebUI, la interfaz de chat con cuentas personales (versión 0.11.4). Se instalan en este orden, y la IA se hace accesible a los compañeros solo desde la red interna o mediante VPN, nunca directamente desde internet.

Gratis Guía PDF · 9 páginas · actualizada a septiembre de 2026

¿Quieres una IA solo tuya, dentro de la empresa? Te explicamos cómo.

  • Qué hardware hace falta de verdad (Mac o servidor) y cuánto cuesta
  • Los mejores modelos en italiano y cómo instalarlos paso a paso
  • Seguridad, RGPD y una checklist de 20 puntos
Descarga la guía gratis →

La recibes por email en pocos segundos. Sin spam.

Qué necesitas antes de empezar

La regla más útil: el modelo debe caber entero en memoria. En un Mac con Apple Silicon cuenta la memoria unificada; en un PC o servidor con tarjeta gráfica cuenta la memoria de la GPU (VRAM). Como orden de magnitud, con los modelos comprimidos a 4 bits que descarga Ollama:

Memoria disponibleQué funciona bienEjemplo
16 GBModelos pequeños, tareas sencillas, pruebasGemma 4 12B (7,6 GB)
32 GBModelos medianos, buena calidad en italianoQwen3.8 27B (18 GB), Gemma 4 26B (19 GB)
64 GB o másModelos grandes, documentos largos, varios usuariosgpt-oss 120B (65 GB)

Deja siempre margen: además del modelo, se necesita memoria para el sistema operativo y para el contexto (el texto que la IA tiene presente en una conversación), que crece con documentos largos y usuarios simultáneos. Para elegir el modelo, encontrarás una comparativa en la guía de modelos para el italiano.

Paso 1 – Instala Ollama

Ollama descarga los modelos, los carga en memoria y los expone mediante una interfaz de programación (API) en el puerto 11434.

  • macOS (14 Sonoma o posterior): descarga Ollama.dmg desde ollama.com/download y arrastra la app a Aplicaciones. En los Mac con chip M usa la GPU integrada.
  • Windows (10 22H2 o posterior): descarga y ejecuta OllamaSetup.exe desde la misma página.
  • Linux: el script oficial instala Ollama como servicio del sistema.
curl -fsSL https://ollama.com/install.sh | sh

Para comprobar que funciona, abre el terminal y escribe ollama --version.

Paso 2 – Descarga y prueba un modelo

Empieza con un modelo que quepa holgadamente en tu memoria. Por ejemplo, en un ordenador con 16 GB:

ollama pull gemma4:12b
ollama run gemma4:12b

Se abre un chat en el terminal: haz alguna pregunta en italiano sobre tu trabajo. Otros comandos útiles:

  • ollama list: los modelos descargados y cuánto espacio ocupan.
  • ollama ps: los modelos cargados en memoria en este momento, y si usan la GPU.
  • ollama rm nome-modello: elimina un modelo que no usas.

Consejo: prueba dos o tres modelos con las mismas preguntas reales (un email que redactar, un documento que resumir). Es la forma más rápida de entender qué calidad necesitas y, por tanto, qué hardware.

Paso 3 – Instala la interfaz de chat (Open WebUI)

El chat en el terminal sirve para probar, pero tus compañeros necesitan una interfaz como ChatGPT, con cuentas personales e historial. Open WebUI se instala con Docker; con Ollama ya activo en el mismo ordenador, el comando de la documentación oficial es:

docker run -d -p 3000:8080 \
  --add-host=host.docker.internal:host-gateway \
  -v open-webui:/app/backend/data \
  -e WEBUI_SECRET_KEY=la-tua-chiave-segreta \
  --name open-webui --restart always \
  ghcr.io/open-webui/open-webui:main

Genera la clave secreta con openssl rand -hex 32 en lugar de inventarla. Después abre http://localhost:3000 en el navegador.

  1. La primera cuenta creada se convierte en administrador: créala tú enseguida, antes de dar la dirección a nadie.
  2. Las cuentas creadas después quedan pendientes hasta que un administrador las aprueba.
  3. Con los grupos puedes decidir quién ve qué modelos y qué bases documentales.

Si no quieres usar Docker, para uso personal existe también LM Studio, una app de escritorio gratuita también para uso profesional interno.

Paso 4 – Hazla accesible a tus compañeros, de forma segura

Es el paso en el que más errores se cometen. Tres reglas:

  1. Nunca expongas Ollama a internet. Ollama no tiene autenticación: cualquiera que llegue al puerto 11434 puede usar tus modelos. En febrero de 2026, los investigadores de LeakIX encontraron unas 12.000 instancias de Ollama accesibles desde internet. Si Open WebUI funciona en el mismo ordenador, Ollama puede escuchar solo en local (es la configuración predeterminada).
  2. Haz que tus compañeros pasen por Open WebUI, que tiene cuentas y permisos, no por la API de Ollama.
  3. Para acceder desde fuera de la oficina usa una VPN (por ejemplo WireGuard o Tailscale), no una apertura de puertos en el router.

Cuidado con Docker en Linux: los puertos publicados por Docker pueden saltarse las reglas del firewall del sistema (como ufw). Si el servidor tiene una dirección pública, publica el puerto solo en la dirección interna, por ejemplo -p 127.0.0.1:3000:8080 detrás de un proxy inverso, o revisa las reglas con atención.

Paso 5 – Copias de seguridad, actualizaciones y licencias

  • Copias de seguridad: las cuentas, chats y documentos de Open WebUI están en el volumen Docker open-webui. Inclúyelo en la copia de seguridad de la empresa.
  • Actualizaciones: Ollama y Open WebUI publican nuevas versiones cada pocas semanas. Actualiza después de leer las notas de la versión y con una copia de seguridad reciente.
  • Licencias: comprueba la licencia de cada modelo antes del uso comercial. Gemma 4, Qwen3.8 y gpt-oss usan Apache 2.0. Open WebUI tiene una licencia propia: por encima de 50 usuarios al mes no puedes eliminar la marca "Open WebUI" sin una licencia enterprise.

Los errores más comunes

  • Modelo demasiado grande: si no cabe en memoria se vuelve lentísimo. Mejor un modelo mediano rápido que uno grande inutilizable.
  • Contexto demasiado corto: en GPU con menos de 24 GB, Ollama usa por defecto un contexto de 4.096 tokens, que corta los documentos largos. Auméntalo en los ajustes del modelo (parámetro num_ctx), teniendo en cuenta que consume memoria.
  • Expectativas de ChatGPT: los modelos locales son excelentes para tareas de oficina, pero los modelos en la nube más grandes siguen siendo superiores en razonamientos muy complejos. Elige los casos de uso en consecuencia.
  • Ninguna norma de uso: decide antes qué datos se pueden subir y quién puede ver qué, y comunícalo a tus compañeros.

Cuándo conviene pedir ayuda

¿Quieres todo en un PDF para imprimir o pasar a tus compañeros? Descarga gratis la guía completa: hardware, modelos, instalación, seguridad y checklist de 20 puntos.

Una prueba en un ordenador se hace en una tarde. Llevarla a producción para una empresa es otro trabajo: cuentas y permisos por departamento, acceso remoto seguro, copias de seguridad, actualizaciones, conexión con los programas de gestión y formación del personal (útil también para el AI Act).

Si la prueba te ha convencido y quieres una instalación fiable, escríbenos: partimos de lo que ya has probado. La consultoría de Dabryx empieza desde 100 € la hora.

Preguntas frecuentes

¿Cuánto tiempo se tarda en crear una IA local?

Para una prueba en un ordenador bastan unas pocas horas: instalación de Ollama, descarga de un modelo y de Open WebUI. Una instalación empresarial con cuentas, VPN, copias de seguridad, documentos conectados y formación suele requerir algunos días de trabajo.

¿Hace falta saber programar?

Para la prueba no: bastan unos pocos comandos que copiar. Para el uso en la empresa se necesitan conocimientos de sistemas (Docker, red, copias de seguridad, seguridad), que puedes tener en casa o confiar a un proveedor.

¿Puedo usar un ordenador que ya tengo?

Sí, si tiene suficiente memoria para el modelo elegido. Un Mac con chip M y 16 GB ejecuta modelos pequeños; para modelos de mayor calidad en italiano se necesitan 32 GB o más.

¿Quieres una estimación para tu empresa?

Cuéntanos cuántas personas usarán la IA y para qué: te diremos qué configuración necesitas.

Tiempos de respuesta

En menos de 2 horas en días laborables (9:00–18:00) para clientes con contrato de asistencia.

Consultoría de IA

Desde 100 € la hora, en los servidores o Mac de tu empresa.

Dónde trabajamos

En toda Italia, en remoto y en tus instalaciones.