Hoy en día todos los modelos de lenguaje son europeos. Pregunta un poco más y te topas con un centro de datos en Fráncfort operado por una empresa de Seattle. Quien tome decisiones sobre IA generativa este otoño oirá en todas partes los mismos tres términos: abierto, europeo, soberano. ¿Qué significan esas palabras? Lo decide el propio proveedor. Un informe del organismo de investigación neerlandés TNO, publicado en agosto de 2026, pone ahora una vara de medir clara junto a ellas [1, 2].
Por qué «abierto» y «europeo» aparecen de repente en todas partes
TNO investigó, por encargo del Ministerio del Interior neerlandés (BZK), qué significan realmente «abierto» y «europeo» en los modelos de lenguaje [1, 2]. El motivo es geopolítico. La Estrategia de Digitalización neerlandesa exige más control sobre las dependencias digitales. Los modelos de lenguaje son la capa más reciente de una cadena de software que ya está en gran parte fuera de Europa. La conclusión es tajante. No existe una definición unívoca de modelo de lenguaje «abierto», y «europeo» puede interpretarse de al menos cuatro maneras [1]. Los proveedores lo aprovechan con astucia [1]. TNO lo llama «open-washing», «Europe-washing» y «soberanía-washing», y aconseja a las administraciones fijar sus propias definiciones de trabajo antes de iniciar la contratación [1]. Es una escena conocida en ayuntamientos y organismos públicos. El comprador pregunta si el modelo es abierto; el proveedor asiente. El CISO pregunta dónde están los datos; silencio. Con las preguntas siguientes diriges tú esa conversación.
Abierto es un espectro, no un interruptor
TNO distingue cinco grados de apertura, de los que tres son frecuentes en la práctica [1]:
- Modelo cerrado: solo lo usas a través de una API. Tamaño, datos de entrenamiento y tratamiento de datos permanecen en secreto (por ejemplo GPT de OpenAI) [1].
- Modelo open-weight: recibes los pesos del modelo [1]. Puedes ejecutarlo y ajustarlo tú mismo, pero no ves los datos de entrenamiento ni el proceso (como Llama y Mistral) [1].
- Modelo totalmente abierto: publica también los datos de entrenamiento y el código fuente (como el suizo Apertus) [1].
El matiz crucial está en la categoría intermedia. Open-weight es lo que la mayoría de los modelos «abiertos» son en realidad. Eso tiene valor: puedes alojarlo tú mismo y mantener el control de tus datos. Pero sigues sin saber exactamente qué contiene. Si un proveedor llama «open source» a su modelo, casi siempre quiere decir open-weight. Pregunta 1: ¿qué grado de apertura tiene exactamente este modelo y qué puedo comprobar yo mismo?
Un modelo de lenguaje europeo son cuatro preguntas, no una casilla
En el informe, TNO utiliza una tabla de valoración con cuatro criterios independientes [1]:
- Origen del proveedor: ¿la organización está bajo jurisdicción del EEE o bajo legislación extranjera como la CLOUD Act estadounidense [1]?
- Ubicación de los datos: ¿dónde se almacenan y tratan los datos [1]?
- Infraestructura: ¿en qué hardware se ejecuta el modelo [1]?
- Base lingüística: ¿se ha entrenado el modelo de forma demostrable en lenguas europeas, incluida la tuya [1]?
Un modelo de una empresa europea en una nube estadounidense no es soberano, afirma TNO con toda claridad [1]. A la inversa, un modelo europeo abierto no garantiza nada si el hardware viene de Estados Unidos [1]. Además, un modelo todavía no es una aplicación: el chatbot que usas se compone de toda una cadena [1]. Plantea, por tanto, estas cuatro preguntas a toda la cadena. ¿Dónde está la organización? ¿Dónde están los datos? ¿Dónde se ejecuta? ¿Se entrenó el modelo deliberadamente en tu idioma o lo conoce por casualidad? Un proveedor que ofrece claridad en los cuatro puntos es raro. Un proveedor que duda en uno de ellos te muestra de inmediato dónde están los riesgos.
Nuestras propias decisiones y su lado oscuro
Un relato sobre decisiones claras solo funciona si ponemos nuestras propias cartas sobre la mesa. La plataforma de IA IRIS de ASE Cloud Services funciona con Mistral Small, un modelo open-weight con licencia Apache 2.0 de una empresa francesa. En las cuatro preguntas de TNO obtiene este resultado: proveedor en el EEE, almacenamiento de datos en nuestro propio entorno cloud en OVHcloud (Gravelines y Estrasburgo), infraestructura dentro de la UE y entrenamiento en lenguas europeas. Pero TNO también señala los riesgos de precisamente esta elección [1]. Mistral ofrece modelos open-weight con visibilidad limitada de los datos de entrenamiento, y existe un riesgo permanente de adquisición por inversores no europeos [1]. Ese riesgo se absorbe en la arquitectura que rodea al modelo. El propio modelo se ha hecho sustituible. La base de conocimiento del cliente está en una capa RAG aislada, no se entrena con datos de clientes y todo descansa sobre estándares abiertos. Si cambias de modelo, la base de conocimiento se queda donde está. Como el modelo es open-weight, el cliente elige el entorno de ejecución. Entregamos la aplicación en cuatro variantes: a través de la API de Mistral, en nuestra nube de la UE, en el entorno cloud del propio cliente o en sus instalaciones. Esa decisión corresponde a la organización, no al proveedor. Así evitas la dependencia de un proveedor. Quien mantiene bajo su control los datos, el alojamiento y la capa de aplicación cambia sin problemas en cuanto aparece un modelo mejor.
El primer paso más pequeño
No hace falta migrar de inmediato. Lleva estas cuatro preguntas a tu próxima reunión con un proveedor y plantéaselas también a tus proveedores actuales. Registra las respuestas con sus fuentes. Eso es, de inmediato, el expediente para la dirección, compras y los supervisores, y sienta la base de la definición de trabajo que recomienda TNO [1]. La tabla de valoración de TNO está disponible públicamente en open.overheid.nl [2]. ¿Quieres aplicar estas preguntas a tu situación concreta? En una consulta gratuita de 30 minutos repasamos las opciones. Consulta nuestros servicios de consultoría en IA para más información. Si primero quieres comprobar que tu gobernanza de la IA puede sostener la elección de un modelo, la Evaluación GAP lo determina en 40 a 60 horas. Y si quieres que el modelo elegido trabaje directamente sobre tus propios documentos, eso es exactamente lo que hace el Asistente de IA para el puesto de trabajo.
Fuentes
- TNO (2026). Open en Europese taalmodellen bij de overheid: definities en afwegingen (Modelos de lenguaje abiertos y europeos en la administración: definiciones y consideraciones). Informe TNO-2026-17545, agosto de 2026 (en neerlandés). https://open.overheid.nl/details/6ba92fae-f8e6-48f0-a5d2-bf334b14ac5e
- Digitale Overheid (2026). Verkenning inzet open en Europese taalmodellen bij overheid, 1 de septiembre de 2026 (en neerlandés). https://www.digitaleoverheid.nl/nieuws/verkenning-inzet-open-en-europese-taalmodellen-bij-overheid/



