Dónde viven tus datos cuando usas IA: nube, soberana o local

· · Summum IA

Estado. El Plan IA360 se anunció el 21 de septiembre de 2026 y todavía no tiene convocatoria ni bases publicadas; sus fechas están sujetas a desarrollo normativo. Lo que sigue no depende de ninguna ayuda: es la pregunta que te toca a ti resolver cada vez que alguien de tu empresa abre una herramienta de IA.

El proyecto de Real Decreto de centros de datos del Plan IA360, que el plan describe como sometido a audiencia pública, regula «los requisitos de sostenibilidad energética y medioambiental, de resiliencia y de soberanía digital» de las grandes instalaciones que sostienen el cómputo del país, con aprobación prevista para octubre de 2026 (Plan IA360, proyecto tractor 2). Es una norma a escala de infraestructura nacional, pensada para las instalaciones de mayor tamaño, no para cualquier oficina con un servidor. A escala de tu empresa, la expresión soberanía digital se traduce en algo mucho más concreto y mucho más inmediato: cuando alguien de tu equipo pega un documento en una IA, ¿dónde acaba ese texto?

Tres sitios donde puede vivir un dato cuando usas IA

Una nube pública genérica, sin contrato corporativo. Es la versión gratuita de un chat de IA que cualquiera puede abrir en el navegador. El dato sale del perímetro de la empresa hacia un servicio cuyos términos de uso rara vez se han leído, sin que quede registro de quién lo mandó ni de qué contenía. Es la forma más habitual — y menos visible — en la que información confidencial deja de estar bajo tu control.

Una nube con contrato corporativo y residencia acotada. El proveedor procesa el dato bajo un acuerdo que fija dónde se aloja —dentro de la Unión Europea, por ejemplo—, cuánto tiempo se retiene y si se usa para entrenar otros modelos. El dato sigue en infraestructura de un tercero, pero con reglas escritas y exigibles, no con las condiciones genéricas de un servicio gratuito.

Infraestructura propia o soberana. El modelo se despliega dentro de la red de la empresa, y el dato no sale de ahí en ningún momento. Es la opción con más control y, casi siempre, con más coste y complejidad operativa: alguien tiene que mantener esa infraestructura, no solo usarla.

El riesgo está en no saber por dónde sale el dato, no en usar IA

Cuando alguien de tu equipo pega un contrato, una base de clientes o el código fuente en una IA gratuita, esos datos salen de tu perímetro sin que nadie lo sepa — no suele ser mala fe, es que la herramienta resuelve el problema más rápido que el canal oficial. Usar IA no es el problema; usarla sin ningún control sobre qué sale, con quién y bajo qué condición, sí lo es. Formar a la plantilla sirve, entre otras cosas, para saber distinguir estos tres escenarios antes de pegar nada. Un AI Gateway corporativo es la capa que se pone entre tu equipo y los modelos de IA: filtra qué datos pueden salir, decide qué herramientas se permiten por rol o departamento y registra cada consulta, en lugar de dejar la decisión al criterio de cada persona en cada momento.

Cuando el proyecto es tuyo, la pregunta se responde en el diseño, no después

Si el proyecto no es "que alguien use un chat", sino un sistema que responde preguntas sobre tus propios documentos —contratos, manuales, procedimientos—, la ubicación del dato deja de ser una política de uso y pasa a ser una decisión de arquitectura. En un RAG bien construido, el vector store respeta los permisos del sistema de origen y cada respuesta cita el documento concreto del que sale, de modo que quien pregunta puede comprobarlo. Esa trazabilidad —qué documento, qué página, quién puede verlo— solo funciona si se decide desde el principio dónde vive cada pieza del sistema, no como un parche que se añade cuando ya hay un incidente que explicar.

Preguntas frecuentes

¿Cómo sé qué herramientas de IA usa ya mi equipo, aunque nadie las haya autorizado?

Sin un canal controlado, normalmente no lo sabes hasta que hay un incidente. Un AI Gateway corporativo registra qué herramientas se usan y qué datos pasan por ellas; sin esa capa, la única forma de averiguarlo es preguntar equipo por equipo, y lo habitual es que la respuesta esté incompleta.

¿Qué significa exactamente que un modelo esté "en la UE"?

Que el proveedor procesa y aloja el dato en centros situados dentro de la Unión Europea, bajo un contrato que lo fija por escrito. No es lo mismo que una declaración genérica de cumplimiento: conviene pedir esa condición explícita antes de firmar, no darla por hecha por el nombre del proveedor.

¿La IA soberana o on-premise es solo para grandes empresas?

Es la opción con más coste de mantenimiento, y por eso suele reservarse para los casos con datos más sensibles o con exigencias normativas concretas, no para todos los usos de una empresa por igual. Muchos proyectos de pyme funcionan bien con una nube corporativa con residencia acotada, sin necesidad de esa inversión.

¿Qué pasa si un empleado ya ha pegado datos de un cliente en una IA gratuita?

Conviene tratarlo como cualquier otro incidente de fuga de datos: identificar qué información salió, si incluía datos personales y si corresponde notificarlo según el RGPD, y a partir de ahí cerrar la vía por la que ocurrió — normalmente, poniendo un canal corporativo controlado en lugar de dejarlo al criterio individual.

Para seguir

La soberanía digital que persigue el Real Decreto de centros de datos es un asunto de país. La tuya se decide en el contrato con cada proveedor y en el diseño de cada sistema. El resto del plan, en la guía completa del Plan IA360, y cómo una pyme podrá probar IA con sus propios datos, en la Red NEURONA.