IA privada con datos empresariales: guía de seguridad
Usar IA con datos empresariales de forma segura requiere más que contratar una herramienta “privada”. Debes saber qué información se envía, dónde se procesa, cuánto se retiene, quién puede verla y qué acciones puede ejecutar. Una arquitectura con RAG, control de acceso, cifrado, registros y supervisión permite obtener valor sin entregar permisos indiscriminados.
La expresión IA privada con datos de empresa puede significar varias cosas: una instancia con condiciones empresariales, un modelo desplegado en infraestructura controlada o una aplicación que consulta repositorios internos. No asumas que “privado” equivale a “sin riesgo”.
Comienza por clasificar la información
No conectes una carpeta completa antes de conocer su contenido. Crea categorías:
- Pública.
- Interna.
- Confidencial.
- Datos personales.
- Datos sensibles.
- Secretos, credenciales y llaves.
Define qué categorías puede usar cada caso. Un asistente de marketing no necesita remuneraciones. Un agente de soporte no necesita todas las carpetas legales.
¿Qué aporta RAG?
RAG busca contenido relevante y lo incorpora al contexto del modelo para generar una respuesta. Permite trabajar con información privada o actualizada sin reentrenar el modelo.
Sus ventajas incluyen respuestas basadas en fuentes y actualización del conocimiento al reindexar documentos. Pero RAG no es un control de seguridad por sí solo. Si el índice ignora permisos, el agente puede recuperar información que el usuario nunca debió ver.
Controles esenciales
Identidad
Integra inicio de sesión corporativo y evita cuentas compartidas. El sistema debe conocer quién pregunta.
Autorización
Filtra documentos y herramientas según rol, área, cliente o proyecto. Verifica permiso en cada consulta.
Mínimo privilegio
Entrega solo las acciones necesarias. Un agente que responde políticas no necesita acceso de escritura al ERP.
Cifrado
Protege datos en tránsito y almacenamiento. Administra llaves, rotación y secretos fuera del código.
Retención
Define cuánto se conservan prompts, respuestas, archivos y registros. Guardar todo “por si acaso” aumenta exposición.
Auditoría
Registra accesos y acciones, pero aplica enmascaramiento y permisos sobre los propios logs.
Prevención de fuga
Detecta información sensible, limita exportaciones y evita incluir secretos en prompts. Considera reglas DLP cuando corresponda.
Revisa el contrato con el proveedor
Antes de enviar datos, pregunta:
- ¿Se utilizan para entrenamiento?
- ¿Dónde se procesan y almacenan?
- ¿Qué subencargados participan?
- ¿Cuál es la retención?
- ¿Cómo se eliminan?
- ¿Qué cifrado existe?
- ¿Quién accede para soporte?
- ¿Cómo se notifican incidentes?
- ¿Se puede auditar uso?
- ¿Qué ocurre al terminar el contrato?
La respuesta depende del servicio y plan contratado. No generalices una política de consumo a una modalidad empresarial ni al revés.
Amenazas específicas de agentes
OWASP incluye entre los riesgos de aplicaciones de IA generativa la inyección de prompts y la divulgación de información sensible.
Inyección de prompts
Un usuario o documento intenta cambiar las instrucciones del agente. El contenido externo debe tratarse como no confiable. Nunca permitas que un texto decida permisos.
Divulgación sensible
El modelo puede exponer información presente en contexto, registros o herramientas. Limita el contenido antes de enviarlo y revisa resultados.
Exceso de agencia
Un agente con demasiadas herramientas puede producir daños aunque la respuesta textual parezca correcta. Restringe funciones, parámetros y frecuencia.
Dependencia excesiva
Una respuesta coherente puede ser falsa. Exige fuentes, reglas de abstención y revisión para decisiones relevantes.
Trazabilidad sin vigilancia innecesaria
La organización necesita saber qué hizo el agente. Puede registrar identificador de usuario, herramienta, documento, versión, hora y resultado. No siempre necesita conservar la conversación completa.
Aplica minimización: almacena lo necesario para seguridad, medición y cumplimiento. Define acceso y borrado. La trazabilidad también debe respetar privacidad.
Un modelo de gobierno práctico
NIST propone gobernar, mapear, medir y gestionar riesgos de IA:
- Gobernar: responsables, políticas y tolerancia al riesgo.
- Mapear: uso, personas afectadas, datos y contexto.
- Medir: precisión, seguridad, sesgo, costo y fallas.
- Gestionar: priorizar riesgos, aplicar controles y monitorear.
No es una certificación automática. Es una estructura voluntaria para ordenar decisiones.
Pruebas necesarias
Prueba preguntas normales y ataques:
- Solicitudes de otro cliente.
- Datos sensibles.
- Instrucciones escondidas en documentos.
- Preguntas sin evidencia.
- Exportación masiva.
- Uso de herramientas fuera de alcance.
- Cambio de rol.
- Revocación de acceso.
- Caída de servicios.
- Eliminación de datos.
También evalúa falsos positivos. Un control excesivo puede hacer inutilizable la solución.
Señales de una implementación insegura
- Todos los usuarios ven el mismo índice.
- Se comparten credenciales.
- No existe inventario de fuentes.
- El agente escribe directamente en producción.
- Se guardan prompts sin retención definida.
- Nadie revisó términos del proveedor.
- No existe procedimiento de incidente.
- La demostración reemplazó las pruebas.
Preguntas frecuentes
¿RAG evita que mis datos se usen para entrenar?
RAG describe cómo se recupera información, no la política del proveedor. Debes revisar contrato, configuración y servicio utilizado.
¿Es necesario alojar el modelo en servidores propios?
No siempre. Una nube empresarial puede cumplir requisitos si ofrece controles adecuados. Para casos especiales puede justificarse un despliegue más aislado.
¿Se pueden usar datos personales?
Puede ser posible con base lícita, finalidad, medidas de seguridad y derechos del titular. La evaluación debe considerar la normativa chilena y asesoría jurídica cuando corresponda.
Revisa datos y controles antes del piloto
Syscode puede inventariar fuentes, permisos, proveedores y riesgos para proponer una arquitectura segura. Solicita una revisión de datos e IA antes de conectar documentos o sistemas productivos.
Fuentes consultadas
Equipo Syscode
Syscode — Tecnología a medida para empresas que quieren crecer.
Conversemos sobre el proceso, sistema o desafío que necesitas mejorar
Una conversación inicial de 30 minutos, sin compromiso. Revisamos tu caso y te proponemos alternativas concretas de solución.
¿Prefieres el correo? Escríbenos a contacto@syscode.cloud o llámanos al +56 9 7570 8390