Fuente externa
Documentos, emails o webs pueden contener una prompt injection indirecta.
Atlas, gratis para siempre. Regístrate y actívalo en tu Suite hasta el 31 de diciembre de 2026, inclusive.
ActivarServicios · Seguridad en IA
Las empresas están conectando inteligencia artificial con documentos, datos, aplicaciones y procesos reales. Mikodawa diseña, revisa y protege esos sistemas para que modelos, agentes y automatizaciones trabajen dentro de límites claros, auditables y controlados.
Dos superficies, un mismo problema
La seguridad no puede confiar únicamente en el comportamiento del modelo. También debe existir en identidades, permisos, aplicaciones, herramientas, datos y acciones.
Analizamos qué puede ver la IA, qué puede hacer, qué datos puede procesar y dónde deben existir límites.
Una aplicación con IA une modelos probabilísticos e infraestructura tradicional. La arquitectura debe proteger ambas partes.
La nueva superficie de ataque
El riesgo ya no termina en un prompt. Una instrucción puede viajar desde contenido no confiable hasta una herramienta capaz de actuar sobre sistemas reales.
Documentos, emails o webs pueden contener una prompt injection indirecta.
Datos confidenciales, poisoning o aislamiento incorrecto entre usuarios.
Manipulación, jailbreaks o exposición de información y del system prompt.
APIs, conectores y MCP convierten respuestas en capacidad operativa.
Una salida del modelo nunca debería equivaler por sí sola a autorización.
Credenciales, archivos y propiedad intelectual requieren controles propios.
Qué podemos hacer
Combinamos arquitectura, evaluación y pruebas. El alcance se adapta al estado del sistema y al riesgo de sus datos y acciones.
Inventario de modelos, agentes, datos, herramientas y conexiones para localizar superficies de ataque.
Diseño de aislamiento, permisos, scopes, validaciones, límites y autorización alrededor del modelo.
Revisión de herramientas disponibles, contexto recibido y consecuencias posibles de cada acción.
Pruebas controladas frente a instrucciones maliciosas directas, indirectas e ingeniería social contra agentes.
Acceso, segmentación, embeddings, recuperación, documentación maliciosa y contaminación de fuentes.
Autenticación, OAuth, tokens, claves y acceso entre servicios sin exponer secretos al modelo.
Validación antes de enviar contenido generado a navegadores, comandos, bases de datos o APIs.
Registro de actividad, decisiones, acciones, errores y anomalías con señales útiles para responder.
Escenarios adversariales, respuesta ante comportamientos inesperados y reducción continua del riesgo.
El trabajo también puede incorporar gobierno, responsabilidades, políticas de acceso, supply chain de modelos y respuesta ante incidentes.
Mínimo privilegio
Consultar una factura no exige acceso completo al ERP. Preparar un email no implica permiso para enviarlo. Recuperar documentación no requiere revelar las credenciales utilizadas para obtenerla.
Leer
Solo con alcance explícito
Modificar
Solo con alcance explícito
Ejecutar
Solo con alcance explícito
Compartir
Solo con alcance explícito
Defensa en profundidad
No colocamos un único filtro delante del modelo. Diseñamos controles independientes y verificables en cada punto relevante.
Metodología
Tratamos la seguridad como una disciplina continua: desde el mapa inicial hasta la observación del sistema en producción.
01
Entender arquitectura, procesos, modelos, datos y conexiones.
02
Identificar qué puede fallar, quién podría explotarlo y cuál sería el impacto.
03
Definir permisos, validación, aislamiento, confirmaciones y límites.
04
Probar el sistema con escenarios adversariales realistas y controlados.
05
Corregir vulnerabilidades y reducir la superficie de ataque.
06
Incorporar logging, seguimiento, gobierno y mejora continua.
Certificación Mikodawa EIA
Conozca el proceso formal de evaluación, evidencias, auditoría y certificación para un alcance definido.
Cuéntanos qué modelos, agentes, automatizaciones o sistemas utiliza su organización. Analizaremos dónde existe riesgo y cómo construir una arquitectura preparada para crecer.