Auditorías del sistema de IA y de la gestión relacionada con él.

Auditorías independientes para sistemas de IA y LLM: desde pruebas adversarias de «red teaming» hasta revisiones de sistemas de gestión según la norma ISO/IEC 42001, pasando por evaluaciones de conformidad con la Ley de IA de la UE.

Basadas en nuestro marco STARED, revisadas por pares —entre tres y cuatro especialistas— y alineadas con las normas que realmente comprueban tus organismos reguladores y clientes.

Marcas internacionales que confían en AuditOne

De 5partes
Las dimensiones de STARED abarcan todo el ámbito de la auditoría de IA
3-4veces
Cada auditoría es revisada por especialistas independientes mediante un proceso de revisión por pares
2 de agosto de 26
Fecha de entrada en vigor de la Ley de la UE sobre la IA para los sistemas de alto riesgo
24h
Plazo de elaboración del presupuesto desde la primera llamada hasta la presentación del mismo
Nuestro marco de referencia

Los marcos de auditoría existentes no se diseñaron pensando en la IA. Nosotros hemos creado uno que sí lo está.

Los marcos tradicionales de seguridad y cumplimiento normativo pasan por alto la mayor parte de los aspectos que dificultan la auditoría de los sistemas de IA: los datos de entrenamiento, el comportamiento de los modelos, la deriva tras la implementación y la robustez ante ataques adversarios. STARED es nuestro marco de cinco dimensiones, diseñado específicamente para subsanar esa carencia.
STARED
UN MARCO DE CINCO DIMENSIONES PARA LAS AUDITORÍAS DE SISTEMAS DE IA
S
Seguridad
Seguridad de los modelos y de la infraestructura. Robustez ante ataques adversarios, inyección de prompts, extracción de modelos e integridad de la cadena de suministro de los pesos y las dependencias.
TA
Evaluación técnica
Rendimiento del modelo, calibración, evaluación frente a modelos de referencia y evaluaciones personalizadas, supervisión, detección de desviaciones y estrategia de reentrenamiento.
R
Normativa
Conformidad con la Ley de IA de la UE, sistema de gestión ISO/IEC 42001, artículo 22 del RGPD, normativa sectorial (MDR, DORA, equivalente a la FDA en materia de IA).
E
Ética
Sesgo, imparcialidad, explicabilidad, supervisión humana y participación de las partes interesadas a lo largo de todo el ciclo de vida del sistema de IA. Documentado, no simplemente afirmado.
D
Gobernanza de datos
Origen, consentimiento, conservación, calidad y representatividad de los datos de entrenamiento. Protección de la privacidad mediante flujos de trabajo de inferencia y eliminación.
Solicitar una auditoría de IA
El documento técnico STARED analiza en profundidad el marco: metodología, rúbricas de puntuación y ejemplos prácticos en sistemas de LLM, aprendizaje automático tradicional y visión artificial.
Qué es lo que comprobamos

Los fallos que han llevado a los sistemas de IA a los titulares.

Un mapa no exhaustivo de los riesgos específicos de la IA que se abordan en cada proyecto de AuditOne, en consonancia con el «Top 10» de OWASP para modelos de lenguaje grande (LLM), MITRE ATLAS, el Marco de Gestión de Riesgos de la IA (AI RMF) del NIST y nuestro catálogo interno STARED.
LLM01
Inyección inmediata
Inyección directa e indirecta a través de la entrada del usuario, los documentos recuperados, los resultados de las herramientas y las indicaciones del sistema. Fuga de límites entre el contexto del usuario y el del sistema.
LLM02 / owasp-a07
Divulgación de información confidencial
Extracción de datos de entrenamiento, memorización de datos de carácter personal o credenciales, filtración de mensajes del sistema, exposición del contexto potenciada por la recuperación.
LLM03
Cadena de suministro
Ponderaciones de modelos comprometidas, datos de ajuste fino maliciosos, integridad de los adaptadores de terceros y procedencia de las dependencias de las bibliotecas y los marcos de trabajo de aprendizaje automático.
LLM04
Contaminación de datos y modelos
Activadores de puertas traseras, ataques de inversión de etiquetas, envenenamiento del contexto RAG, ajuste de la integridad de los conjuntos de datos y manipulación de las recompensas en el aprendizaje por refuerzo.
LLM05
Gestión inadecuada de los resultados
Inyección «downstream» a través de la salida del modelo, XSS a partir de código HTML generado, inyección SQL a partir de consultas generadas e inyección de comandos a partir de las salidas generadas por el uso de herramientas.
LLM06
Exceso de autonomía
Acceso a herramientas con permisos excesivos, falta de intervención humana en acciones de gran repercusión, fugas del bucle de agencia y desviaciones del alcance en planes de varios pasos.
eu-ai-act, art. 10
Sesgo y equidad
Impacto desigual en función de las características protegidas, deficiencias en la representatividad de los datos de entrenamiento y fallos de calibración en los distintos segmentos demográficos.
eu-ai-act, art. 13
Transparencia y explicabilidad
Trazabilidad de las decisiones relativas a resultados de alto riesgo, divulgación de información al usuario y exhaustividad de la documentación técnica para la evaluación de la conformidad.
eu-ai-act, art. 14
Supervisión humana
Mecanismos de anulación y parada, diseño de la interfaz de usuario de supervisión, requisitos de competencia de los operadores, documentación sobre la aceptación del riesgo residual.
Calendario de la Ley de IA de la UE

El reloj que realmente importa.

Los marcos tradicionales de seguridad y cumplimiento normativo pasan por alto la mayor parte de los aspectos que dificultan la auditoría de los sistemas de IA: los datos de entrenamiento, el comportamiento de los modelos, la deriva tras la implementación y la robustez ante ataques adversarios. STARED es nuestro marco de cinco dimensiones, diseñado específicamente para subsanar esa carencia.
agosto de 2024

Entrada en vigor de la Ley de IA

EN VIGOR
FEB 2025

Prácticas prohibidas

APLICADO
agosto de 2025

Se aplican las normas del modelo GPAI

APLICADO
2 de agosto de 2026

Cumplimiento normativo de los sistemas de alto riesgo

EN VIGOR
agosto de 2027

Sistemas integrados en productos regulados

PRÓXIMAMENTE
Actualización importante: El acuerdo político sobre el «Omnibus Digital», alcanzado en mayo de 2026, podría aplazar algunos plazos de alto riesgo hasta diciembre de 2027, aunque la propuesta aún no se ha adoptado formalmente. El 2 de agosto de 2026 sigue siendo la fecha límite legal vigente. Las multas pueden alcanzar hasta 35 millones de euros o el 7 % de la facturación global. En cualquier caso, una evaluación de conformidad fiable lleva entre 8 y 16 semanas. Nosotros evaluamos su caso en 24 horas.
hablar con un auditor
En qué nos diferenciamos

Cuatro pares de ojos pendientes del mismo sistema. Siempre.

Un auditor ve lo mismo que ha visto antes. Cuatro especialistas ven lo que realmente hace un sistema de inteligencia artificial.
Cada proyecto de AuditOne AI lo llevan a cabo entre tres y cuatro especialistas independientes que trabajan en paralelo —normalmente, un auditor técnico/de aprendizaje automático, un auditor de seguridad/del equipo rojo, un auditor normativo y un revisor de ética/equidad—. Evalúan el sistema por separado y, a continuación, revisan entre ellos los resultados antes de que cualquier incidencia se incluya en el informe.

La IA es demasiado multidimensional como para que un solo auditor pueda abarcala de forma fiable. Nuestro modelo asigna al especialista adecuado a cada dimensión STARED y exige una validación cruzada entre ellos.
Asignación según especialidades: un auditor de equidad revisa las denuncias de sesgo, un ingeniero de aprendizaje automático revisa la detección de desviaciones y un auditor normativo revisa la documentación del anexo IV.
Validación entre dimensiones: los resultados obtenidos en una dimensión de STARED se comparan con los de las demás. Una respuesta técnica «segura» que no supere la prueba ética no se lanza al mercado.
«Skin in the game »: los auditores obtienen bonificaciones por las observaciones válidas, lo que premia la profundidad y la precisión por encima del mero cumplimiento de una lista de comprobación.
cómo funciona

Desde la definición del alcance hasta el informe de auditoría, en un plazo de entre 6 y 16 semanas

01
Definición del alcance y clasificación de riesgos
De 24 a 48 horas
Clasificamos su sistema de IA según el anexo III de la Ley de IA de la UE, identificamos las obligaciones aplicables y confirmamos el alcance en todas las dimensiones del marco STARED. En un plazo de 48 horas, recibirá un presupuesto fijo, un plazo previsto para la auditoría y una lista de verificación de la documentación.
02
Revisión de la documentación
De 1 a 2 semanas
Revisamos su documentación técnica (expediente del anexo IV de la Ley de IA de la UE, declaración de aplicabilidad de la norma ISO 42001), fichas de modelo, fichas técnicas, informes de evaluación y procedimientos operativos. Las deficiencias detectadas se señalan con solicitudes específicas de pruebas.
03
Pruebas técnicas y de simulación de ataques
De 2 a 6 semanas
Pruebas prácticas en todas las dimensiones de STARED: simulacros de ataque («red teaming») contra el Top 10 de OWASP LLM y MITRE ATLAS, evaluación de sesgos y equidad, análisis de desviaciones y calibración, y revisión de la seguridad de la infraestructura. Los hallazgos críticos se comunicaron de inmediato.
04
Revisión por pares y consolidación
1 semana
Las conclusiones de cada especialista son revisadas por al menos un auditor de una dimensión diferente de STARED. El equipo elabora un informe consolidado en el que se recogen las conclusiones clasificadas, las pruebas y las recomendaciones de corrección.
05
Revisión por pares y consolidación
Depende del proyecto
Ustedes se encargan de subsanar los problemas documentados. Nosotros verificamos que se hayan resuelto y elaboramos el informe final, con un formato que cumpla con los requisitos de su organismo de certificación (ISO 42001), organismo notificado (Ley de IA de la UE para casos de alto riesgo) o de diligencia debida de sus clientes.
comentarios

Lo que dicen los clientes.

Preguntas frecuentes

¿Se considera mi sistema de IA «de alto riesgo» según la Ley de IA de la UE?

La clasificación de alto riesgo viene determinada por el anexo III del reglamento. Las principales categorías son: identificación biométrica, infraestructuras críticas, educación, empleo (contratación, seguimiento, despido), acceso a servicios esenciales (calificación crediticia, seguros, prestaciones públicas), fuerzas del orden, migración y administración de justicia. Los sistemas de IA utilizados como componentes de seguridad en productos regulados por la legislación de la UE en materia de seguridad de los productos (dispositivos médicos, vehículos, maquinaria) también se consideran de alto riesgo. Clasificamos su sistema de manera formal como primer paso de cada proyecto, y la propia clasificación constituye una prueba que las autoridades reguladoras pueden solicitar.

¿Cuál es la diferencia entre una auditoría según la norma ISO 42001 y una evaluación de conformidad con la Ley de IA de la UE?

La norma ISO/IEC 42001 audita su sistema de gestión: la gobernanza, las políticas y los procesos relacionados con la IA en su organización. La evaluación de la conformidad con la Ley de IA de la UE analiza un sistema específico de IA de alto riesgo en función de los requisitos técnicos y de documentación del reglamento (artículos 9 a 17). Ambas son complementarias: un sistema de gestión maduro conforme a la norma ISO 42001 facilita enormemente la demostración de la conformidad con la Ley de IA de la UE. Ofrecemos ambos servicios, por separado o como un proyecto integrado.

¿Realizáis auditorías específicas de sistemas de LLM y de IA generativa?

Sí: los modelos de lenguaje grande (LLM) y la IA generativa constituyen ya la mayor parte de nuestros encargos de auditoría de IA. Nuestros especialistas del «equipo rojo» realizan pruebas basadas en el «OWASP LLM Top 10» (edición de 2025), la taxonomía adversaria de MITRE ATLAS y los modos de fallo específicos de cada protocolo para sistemas RAG, flujos de trabajo agentivos y modelos multimodales. Cubrimos la inyección de prompts (directa e indirecta), el «jailbreaking», la extracción de datos de entrenamiento, el abuso de los límites de uso de herramientas, las vulnerabilidades en el manejo de resultados, así como los riesgos propios de los agentes de IA, como el bucle agencial y el exceso de agencia.

¿Qué documentación tengo que preparar?

Para el trabajo de cumplimiento de la Ley de IA de la UE, el paquete de documentación técnica del Anexo IV: descripción del sistema, finalidad prevista, documentación de los datos de entrenamiento, resultados de la evaluación, documentación sobre la gestión de riesgos y plan de seguimiento posterior a la comercialización. Para el trabajo relacionado con la norma ISO 42001, su política de IA, la declaración de aplicabilidad, el registro de riesgos y la documentación de los procesos. Para el «red teaming» técnico, el acceso al modelo (API o pesos), las indicaciones del sistema y cualquier medida de protección en la implementación. Tras la reunión para definir el alcance, enviamos una lista de comprobación personalizada; la mayoría de los clientes ya disponen del 60-70 % de lo que necesitan y identificamos rápidamente las carencias.

¿Cuánto tiempo dura una auditoría de sistemas de IA?

De seis a dieciséis semanas en total, dependiendo del alcance. Una intervención específica de «equipo rojo» con un modelo de lenguaje grande (LLM) dirigida a un único sistema implementado puede completarse en un plazo de 4 a 6 semanas. Una auditoría interna completa según la norma ISO/IEC 42001 en toda una organización suele durar entre 8 y 12 semanas. Una evaluación de conformidad con la Ley de IA de la UE para un único sistema de alto riesgo, incluidos los ciclos de corrección, dura entre 10 y 16 semanas. Nos comprometemos a respetar un plazo concreto en la carta de encargo.

¿Cuál es el precio de la auditoría?

El precio depende de tres factores: la complejidad del sistema de IA (modelo único frente a flujo de trabajo multimodelo frente a sistema agencial), el nivel de detalle de la auditoría requerido (dimensión específica frente a STARED completo) y los días-auditor necesarios entre los especialistas pertinentes. Se envía un presupuesto a precio fijo en un plazo de 24 horas tras definir el alcance. Los proyectos adaptados a las pymes parten de una cifra baja de cinco dígitos; las evaluaciones completas de conformidad con la Ley de IA de la UE para grandes empresas tienen un coste superior a partir de ahí. Ponte en contacto con nosotros en hello@auditone.io para obtener un rango de precios orientativo.

¿Es usted un organismo notificado para la conformidad con la Ley de IA de la UE?

No. La mayoría de los sistemas de IA de alto riesgo (Anexo III) siguen la vía de la autoevaluación prevista en el artículo 43, en la que el proveedor lleva a cabo la evaluación de la conformidad mediante procedimientos internos. Nuestra función consiste en llevar a cabo la evaluación de la conformidad como tercero independiente, elaborando la documentación que cumpla los requisitos sin necesidad de que intervenga un organismo notificado. En el caso del reducido conjunto de productos de alto riesgo que requieren la intervención de un organismo notificado (determinados sistemas de identificación biométrica), colaboramos con organismos notificados acreditados —incluidos socios de nuestra red de organismos de certificación— y elaboramos la base de pruebas que necesitan.

¿En qué consiste el marco STARED y dónde puedo informarme al respecto?

STARED es nuestro marco de cinco dimensiones para las auditorías de IA: seguridad, evaluación técnica, cumplimiento normativo, éticay gobernanza de datos. Se ha diseñado específicamente porque los marcos de seguridad o cumplimiento normativoexistentes no abordan los aspectos que dificultan la auditoría de los sistemas de IA: el linaje de los datos de entrenamiento, el comportamiento de los modelos en condiciones adversas, la deriva y el riesgo de agencia. La metodología completa, las rúbricas de puntuación y los ejemplos prácticos están disponibles en el documento de presentación de STARED.

¿Nos ayudarás también a prepararnos o solo harás una auditoría?

Ambas funciones se mantienen estrictamente separadas. No redactamos vuestras políticas, ni diseñamos vuestra gobernanza de la IA, ni implementamos vuestros controles; hacerlo comprometería la independencia necesaria para la propia auditoría. Lo que sí ofrecemos es una evaluación de deficiencias previa a la auditoría (más superficial y de carácter consultivo), seguida de la auditoría formal (independiente y basada en pruebas). La evaluación de deficiencias os indica qué debéis corregir; la auditoría verifica que lo hayáis corregido. El alcance es diferente, al igual que los resultados finales.