El human-in-the-loop no es un control si la persona no puede rebatir a la IA. El estudio de IBM lo muestra
Según IBM, el 71% de los directivos valora poder supervisar, validar o anular a la IA, frente al 38% de los empleados. Revisar exige preparación, tiempo y autoridad.
Escuche este artículo · 6 min
Narración completa del artículo, generada con IA.

Casi todos los diagramas de arquitectura de IA empresarial tienen una caja que dice “revisión humana”. A menudo es el control principal del paso más arriesgado. Y casi nunca se diseña: nadie concreta quién es la persona, qué ve, cuánto tiempo tiene, si puede decir que no ni cómo se sabrá si dejó de mirar de verdad.
Los nuevos datos de IBM sugieren que esa caja es más débil de lo que parece.
Qué encontró IBM
El estudio de 2026 del IBM Institute for Business Value con directores de recursos humanos (CHRO) encuestó a 1.500 CHRO y altos directivos y a 8.800 empleados de 21 países y regiones y 23 sectores, entre abril y junio de 2026. Según IBM:
- El 71% de los directivos prioriza la capacidad de supervisar, validar o anular lo que produce la IA, frente al 38% de los empleados. IBM la describe como la mayor divergencia entre ambos grupos.
- Solo el 26% de las organizaciones define con claridad qué trabajo lideran las personas, cuál asiste la IA y cuál ejecuta la IA.
- El 36% de los directivos afirma que la falta de claridad sobre responsabilidades complica el despliegue de la IA.
- La pérdida de competencias preocupa al 46% de los directivos, y el 60% de los empleados dice que le afecta directamente.
La nota de IBM Canadá del 2 de octubre afinó el mismo punto: el 68% de los CHRO canadienses señala la capacidad de supervisar, validar y anular la IA como la competencia más esencial, mientras que solo el 29% de los empleados canadienses considera importante el criterio propio. Todas las cifras son de IBM, y el estudio no publica un desglose para España ni para Latinoamérica.
La recomendación de IBM es clara: el rediseño del trabajo debe hacer explícitos, dentro del flujo, el responsable, la validación, la gestión de excepciones, el escalado y la anulación.
Por qué la brecha importa para la arquitectura
Cuando el directivo piensa “una persona lo revisa” y quien revisa no ve la evaluación como parte de su trabajo, la revisión se convierte en un sello. No es un detalle de formación. Es un fallo de control que no aparece en ninguna prueba, porque el proceso parece idéntico tanto si el revisor lee con atención como si solo pulsa aprobar.
Tres factores lo agravan con la IA:
- Verosimilitud. La respuesta de la IA suena bien incluso cuando es errónea. Detectar el error exige criterio del dominio, no corrección de textos.
- Volumen. Los agentes generan más elementos que revisar de los que generaban las personas. El tiempo por elemento se reduce.
- Pérdida de práctica. Quien deja de hacer el trabajo de base pierde poco a poco la capacidad de juzgarlo, la erosión que el 60% de los empleados dijo notar.
Qué necesita una revisión de verdad
- Autoridad para rechazar
- Evidencia a la vista, no solo la respuesta
- Tiempo previsto por elemento
- Competencia al día
- Calidad de la revisión medida
PersonaDiseño del paso
Autoridad. El revisor tiene que poder rechazar, y rechazar no puede penalizarse con objetivos que premian el volumen. Si anular a la IA supone no cumplir el objetivo, nadie la anulará.
Evidencia. Muestre las fuentes, los registros consultados y el razonamiento, no solo la conclusión. Quien ve solo la respuesta únicamente puede juzgar si suena bien.
Tiempo. Prevea el tiempo de revisión por elemento en el diseño del proceso. Si el agente produce 400 elementos al día y una persona dispone de dos horas, la revisión es una ficción.
Competencia. Mantenga a los revisores haciendo parte del trabajo de base para conservar el criterio, y fórmelos en las formas concretas en que falla la IA.
Medición. Siga las tasas de anulación y de edición y los errores detectados con muestreo independiente. Una tasa de anulación cercana a cero durante meses no demuestra una IA perfecta; puede demostrar un revisor ausente. Es también la evidencia de la que depende la escalera de autonomía: una aprobación solo cuenta si es real.
El patrón se repite en todo lo que hemos analizado. En el SOC agéntico, los analistas conservan la autoridad porque están formados para desconfiar de lo que no pueden verificar. Cuando un agente sigue actuando después de que su responsable se va, como en Copilot Autopilot, no hay revisor alguno.
En Europa, esto ya es una obligación
Para las empresas españolas, la brecha que mide IBM tiene consecuencias legales. El Reglamento europeo de IA exige en su artículo 14 que los sistemas de alto riesgo puedan ser supervisados de forma efectiva por personas, y en su artículo 26 obliga a quien los despliega a encomendar esa supervisión a personas físicas que tengan la competencia, la formación y la autoridad necesarias. Es, casi palabra por palabra, la lista de condiciones de arriba. Un revisor que no se siente con autoridad para anular a la IA, o que no ve la evaluación como su trabajo, no cumple ese perfil. En Latinoamérica no existe todavía una obligación equivalente, pero las empresas que operan en Europa o venden a clientes europeos acabarán aplicando el mismo estándar.
Qué hacer ahora
- Inventaríe cada paso de “revisión humana” en los flujos de IA en producción y ponga nombre a la persona o al rol detrás de cada uno.
- Clasifique cada paso como liderado por personas, asistido por IA o ejecutado por la IA, la distinción que solo el 26% de las organizaciones hace con claridad, según IBM.
- Dé al revisor la evidencia y el tiempo, y escriba ambos en el proceso, no solo en el diagrama.
- Mida las tasas de anulación y edición y haga muestreos independientes para comprobar que la revisión es real.
- Proteja la competencia: haga que los revisores pasen por el trabajo de base y fórmelos en los modos de fallo conocidos.
En resumen
El human-in-the-loop es un diseño, no una etiqueta. Los datos de IBM sugieren que muchas organizaciones se apoyan en un control que las personas que lo ejecutan no reconocen del todo como parte de su trabajo. Corregirlo es barato comparado con lo que protege: dé a la persona autoridad, evidencia, tiempo y competencia, y mida si los usa.