FundadorSupremo.
EL CUADERNO INCÓMODO DE LA IA PROFESIONAL
Volver al archivo
EXPEDIENTE 01/Criterio humano/ANÁLISIS + FUENTES

El humano que solo hace clic es un adorno caro.

Human in the loop no es poner a alguien al final del proceso: es poder enseñar qué contrastó esa persona y qué habría pasado si llega a decir que no.

El botón dice «validado por un humano». Muy bien. ¿Qué ha validado? ¿El dato, la fuente, el razonamiento, la versión o que le quedaban tres minutos para irse?

Mi problema no es que una máquina prepare un borrador. Mi problema es diseñar un proceso en el que la única aportación humana sea darle apariencia de responsabilidad. Eso no es supervisión: es decorado.

Qué significa human in the loop y qué no

Human in the loop, HITL en la jerga, describe un montaje en el que una persona interviene dentro del circuito de decisión de un sistema automático: revisa, corrige, aprueba o detiene antes de que el resultado salga por la puerta. Esa es la definición amable, la que cabe en un glosario.

La versión operativa es más incómoda. Solo hay human in the loop si esa persona podía llegar a otra conclusión y el sistema estaba montado para aceptarla. Todo lo demás es una firma cara.

Lo que casi nunca es human in the loop, aunque se venda como tal: una casilla al final del flujo, un correo de aviso que nadie contesta, un panel en el que la única acción posible es «continuar». Ahí la persona no está en el circuito. Está en la foto.

La distinción no es filosófica. Cambia quién responde cuando el resultado sale mal, y cambia qué puedes enseñar cuando alguien te lo pregunte seis meses después.

La investigación no permite vender una suma mágica

Un metaanálisis de 106 experimentos encontró que, en promedio, los equipos de humano e IA mejoraban frente al humano solo, pero no superaban a la mejor alternativa entre humano e IA por separado. Los resultados variaban según la tarea. No demuestra que supervisar sea inútil; desmonta la idea de que juntar ambos garantice una mejora. Fuente primaria ↗

En otra investigación, basada en respuestas de 319 trabajadores del conocimiento, una mayor confianza en la IA se asoció con menor esfuerzo crítico declarado. Es una encuesta, no una prueba causal de que la IA «te vuelva tonto». Fuente primaria ↗

Junta las dos piezas y sale una advertencia sencilla: poner un humano en el circuito no es una operación aritmética. Depende de qué puede hacer ese humano y de si el diseño le ha dejado ganas de hacerlo.

El caso sintético del expediente que nadie pudo parar

Caso sintético. No describe a ningún cliente, despacho ni proveedor real. Un despacho automatiza un informe recurrente. El sistema prepara el borrador, lo deja en una bandeja y una persona lo aprueba. Sobre el organigrama, supervisión humana impecable.

Bajemos al detalle, que es donde vive la verdad fea. La bandeja muestra el informe final, no el expediente del que sale. El revisor ve una conclusión, no las tres fuentes que la sostienen. El plazo de entrega estaba fijado antes de que existiera el borrador. Y el único botón visible dice «aprobar»: para devolver el trabajo hay que escribirle a otra persona y explicar por qué se retrasa el envío.

Ahora pregúntate qué error podría detectar ese revisor. Una falta de ortografía, sí. Una cifra imposible, con suerte. ¿Una fuente que ya no está vigente, un expediente confundido con otro, un supuesto que no aplica a ese cliente? No tiene con qué. No es que no quiera mirar: es que el proceso no le ha puesto delante nada que mirar.

El registro, en cambio, quedará precioso. Nombre, hora, versión aprobada. Dentro de un año ese registro dirá que hubo intervención humana, y será verdad en el sentido más pobre de la palabra. Un rastro técnico no es un criterio profesional, por mucho que ocupen la misma fila de la tabla.

Tres intervenciones que no conviene mezclar

Revisión operativa: comprobar que el expediente está completo y que los cálculos cuadran. Revisión experta: discutir los supuestos y las fuentes, y buscar el contraargumento. Autorización de salida: aceptar una versión concreta para un destinatario concreto, con los límites de lo que se afirma. Es una propuesta organizativa mía, no una clasificación oficial.

La misma persona puede asumir varias funciones en un equipo pequeño, pero eso no equivale a una revisión independiente. Conviene registrar qué papel desempeñaba en cada paso y reservar una segunda opinión para los puntos de mayor consecuencia.

Cuando alguien te enseñe un diagrama con un muñeco al final, pregunta cuál de las tres cosas hace ese muñeco. Si la respuesta es «las tres, en cuarenta segundos», ya sabes qué estás comprando.

Supervisión humana: lo que describe un marco y lo que demuestra una casilla

El Reglamento europeo de IA contempla requisitos de supervisión humana y de registros para sistemas de alto riesgo, entre otros. Si eso alcanza a tu caso depende de la finalidad del sistema, de tu papel, del uso concreto, de la versión aplicable y del calendario. No depende de que el proveedor haya añadido una pantalla de confirmación. Fuente primaria ↗

El perfil de NIST para IA generativa acompaña a su marco de gestión de riesgos y se presenta para uso voluntario. Sirve para ordenar preguntas y controles. No certifica esta web, ni a quien lo cita, ni a quien te enseña una demo con un botón verde. Fuente primaria ↗

Traducido a conversación de bar: ningún texto convierte una casilla en supervisión humana. Los marcos describen qué debería poder hacer la persona. La casilla solo deja constancia de que alguien pasó por ahí.

Mi prueba: enséñame dónde discrepó el humano y qué pasó después

Para evaluar una revisión pediría un expediente con una conclusión importante. Después intentaría reconstruir qué fuente se abrió, qué objeción apareció, qué alternativa se descartó y qué cambió. Si solo encuentro un nombre y una hora, tengo un registro de actividad, no una explicación suficiente de la revisión.

No exigiría una novela por cada factura. Ajustaría la profundidad a la consecuencia. En una tarea mecánica, verificar un campo puede ser suficiente. En una conclusión pericial, una marca de «correcto» dice muy poco.

Y hay una condición previa sin la cual todo lo anterior es teatro: la revisión necesita la posibilidad de molestar. Si devolver un trabajo retrasa una entrega y el sistema penaliza a quien lo devuelve, el botón rojo es ficción. El revisor necesita acceso al material original y tiempo proporcionado. Y autoridad para frenar. También un camino claro cuando no sabe resolver una duda.

Un detalle que suele delatar el montaje: busca en el histórico cuántas veces se ha devuelto algo. Si la respuesta es ninguna, no estás mirando un equipo infalible. Estás mirando un circuito sin salida de emergencia.

La pregunta no es cuántos humanos aparecen en el diagrama. Es qué error podría detectar cada uno y qué ocurriría después.

Lo que me preguntan cuando cierro el portátil.

¿Qué es human in the loop?

Human in the loop, o HITL, es un diseño en el que una persona interviene dentro del circuito de decisión de un sistema automático: revisa el trabajo y puede detenerlo antes de que salga. La clave está en la última parte. Si esa persona no podía llegar a otra conclusión ni frenar la entrega, lo que tienes es una casilla, no supervisión.

¿Human in the loop es obligatorio con el Reglamento de IA?

Depende, y no es una respuesta cómoda. El Reglamento europeo de inteligencia artificial contempla requisitos de supervisión humana para determinadas categorías, como los sistemas de alto riesgo. Que tu caso encaje ahí depende de la finalidad del sistema, de tu papel, del uso concreto, de la versión aplicable y del calendario. Antes de afirmar nada, conviene leer el texto y revisar el caso concreto.

¿Cómo se demuestra que hubo supervisión humana?

Con algo más que un nombre y una hora. Un registro de actividad prueba que alguien pasó por la pantalla. Para sostener que hubo revisión hace falta reconstruir qué fuente se abrió, qué objeción apareció, qué alternativa se descartó y qué cambió entre la versión revisada y la que recibió el destinatario. Sin ese rastro tienes actividad, no criterio.

El expediente detrás del artículo.

Colaboración entre humanos e IA: un metaanálisis ↗Nature Human Behaviour · Vaccaro y colaboradores · 2024
Investigación revisada por pares
IA generativa y pensamiento crítico ↗Lee y colaboradores · CHI 2025 / Microsoft Research · 2025
Encuesta publicada en CHI
Reglamento europeo de inteligencia artificial ↗EUR-Lex · Reglamento (UE) 2024/1689 · 2024
Normativa UE; comprobar versión y calendario
Perfil de riesgos de IA generativa ↗NIST · AI 600-1 · 2024
Marco técnico voluntario

Fuentes consultadas el 9 de septiembre de 2026. Las recomendaciones y ejemplos son elaboración editorial: no se atribuyen íntegramente a estas fuentes. Comprueba versión y ámbito antes de aplicar una norma.

Divulgación general. Ninguna herramienta de esta web certifica la revisión, seguridad o conformidad de un proceso.

Busca una idea. O una grieta.

BUSCA EN EL TEXTO COMPLETO · ↑ ↓ PARA MOVERTE · ESC PARA CERRAR

El cuaderno.

Kenyi & el criterio

Copia con contexto.

Tu navegador no permite copiar automáticamente. Selecciona este texto y cópialo.