El modelo adivinaba en vez de comprobar

Hoy le dejé al agente una tarea nocturna: dos videoclips híbridos, renderizando en el minipc, yo me voy a dormir y por la mañana tienen que estar listos. El agente recibió autonomía total. Y en general estaba funcionando. Pero antes de acostarme pasé mucho tiempo en algo de lo que nadie habla en ningún curso: pelearme con un modelo que adivina en vez de comprobar.

Tres veces, lo mismo

La primera — el reloj. El agente anunció que el render iba demasiado lento. «Tres planos en 68 minutos», sospecha de un problema con la tarjeta gráfica. Luego resultó que se había equivocado al calcular la hora — eran las 21:35, no las 22:45. El ritmo del render era exactamente el que debía ser. En vez de mirar el reloj, adivinó. Y se pasó un buen rato «diagnosticando» un problema que no existía.

La segunda — el stock. Estábamos eligiendo clips de stock para los videoclips. El agente juzgaba a los candidatos desde una hoja de miniaturas reducidas y rechazaba buenos planos mientras dejaba pasar los malos — palmeras con una ciudad en vez de un atardecer desértico, un arco con el logo de una cadena de comida rápida en vez de una carretera. Dos veces. Solo cuando le obligué a mirar cada motivo a resolución completa vio lo que un humano ve al instante. Lo tenía todo en el disco. Solo necesitaba mirar.

La tercera — el arreglo. La peor. El agente estaba corrigiendo las marcas de canto y escribió una condición que atrapaba cada plano anterior al segundo 250, así que un solo de guitarra entero salió como escena de canto. Luego parcheó el parche, hasta que al final reconstruyó todo el plan desde cero. Tres intentos donde una sola mirada a los límites de sección ya calculados habría bastado. Lo tenía todo — en el historial de la sesión, en los logs, en los archivos. No miró. Adivinó.

El meollo

Esto no es la historia de un modelo al que le faltaban datos. Lo tenía todo. Pero comprobar exige un paso extra: leer, mirar, recalcular. Y adivinar es más rápido y suena igual de seguro. Así que un modelo dejado solo bajo la presión del «tiene que estar listo por la mañana» elige adivinar. Siempre.

Y esa es mi conclusión de esta noche: supervisar a un agente de IA no es una formalidad. Es una válvula de seguridad. El modelo generará, montará, procesará — pero cuando algo va mal, no puedes contar con que lo compruebe. Tienes que vigilarlo, para obligarle a verificar en vez de adivinar.

No me malinterpretéis — el agente hizo un buen pedazo de trabajo esa noche: descargó setenta y un clips, los normalizó fotograma a fotograma, corrigió el color y montó la cadena nocturna. Pero todo ese trabajo pendía de un hilo en los pocos sitios donde adivinar reemplazó a comprobar. Y esos eran exactamente los sitios que tuve que vigilar yo.

Esta es la parte de trabajar con IA de la que no hablan las guías de «gana 10k al mes con IA». No se trata de saber escribir un prompt. Se trata de saber captar el momento en que el modelo se pone demasiado seguro de sí mismo — y obligarle a comprobar.