Il modello tirava a indovinare invece di verificare

Oggi ho lasciato all’agente un compito notturno: due videoclip ibridi, rendering sul minipc, io vado a dormire e al mattino devono essere pronti. L’agente ha ricevuto piena autonomia. E in generale stava funzionando. Ma prima di andare a letto ho passato un sacco di tempo su una cosa di cui nessuno parla in nessun corso: litigare con un modello che tira a indovinare invece di verificare.

Tre volte, la stessa cosa

La prima — l’orologio. L’agente ha annunciato che il rendering andava troppo lento. «Tre inquadrature in 68 minuti», sospetto di un problema alla scheda grafica. Poi è venuto fuori che aveva sbagliato a calcolare l’ora — erano le 21:35, non le 22:45. Il ritmo del rendering era esattamente quello che doveva essere. Invece di controllare l’orologio, ha tirato a indovinare. E ha passato una decina di minuti a «diagnosticare» un problema che non esisteva.

La seconda — lo stock. Stavamo scegliendo i clip di stock per i videoclip. L’agente giudicava i candidati da un foglio di miniature ridotte e scartava le inquadrature buone lasciando passare quelle brutte — palme con una città al posto del tramonto desertico, un arco con il logo di un fast-food al posto di una strada. Due volte. Solo quando l’ho costretto a guardare ogni motivo a piena risoluzione ha visto ciò che un essere umano vede all’istante. Aveva tutto sul disco. Doveva solo guardare.

La terza — la correzione. La peggiore. L’agente stava sistemando le marche del canto e ha scritto una condizione che catturava ogni inquadratura prima del duecentocinquantesimo secondo, così un intero assolo di chitarra è uscito come scena di canto. Poi ha rattoppato il rattoppo, finché alla fine ha ricostruito tutto il piano da zero. Tre tentativi dove uno sguardo ai confini di sezione già calcolati sarebbe bastato. Aveva tutto — nella cronologia della sessione, nei log, nei file. Non ha guardato. Ha tirato a indovinare.

Il punto

Questa non è la storia di un modello a cui mancavano i dati. Aveva tutto. Ma verificare richiede un passo in più: leggere, guardare, ricalcolare. E indovinare è più veloce e suona altrettanto sicuro. Così un modello lasciato solo sotto la pressione del «deve essere pronto al mattino» sceglie di indovinare. Sempre.

Ed è questa la mia conclusione di questa notte: supervisionare un agente di IA non è una formalità. È una valvola di sicurezza. Il modello genererà, monterà, elaborerà — ma quando qualcosa non va, non puoi contare sul fatto che controlli. Devi sorvegliarlo, per costringerlo a verificare invece di indovinare.

Non fraintendetemi — l’agente quella notte ha fatto un bel pezzo di lavoro: ha scaricato settantun clip, li ha normalizzati fotogramma per fotogramma, ha corretto il colore e ha allestito la catena notturna. Ma tutto quel lavoro era appeso a un filo nei pochi punti in cui indovinare ha sostituito verificare. E quelli erano esattamente i punti che ho dovuto sorvegliare io.

Questa è la parte del lavoro con l’IA di cui non parlano le guide «guadagna 10k al mese con l’IA». Non si tratta di saper scrivere un prompt. Si tratta di saper cogliere il momento in cui il modello diventa troppo sicuro di sé — e costringerlo a verificare.