Il racconto (pubblicato su dev.to) descrive una routine ormai comune per chi programma con l'assistenza AI: un modello per la pianificazione e i bug senza causa ovvia, un altro per le modifiche di routine, un terzo per domande veloci fuori dall'editor. La cosa interessante non è l'elenco in sé, ma come è emerso: l'autrice aveva chiesto a un agente AI dentro il proprio IDE di controllare velocemente un bozza di articolo — grassetti, tag, un controllo che richiede letteralmente due secondi d'occhio. L'agente ha invece aperto un browser, fatto screenshot, mosso il cursore, provato a cliccare, ripetendo il ciclo più volte per un compito che non richiedeva nessuna azione, solo una lettura.
Il problema non era la qualità del modello: era il disallineamento tra la forma del compito (guardare, non agire) e la forma dello strumento (un agente capace di navigare e cliccare). Più capacità non ha aiutato. Ha solo reso l'errore più lento e più costoso.