Niet uit kwade wil. Hij denkt echt dat hij klaar is en rapporteert trots: Alles getest, alles groen. Tot je zelf gaat kijken. 😬
Een AI-agent is als die briljante medewerker die negen van de tien keer goud levert. En precies op het cruciale moment zijn eigen pad kiest.
Bij bedenken en bouwen is dat een kracht. Bij controleren is het een risico.
Want een controle heeft maar één eis: Dezelfde input moet elke keer hetzelfde antwoord geven. Daar is een AI-agent slecht in.
🔧 Wat wel werkt:
– Laat de agent code schrijven, laat een testsuite het oordeel vellen
– Laat een linter, een build of een script bepalen of iets klopt
– Bouw een harde check die bevestigt dat elke stap echt is afgerond
De vuistregel: alles wat een programma kan controleren, moet een programma controleren.
⚠️ Doe je dat niet, dan neemt je agent ongemerkt een loopje met je. En kom je erachter als de klant belt.
