Hier verzamelen we de serie rond AI-agent workflows, zodat de teksten terug te lezen, te kopiëren en later te hergebruiken zijn voor CAAO.
draft
CAAO Praktijktest #2 — Wanneer een groene build niet betekent dat het werkt
Groene codechecks bewijzen nog niet dat de volledige productieketen werkt. Een echte gebruikersactie, productielogs en een geslaagde herhaling zijn afzonderlijke verificatiesignalen.
CAAO Praktijktest #2 — Wanneer een groene build niet betekent dat het werkt
De tests waren groen.
De lint-check was groen.
De production build was groen.
Toch kon ik niet inloggen op caao.nl.
Dat is precies het soort verschil waar ik CAAO voor bouw:
CAAO Praktijktest #1 — Van losse Excel-exports naar één controleerbaar rapport
Een agentanalyse wordt pas bruikbaar wanneer de workflow ook dubbeltellingen herkent, controles uitvoert en laat zien waar de uitkomst vandaan komt.
CAAO Praktijktest #1 — Van losse Excel-exports naar één controleerbaar rapport
Ik zette negen LinkedIn-exports in één map.
Niet om nog een dashboard te bouwen, maar om iets praktisch te testen: kan een agent van losse Excelbestanden een analyse maken die ik ook kan controleren?
De eerste uitkomst leek eenvoudig. Negen bestanden, negen posts.
GPT-5.6 Terra, GPT-5.6 Luna en GPT-5.6 Sol zijn niet vooral een uitnodiging om te vragen welk model “het beste” is. Ze maken zichtbaar dat een goede AI-workflow verschillende soorten werk kent: voorbereiden, uitwerken, kritisch beoordelen en menselijk beslissen.
De vraag is niet alleen: welk AI-model is het slimst?
De betere vraag is: welk deel van mijn workflow verdient welk model én welke controle?
OpenAI heeft GPT-5.6 nu in drie varianten:
- Luna: gericht op kostenbewust werk op volume
- Terra: balans tussen kwaliteit en kosten
- Sol: voor complex professioneel werk
Deze post is bedoeld als rustige lancering van de website, niet als grote marketingclaim.
CAAO staat live.
De afgelopen weken merkte ik dat mijn AI-gebruik steeds minder draaide om losse prompts.
Het ging steeds vaker om herhaalbare workflows:
- een agent code laten reviewen;
- een productidee laten pressure-testen;
- research omzetten naar een bruikbare samenvatting;
- een loop bouwen met bewijs in plaats van alleen vertrouwen.