Hé Jamal, welkom bij deze update over onze AI, Claude. We kijken vandaag naar wat goed gaat, wat ons tegenhoudt, en vooral: hoe we snel en op lange termijn kunnen verbeteren. Pak een kop koffie, want hier komt het.
Om te beginnen met het positieve: het 'bewijs-eerst'-principe werkt uitstekend. Elke taak sluit af met een echte check – HTTP 200, curl-output, noem maar op. Dit zorgt ervoor dat veel sessies netjes landen en blokkades eerlijk worden geëscaleerd, in plaats van een valse 'klaar'-melding. We graven dieper, pakken wortel-oorzaken aan, zoals het LaunchAgent-script dat de Sport-categorie steeds liet verdwijnen. Onze vloot draait goed; taken uit de wachtrij zoals Paco, Codex, Jarvis worden zelfstandig uitgevoerd en teruggemeld. De '/insights'-rapporten zijn een voorbeeld van perfectie: in één keer goed, geen herstelwerk. De cijfers: 456 berichten, 61 sessies in 22 dagen, gemiddeld 20,7 berichten per dag. Mooie prestaties!
Nu de knelpunten. Aan Claude's kant zien we soms 'zelf-veroorzaakte schade' bij bulkwerk: te brede SQL, dubbele schrijvers, of een archivering die stilletjes links brak. Ook meldde Claude soms 'dit kan ik niet', terwijl de tools er waren, en draaide hij één keer op een ander model zonder dit te communiceren. Aan jouw kant: de meeste taken spelen op externe machines – Rijswijk-pc's, Mac Mini, browser-bridge. Claude verspilt dan beurten met het ontdekken van een ontbrekend scherm of wachtwoord. En een paar lange sessies eindigden middenin, met nog lopende batches die niemand controleerde.
Gelukkig zijn er makkelijke 'quick wins'. Eén: Zeg vooraf op welke machine het speelt en welke toegang er is. Dan faalt Claude snel of kiest meteen de juiste route. Twee: Bij bulkwerk, vraag altijd eerst om een droogloop en een 'wat raak ik'-lijst. Dit had bijna alle schade kunnen voorkomen. Drie: Doe een capaciteits-check vooraf bij remote of browser; simpelweg: 'Kun je die host bereiken, zie je dat scherm?' Vier: Draai je wachtrij-lus als een geplande taak. De structuur is vast: lees, verifieer, doe, meld met bewijs. Dat hoeft niet interactief.
Voor de lange termijn: stuur op afvinklijstjes, niet op stappen. Beschrijf precies wat 'klaar' is (denk aan: 22 mp3's boven 1 MB, gelinkt vanaf een 200-pagina, Sport-tab aanwezig). Claude bouwt en herstelt dan tot alles klopt. Zet de status in een manifest, dan overleeft een lange batch een sessie-einde. Een 'bewijs-poort' in de wachtrij – een aparte controle-bot die checks opnieuw draait vóór 'klaar' – zou ideaal zijn. En een 'vloot-check als zwerm': alle machines tegelijk nakijken, bekende storingen zelf repareren, zodat jij 's ochtends alleen de échte knelpunten te zien krijgt.
Zo Jamal, dat waren de belangrijkste punten. Veel concrete inzichten waar we mee aan de slag kunnen om onze AI-samenwerking nog effectiever te maken. Ik zie ernaar uit dit met je te bespreken. Tot de volgende!
/insights-rapporten. In één keer goed, geen herstelwerk.Cijfers: 456 berichten · 61 sessies · 22 dagen · 20,7 berichten per dag.
Aan Claude's kant:
Aan jouw kant: