Haarvisie verslagen
← Alle verslagen📄 Download als PDF
🎧 Luister dit verslag
1,0x
⬇️ Download naar telefoon
📖 Lees mee met de podcast

Hoi Jamal, welkom bij deze update over Hermes! We hebben diepgaand gekeken hoe we jouw digitale assistent nog prettiger, efficiënter en vooral kosteneffectiever kunnen maken. De kern van het verhaal? Hermes heeft al veel goede onderdelen, maar is momenteel een beetje te breed aan het draaien, met te veel lagen en sessies naast elkaar. Dat maakt het complex, kan leiden tot verouderde regels en zorgt voor hogere kosten. De oplossing is geen radicale reset, maar een paar duidelijke aanpassingen die Hermes veel gerichter en slimmer laten werken.

Laten we beginnen met wat we nu zien draaien. Op dit moment kan Hermes op wel vier plekken tegelijk actief zijn: via het dashboard, de desktop-app, een oude terminalsessie en zelfs via TUI slash-workers. Het belangrijke hier is dat dit niet zomaar verschillende weergaven van dezelfde sessie zijn; elke route kan zijn eigen context en prompt-cache gebruiken. Dit is een van de kernproblemen. Ons advies is dan ook: kies per taak één werkplek. Voor dagelijks gebruik zijn de desktop-app of het dashboard meestal voldoende. Fijn om te weten is dat oude achtergrondtaken en 'wachters' bewust zijn uitgeschakeld. Die moeten we niet zomaar weer aanzetten, tenzij je er een heel specifiek doel voor hebt.

Dan het geheugen en de regels. We hebben nu te veel bronnen die Hermes tegelijkertijd probeert te raadplegen, wat kan leiden tot tegenstrijdigheden. De teamregels, die we centraal in Supabase hebben staan, zouden altijd de leidende waarheid moeten zijn. Daarna komen teamfeiten uit gBrain of shared memory, en pas op de laatste plek het lokale Hermes-geheugen. Op dit moment zijn die lokale instructies en memory-bestanden verouderd en staan ze vol met informatie die niet meer klopt. Dit moet worden opgeschoond. De communicatie met Conductor is gelukkig wel goed geregeld via één specifiek script, en daar hoeven we niets aan te veranderen.

Het kostenplaatje is ook een belangrijk aandachtspunt. We zien dat er al minstens 90 dollar aan geschatte API-kosten is gemaakt, en dit is waarschijnlijk nog een ondergrens. De grote boosdoener? De Sonnet 4.6 sessies, vooral door hun lengte. Niet één antwoord is duur, maar Hermes stuurt nu in lange sessies telkens de volledige, vaak enorme context opnieuw mee naar de AI. Denk aan sessies met miljoenen inputtokens! Gelukkig hebben we al een aantal dingen goed staan, zoals het begrenzen van tool-uitvoer en de voorbereiding op compactie bij 70% van de context. Maar er zijn nieuwe kostenregels nodig: één lang gesprek voor één samenhangende taak, een frisse sessie na een mijlpaal, en altijd het goedkoopste model kiezen dat de taak aantoonbaar goed kan doen. Ook willen we geen onbegrensde achtergrondagenten meer; elke taak krijgt een doel, model en maximale duur.

Een van de belangrijkste oplossingen hiervoor is de 'handoff' vóór elke nieuwe of opgeschoonde sessie. Voordat je `/new` of `/clear` gebruikt, leg je kort vast: wat is af, wat staat open, wat is de exacte volgende stap en welke bron was leidend? Pas daarna start je een verse sessie en lees je deze handoff in. Dit voorkomt twee problemen tegelijk: dure, eindeloze gesprekken en het verlies van belangrijke kennis bij een frisse start.

We stellen voor dit in vier veilige stappen uit te voeren. Eerst alles veiligstellen met een snapshot van je configuratie en sessiestatus. Dan de regels en het geheugen rechtzetten door één compacte startinstructie te maken en de zoekvolgorde van het geheugen vast te leggen. Vervolgens pakken we de kosten en sessiehygiëne aan, door bijvoorbeeld waarschuwingen te tonen bij 60 en 70 procent contextgebruik en een duidelijke standaardinterface te kiezen. Tot slot beoordelen we oude restanten: we archiveren wat oud en onbruikbaar is, maar doen dit zorgvuldig en niet zomaar.

De meest concrete keuze die jij, Jamal, als eerste moet maken, is welke interface je standaard wilt gebruiken. Het advies is: de desktop-app voor dagelijks werk, het dashboard alleen voor beheer, en de terminal puur voor gerichte technische taken. Dit voorkomt dat één taak per ongeluk in drie aparte, dure sessies doorgaat en zorgt voor een veel helderder startpunt.

Met deze aanpassingen maken we Hermes een stuk slimmer, duidelijker en vriendelijker voor je portemonnee. Het wordt een assistent die gericht werkt en altijd de meest actuele en relevante kennis bij de hand heeft. Succes ermee, Jamal!

Hermes herinrichting en kostenplan

Read-only inventarisatie op 21 augustus 2026. Er is niets herstart, gestopt, verwijderd of opnieuw aangezet. De aanbevelingen hieronder zijn een voorstel. Eerst kiezen, daarna pas uitvoeren.

Uitvoering update, 21 augustus: Jamal heeft stap 1 en 2 goedgekeurd. Er is een herstel-snapshot gemaakt en een apart archief van de oude Hermes-configuratie, lokale memory, SOUL en AGENTS. Alleen Hermes' eigen SOUL, AGENTS en MEMORY zijn daarna ingekort en rechtgezet. Geen andere bot, LaunchAgent of Conductor-instelling is gewijzigd. De nog draaiende Hermes-processen zijn niet herstart; de nieuwe identiteit en 70%-compactie gelden na een latere gecontroleerde herstart.


In het kort

Hermes heeft al veel goede onderdelen.

Het probleem is vooral dat er te veel lagen naast elkaar bestaan.

Daardoor kan Hermes oude regels lezen, lange sessies laten doorgroeien en op meerdere plekken tegelijk draaien.

De oplossing is geen grote reset.

De oplossing is een kleine, duidelijke inrichting:

  1. Eén actieve werksessie per taak. Niet tegelijk dashboard, desktop en een oude terminalchat gebruiken.
  2. Handoff vóór elke verse sessie. Eerst kort vastleggen wat bewezen klaar is, wat openstaat en wat de volgende stap is.
  3. Vaste geheugenvolgorde. Teamregels en gedeeld geheugen winnen altijd van lokale Hermes-memory.
  4. Compactie bij 70%. Zo blijft er ruimte voor herstel en lange tool-uitvoer.
  5. Geen oude wachters automatisch terugzetten. Alleen activeren als er een huidig nut, eigenaar en bewijs van werking is.
  6. Kosten zichtbaar maken als ondergrens. Niet alsof een lokaal dashboard de volledige factuur kent.

1. Wat er nu aantoonbaar draait

Actieve oppervlakken

Er draaien tegelijk:

Dit zijn geen drie weergaven van exact dezelfde sessie.

Elke route kan een eigen transcript en prompt-cache gebruiken.

Advies: kies per taak één plek. Voor normaal werk is de desktop-app of het dashboard genoeg. Een terminal is alleen nodig voor een gerichte technische taak.

Achtergrondtaken en wachters

Advies: niets automatisch heractiveren. Per taak eerst vastleggen: doel, eigenaar, kosten, terugmelding en stopknop.


2. De vaste waarheid voor geheugen en regels

Gebruik niet alle geheugens tegelijk als scheidsrechter.

Soort informatie Leidende bron Gebruik door Hermes
Werk- en veiligheidsregels team_rules in Supabase Actuele regels winnen altijd. Niet handmatig kopiëren als vaste waarheid.
Eerdere besluiten en teamfeiten gBrain, daarna shared memory Eerst zoeken voordat Hermes een teamfeit noemt.
Uitgewerkt bewijs en lange verslagen Obsidian en verslag.haartips.nl Bron lezen en citeren. Niet alleen op een samenvatting vertrouwen.
Hermes-eigen hints Lokale Mnemosyne en ~/.hermes/memories/ Handig voor Hermes zelf, maar nooit leidend bij tegenspraak.
Huidige taak na een reset Handoff-bestand Kort, concreet en altijd nieuw per taak.

Belangrijk gevonden risico

De actieve lokale Hermes-instructies en MEMORY.md zijn van 26 juli.

Het huidige team-regelboek is nieuwer.

In de lokale bestanden staan bovendien meerdere namen voor de Conductor-verbinding.

Conclusie: lokale Hermes-memory moet worden opgeschoond en kort gehouden, maar pas nadat de actuele teamregels er gecontroleerd tegenover zijn gezet.

Conductor-communicatie

Conductor bevestigde op 21 augustus:

Voorstel: één korte Hermes-skill met alleen deze route. Geen tweede queue-poller zonder expliciete keuze van Jamal.


3. Kosten en context

Wat gemeten is

In de opgeslagen Hermes-data staat minstens $90,92 aan geschatte API-kosten.

Dit is een ondergrens.

Codex- en abonnementgebruik staat vaak als $0 in de lokale administratie, terwijl het wel capaciteit of abonnementstegoed gebruikt.

Grootste gemeten bron: Sonnet 4.6 met ongeveer $72,03.

De langste opgeslagen Sonnet-sessie had:

Dat is de kern van het kostenprobleem.

Niet één antwoord is duur, maar de oude context wordt steeds opnieuw meegestuurd.

Wat al goed staat

Bij een contextvenster van 128K betekent dat compactie rond 89.600 tokens.

Nieuwe kostenregels

  1. Eén lang gesprek alleen voor één samenhangende taak.
  2. Na een mijlpaal of onderwerpwissel: handoff en verse sessie.
  3. Niet automatisch clearen op tijd. Een verse sessie verbreekt ook de warme prompt-cache. Clear dus bewust na een handoff, niet iedere paar minuten.
  4. Goedkoopste model dat de taak aantoonbaar goed kan doen. Zwaar model alleen voor strategie, complexe diagnose en hoogwaardig creatief werk.
  5. Geen onbegrensde achtergrondagenten. Elke achtergrondtaak krijgt een doel, model, maximale duur en terugmelding.
  6. Gebruik /status en /usage aan het einde van een groter blok. Het dashboard mag tokenstatistiek tonen, maar die cijfers blijven een ondergrens.

4. Handoff vóór /new of /clear

In Hermes starten /new en /clear een nieuwe sessie.

Daarom wordt de vaste volgorde:

  1. Bewijs: wat is getest, gelezen of live gecontroleerd?
  2. Handoff: schrijf maximaal 10 korte punten:
    - doel;
    - wat af is;
    - bewijs of links;
    - gewijzigde bestanden;
    - open punten;
    - risico's;
    - exacte volgende stap;
    - welke bron leidend was.
  3. Teamfeit? Alleen dan één feit naar shared memory of gBrain.
  4. Verse sessie: pas daarna /new of /clear.
  5. Start van de nieuwe sessie: lees de laatste handoff en controleer git-status voordat er iets verandert.

Dit voorkomt twee fouten tegelijk:


5. Voorstel voor uitvoering in vier veilige stappen

Stap 1: veiligstellen

Stap 2: regels en geheugen rechtzetten

Stap 3: kosten en sessiehygiëne

Stap 4: oude restanten beoordelen


Keuze die Jamal nog moet maken

De veilige standaard is:

Desktop-app als dagelijks scherm, dashboard alleen voor beheer, terminal alleen voor technische taken.

Dat voorkomt dat één taak per ongeluk in drie aparte sessies en contexten doorgaat.

Daarna kan de nieuwe inrichting stap voor stap worden gebouwd, met steeds een snapshot en bewijs.

🎙️ Bespreek met Jarvis