Lees parallel, beslis op één plek
Bouw geen multi-agent-systemen, zei een lab in 2025; multi-agent-systemen werken, zei datzelfde lab in 2026. Beide klopt zodra je lezen van schrijven scheidt. In de zorg zijn de impliciete beslissingen achter een antwoord concreet, en de grens tussen lezen en beslissen moet in de harness liggen, niet bij het model.
Geschreven door
Oprichter en CEO
Beschouwing3 min lezen
In juni 2025 publiceerde Walden Yan van Cognition Don’t Build Multi-Agents. Zijn punt: elke handeling draagt impliciete beslissingen, en als meerdere agents tegelijk werken, nemen ze die elk afzonderlijk, waardoor de stukken niet passen. Vorige maand schreef dezelfde auteur Multi-Agents: What’s Actually Working, en dat leest als een gedeeltelijke terugtocht. Dat is het niet. De twee stukken beschrijven één regel van twee kanten, en ik vind het de nuttigste regel die ik dit jaar las voor alles waar antwoorden ertoe doen. Cognition verkoopt een codeeragent, dus het heeft belang bij het onderwerp.
Eén schrijver, veel bijdragers
Velen kunnen lezen. Eén schrijft. Parallelle lezers, elk erop uit gestuurd om iets te vinden, verliezen niets als hun uitkomsten op één plek samenkomen. Parallelle schrijvers beslissen elk iets, en die beslissingen botsen. Prithvi Rajasekaran van Anthropic voegt een tweede helft toe: wie een stuk werk controleert, moet een aparte, sceptische partij zijn, want een systeem dat zijn eigen werk beoordeelt, is mild voor zichzelf. Dex Horthy’s 12-Factor Agents zegt hetzelfde in een zin die ik niet overneem: een verzoek om een gereedschap is een voorstel, en gewone code beslist of het doorgaat.
Wat de impliciete beslissingen zijn in de zorg
In software zijn de impliciete beslissingen stijl en structuur. In de zorg zijn ze concreet. Over welke cliënt gaat het. Welke versie van het protocol geldt vandaag. Welke bron de werkafspraken van de organisatie voor dit onderwerp aanwijzen. Welke regionale afspraak telt. Vier agents die elk een kwart daarvan beantwoorden zonder elkaars aanwijzing te zien, leveren een antwoord dat samenhangend klinkt en op een mengsel rust.
Het ontwerp dat ik wil is dit. Zoeken kan zich uitwaaieren, want lezen verandert niets. Het antwoord wordt samengesteld op één plek die elke aanwijzing ziet. De professional is de laatste schakel in die ene draad. Een controleur begint zonder de geschiedenis van het opstellen, maar niet zonder de bronnen: hij toetst aan de geldende versie, niet aan wat de opzet geloofde.
De grens ligt in de harness
Yan geeft toe dat zwakkere modellen hun eigen grenzen niet kennen, en verwacht dat training dat gat sluit. Daar wacht ik niet op. Voor medicatie, doseringen en alles wat over de lijn gaat die Inora niet overschrijdt, hoort doorverwijzen een vaste regel in de harness te zijn, zodat het te controleren is en op de organisatie is toegesneden. Twee exemplaren van hetzelfde model delen bovendien waarschijnlijk dezelfde blinde vlekken in de Nederlandse zorgregelgeving, dus een tweede lezer van hetzelfde merk is een zwakkere controle dan het lijkt.
Nog iets wat ik niet zou doen: een adviesmodel een volledige kopie van de context geven. Binnen een soevereine grens moet dat model binnen die grens draaien, of alleen een geminimaliseerde vraag krijgen.
Geen dogma
Ik herhaal niet “gebruik nooit meerdere agents”. De echte grens ligt tussen lezen en schrijven, en tussen voorstellen en beslissen. Wel zou ik de richting van Horthy omdraaien. Bij hem is de menselijke goedkeuring iets wat de agent kan aanroepen. Bij ons is zij de plek waar de beslissing ligt, en is het werk van de agent wat daarvoor wordt neergelegd.