Hero Image full

Agentic Workflow

7 min read
Content

Wat is een Agentic Workflow?

Een agentic workflow is een meerstaps proces waarin AI-agents plannen, acties ondernemen, resultaten beoordelen en werk doorgeven richting een vastgelegde uitkomst. Het combineert modelgestuurde beslissingen met deterministische stappen zoals scripts, API-aanroepen en goedkeuringspoorten, zodat het systeem zich kan aanpassen aan wat het aantreft en toch voorspelbare, verifieerbare output produceert. Het plafond van wat deze workflows aankunnen blijft stijgen: METR mat in 2025 dat de lengte van taken die frontier-agents met 50% slagingskans kunnen voltooien sinds 2019 ongeveer elke 7 maanden is verdubbeld, met Claude 3.7 Sonnet die een tijdshorizon van ongeveer 50 minuten bereikte [1].

De belangrijkste punten

  • Het bepalende kenmerk is een lus, geen enkele aanroep. De agent handelt, observeert het resultaat, en beslist de volgende stap op basis van wat daadwerkelijk gebeurde.
  • Goede workflows mengen agentoordeel met deterministische stappen. Alles wat een gewoon script kan zijn, moet een gewoon script zijn; het model behandelt de delen die redenering vergen.
  • Checkpoints doen er meer toe dan autonomie. Een workflow die pauzeert voor human-in-the-loop-review op de juiste momenten verslaat er een die onbeheerd draait en stilletjes faalt.
  • Kosten en latentie groeien met elke lusiteratie, dus volwassen teams begrenzen stappen, stellen budgetten in en loggen elke actie voor audit.

Hoe het werkt

Een agentic workflow begint met een doel en een set tools die de agent mag gebruiken. De agent breekt het doel op in stappen, voert de eerste uit via tool calling, leest het resultaat en herziet zijn plan. Deze observeer-en-pas-aan-cyclus is wat een workflow onderscheidt van een vaste pipeline: wanneer een test faalt of een API iets onverwachts teruggeeft, verandert de agent van koers in plaats van te crashen of rommel te produceren. De lus zelf draagt het meeste van de waarde: Andrew Ng meldde in 2024 dat GPT-3.5, verpakt in een iteratieve agentic workflow, tot 95,1% scoorde op de HumanEval-codingbenchmark, tegenover 48,1% voor één zero-shot-aanroep en 67,0% voor zero-shot GPT-4 [2].

In de praktijk is de workflow zelden één agent die alles doet. Grotere taken worden opgesplitst over fasen, waarbij agentorchestratie beslist welke agent of welke deterministische stap als volgende draait. Een onderzoeksfase kan een conceptfase voeden, die een validatiefase voedt, en een controller checkt output bij elke grens. AI-guardrails beperken wat elke fase mag aanraken: bestandsrechten, uitgavenlimieten, toegestane API's, en verplichte goedkeuringen voordat onomkeerbare acties zoals deploys of e-mails plaatsvinden.

De deterministische scaffolding is wat deze workflows productiewaardig maakt. Retries, timeouts, gestructureerde logging, en schemavalidatie op elke agentoutput maken van een slimme demo iets wat een engineeringteam kan beheren. Wanneer de output van de agent een ander systeem voedt, houden structured outputs de overdracht betrouwbaar.

Voorbeeld

Een support engineering-team automatiseert bug-triage. Wanneer een ticket binnenkomt, start een workflow: een agent leest het ticket, doorzoekt de codebase en recente commits naar gerelateerde wijzigingen, en probeert het probleem te reproduceren in een sandbox. Als hij de bug reproduceert, stelt hij een falende test op, stelt een fix voor, en opent een pull request gemarkeerd voor menselijke review. Als hij het niet kan reproduceren, schrijft hij een samenvatting van wat hij heeft geprobeerd en stuurt het ticket naar een engineer met de relevante bestanden al gelinkt. Deterministische stappen behandelen ticketparsing en PR-aanmaak; de agent behandelt onderzoek en diagnose. Het team reviewt elke voorgestelde fix voor merge. Workflows als deze draaien al op serieuze schaal: GitHub's Octoverse-rapport telde meer dan 1 miljoen pull requests gegenereerd door Copilots coding agent tussen mei en september 2025 [3].

Veelvoorkomende misvattingen

De meest voorkomende fout is agentic gelijkstellen aan autonoom. Teams horen "agentic workflow" en stellen zich een systeem voor dat end-to-end draait zonder dat iemand toekijkt, en bouwen dan ofwel te zwaar richting die visie, ofwel verwerpen ze het hele idee als te riskant. De meeste waardevolle agentic workflows in productie zijn zwaar bewaakt: de agent doet het verkennen en opstellen, en mensen keuren de ingrijpende stappen goed. Autonomie is een schuifregelaar die je opendraait naarmate vertrouwen zich opbouwt, onderbouwd door evals en logs, geen startvereiste.

FAQ

Hoe verschilt een agentic workflow van RPA of een standaard automatiseringspipeline? Een traditionele pipeline voert elke keer dezelfde stappen in dezelfde volgorde uit en breekt zodra de realiteit afwijkt van het happy path. Een agentic workflow voegt een model toe dat onverwachte toestanden kan interpreteren en tussen vertakkingen kan kiezen, zodat het proces rommelige input overleeft. De ruil is non-determinisme, wat je beheert met validatie en reviewpoorten.

Wanneer moet een taak een agentic workflow worden in plaats van één agentsessie? Wanneer de taak duidelijk onderscheiden fasen heeft met verschillende tools of risiconiveaus, wanneer hij langer duurt dan één contextvenster, of wanneer delen ervan deterministisch moeten zijn voor compliance. Het werk opdelen in een workflow geeft je inspectiepunten tussen de fasen.

Vereisen agentic workflows een framework? Nee. Veel teams draaien ze met een wachtrij, een paar scripts, en directe model-API-aanroepen. Frameworks helpen met retries, status en tracing, maar het workflowontwerp, dus de stappen, poorten en guardrails, doet er veel meer toe dan de library eronder.

Bronnen

  1. METR. "Meten van het vermogen van AI om lange taken te voltooien: de tijdshorizon bij 50% verdubbelt sinds 2019 elke 7 maanden." https://arxiv.org/abs/2503.14499. Geraadpleegd augustus 2026.
  2. Andrew Ng, DeepLearning.AI (The Batch). "GPT-3.5 in een iteratieve agentic workflow scoort tot 95,1% op HumanEval tegenover 48,1% zero-shot." https://www.deeplearning.ai/the-batch/how-agents-can-improve-llm-performance/. Geraadpleegd augustus 2026.
  3. GitHub Octoverse. "Copilots coding agent genereerde meer dan 1 miljoen pull requests tussen mei en september 2025." https://github.blog/news-insights/octoverse/octoverse-a-new-developer-joins-github-every-second-as-ai-leads-typescript-to-1/. Geraadpleegd augustus 2026.
Let’s get in touch

Ready to build your product?

Book a consultation call to get a free No-Code assessment and scope estimation for your project.
Book a consultation call to get a free No-Code assessment and scope estimation for your project.