Als je nu een agentic pentesting-oplossing evalueert, heb je waarschijnlijk dezelfde toonhoogte meer dan eens gehoord: richt het op een doelwit en het ontdekt, valideert en exploiteert aanvalspaden autonoom, zoals een echte aanvaller dat zou doen.
Die belofte is de moeite waard om serieus te nemen. Het is ook de moeite waard om een druktest uit te voeren, en drie vragen doen het zware werk.
- Wat kan de beoordeling daadwerkelijk bewijzen?
- Wanneer wordt dat bewijs geleverd? En,
- Hoeveel van uw omgeving omvat het bewijs?
De meeste evaluaties stoppen bij de eerste stap. Het is echter bij de tweede en derde waar validatieprogramma’s worden gewonnen of verloren.
Eén opmerking over waar we staan: Picus bouwt en verkoopt autonome pentesting. Dat is precies de reden waarom we precies kunnen aangeven waar het eindigt, omdat de limieten bij de methode horen, niet bij de implementatie van welke leverancier dan ook, en geen enkele routekaart kan deze wegnemen.
Het probleem in vier cijfers
Vier cijfers van dit jaar verklaren waarom de tweede en derde vraag nu zwaarder wegen dan de eerste.
- Volume: In de eerste helft van 2026 werden 35.364 CVE’s gevonden, een stijging van 49,5% op jaarbasis.
- Prioritering: Bij slechts 95 van de ongeveer 39.600 CVE’s die in augustus zijn gepubliceerd, is bevestigd dat er sprake is van ‘in-the-wild’-uitbuiting, dus op basis van ernst wordt bij het stellen van prioriteiten feitelijk de verkeerde lijst nagejaagd.
- Snelheid: De gemiddelde tijd tussen onthulling en uitbuiting daalde van 21,5 dagen in 2025 naar 8 uur in 2026.
- Capaciteit: Van de ruim 26.000 kwetsbaarheden die door ontdekking op AI-schaal aan het licht kwamen, werden er slechts 421 upstream gepatcht.
Je kunt je uitweg niet patchen, plannen of voorspellen. U valideert, op basis van bewijs, binnen enkele uren na de wijziging die dit vereiste. Toch een de jaarlijkse pentest laat maar liefst 365 dagen blind venster tussen een verandering en de volgende testEn wekelijkse geautomatiseerde runs laten nog steeds een gat van maximaal zeven dagen achter.
Tegen een exploitatieperiode van acht uur verliezen beiden.
Gartner heeft de conclusie formeel getrokken: zijn Continuous Offensive Security Testing (COST)-model vervangt de point-in-time beoordeling door trigger-aangedreven, risicogelaagde tests voltooid binnen op risico afgestemde tijdsbestekkenvaak minuten of uren, met een planningsaanname dat in 2028 meer dan 60% van de pentestprogramma’s voor ondernemingen als continue validatie zal functioneren. De hamvraag is niet langer “hebben we getest?” Het is “hoe snel valideren we nieuwe blootstellingen?”
Agentic pentesting is het belangrijkste antwoord op die vraag.
Twee bewijzen die agentic pentesting levert
Elke pentest bestaat om één vraag te beantwoorden: zijn we exploiteerbaar? Agentic pentesting beantwoordt deze vraag met de twee bewijzen die er toe doen. Het bewijst individuele blootstellingen zijn al dan niet exploiteerbaarbevestigd door de exploit veilig uit te voeren in plaats van af te leiden uit een versiebanner. En het bewijst een geketend bereik: waar echte exploits zijn geketend vanaf de eerste toegang via escalatie van bevoegdheden en zijdelingse verplaatsing, waarbij het bevestigde pad naar een kritiek bezit als bewijs wordt gerapporteerd.
Wat betreft de activa die het bereikt, is niets overtuigender, en omdat elke oplossing opnieuw kan worden gevalideerd met nog één keer uitvoeren, wordt herstel een verdedigbaar in plaats van hoopvol.
De operatieve zinsnede hier is ‘op de activa die het bereikt’. Het bewijzen van de exploiteerbaarheid is de eerste vraag die beantwoord wordt; de zinsnede geeft stilletjes de andere twee toe: wanneer het bewijs arriveert, en hoeveel van de nalatenschap het dekt.
Het snelheidsverschil – het ‘wanneer’
Voer een agentische pentest verspreid over een landgoed met 250.000 eindpunten en de volledige cyclus duurt weken. Dat is een dramatische verbetering gedurende het kwartaal dat een door mensen geleide betrokkenheid nodig heeftmaar het is nog steeds de verkeerde tijdseenheid.
Zorgvuldige agentische pentesting werkt stap voor stap: voet aan de grond, opsommen, draaien, ketenen, bewijzen. Herhaal dat over een kwart miljoen eindpunten, en het bereik strekt zich uit terwijl de omgeving eronder verandert. Tegen de tijd dat het onderzoek is voltooid, beschrijven grote delen van de resultaten een omgeving die niet meer bestaat.
Weken zijn misschien snel voor een pentest, maar tegen een tijdsbestek van acht uur is het traag. Een diepe veegbeweging alleen kan die kloof niet overbruggen.
De dekkingskloof – het “hoeveel”
Het dekkingsverschil is belangrijker. Live exploitatie kan slechts op een deel van de omgeving worden gericht. Bedrijfskritische productiesystemen, zeer grote segmenten en beperkte zones of zones met luchtspleten zijn verboden terrein voor echte veiligheidsexploitaties, stabiliteits- en toegangsredenen. De duizenden CVE’s zonder werkende exploit zorgen ervoor dat de tool niets kan afvuren. En het venster tussen de onthulling en de eerste exploit, waarin de snelheidscijfers laten zien dat de hele race nu plaatsvindt, is precies, en helaas, het moment waarop een exploit-afhankelijke tool het minste te zeggen heeft.
Tel het op en autonome pentesting alleen al ziet misschien 20 tot 30% van de werkelijke exploiteerbaarheid in een typische onderneming. Het stapelen van een tweede of derde gereedschap verandert niets aan de wiskunde, omdat elk gereedschap in de categorie dezelfde methode deelt, en dus hetzelfde plafond. En gedeeltelijke dekking vermindert de onzekerheid niet. Het verplaatst het eenvoudigweg naar de activa die je hebt overgeslagen, en de aanvaller heeft alleen dat ene ding nodig dat je hebt overgeslagen om de zaken peervormig te laten verlopen.
De wijziging selecteert de validatiemethode
Het dekkingsgat wordt op dezelfde manier gedicht: laat de verandering die de test heeft veroorzaakt, de methode selecteren die deze het snelst en veiligst beantwoordt.
Een opkomende kwetsbaarheid komt op uw bezittingen terecht. De hamvraag is: “is het exploiteerbaar in onze omgeving?” Validatie van exploiteerbaarheid beantwoordt dit binnen enkele uren, over het hele betrokken bereik, door het te testen aanvallertechnieken waarvan de kwetsbaarheid afhankelijk is, geen werkende exploit vereist. Dit beantwoordt het bezwaar dat we het vaakst horen: “Dekt pentesting dat niet al?” Ja, maar alleen waar live uitvoering mogelijk is; Daarentegen bereikt de validatie van de exploiteerbaarheid het grootste deel van de nalatenschap en het grootste deel van de CVE-lijst.
Er wordt een nieuwe campagne waargenomen of er verandert een veiligheidscontrole. De vraag hier is: kunnen we dit stoppen? Validatie van de veiligheidscontrole emuleert de technieken van de campagne tegen uw live verdedigingsstapel en laat zien of elke techniek wordt voorkomen, gedetecteerd of gemist.
Een infrastructuurverandering landt. De vraag van een miljoen dollar is: heeft dit een nieuw aanvalspad geopend? Agentische pentesten bevestigt het met geketend, levend bewijs, wat alleen het kan doen.
Drie methoden, één bevindingenmodel
Eén waarschuwing uit de recente geschiedenis: het beheer van kwetsbaarheden is opgesplitst in eilanden van dubbele bevindingen en tegenstrijdige prioriteiten, en validatie zal deze eilanden opnieuw creëren als elke methode wordt geleverd met een eigen console en wachtrij. Deze drie moeten één gedeeld bevindingenmodel voedengededupliceerd, door bewijsmateriaal ondersteund en bewust van activa, met één achterstand en één afsluitingsstatus per blootstelling.
Dit is het principe van Picus-platform is hierop voortgebouwd, waarbij autonome penetratietests, blootstellingsvalidatie en inbreuk- en aanvalssimulatie allemaal werken op basis van gedeeld bewijsmateriaal.
Tegen een echte klok: een kritische CVE daalt.
- Uur één is verrijkt met informatie over dreigingen.
- Uur twee: de getroffen activa, de kriticiteit en de omringende controles worden in kaart gebracht.
- In uur vier wordt de exploiteerbaarheid van elk getroffen asset beoordeeld, worden aanvalspaden bevestigd waar live testen veilig is, en zijn de controles getest aan de hand van de relevante technieken.
- Uur zes worden maatregelen met een laag risico geïmplementeerd, de rest is doorgestuurd naar de eigenaren en elke oplossing is vóór sluiting opnieuw gevalideerd.
Elke wijziging wordt gevalideerd. Elke blootstelling is bewezen. Binnen enkele uren. Vraag uw demo aan en zie hoe één CVE alle drie de methoden doorloopt op één gedeeld bevindingenmodel.
Zie het draaien, live

Op The Validation Summit 26, georganiseerd door Ron Eddings van Hacker Valley, op 14 oktober om 13.00 uur ET en 15 oktober om 11.00 uur BST, zullen we dit model live in het product uitvoeren. Onze CTO Volkan Erturk zal een opkomende CVE in enkele uren van trigger naar gevalideerde blootstelling aan een bevestigde oplossing brengen, waarbij de juiste methode wordt geselecteerd als de omstandigheden veranderen. Daarnaast opent Mikko Hyppönen met wat er na Mythos is veranderd. Beveiligingsleiders van Chanel, Atlassian en Kraft Heinz zullen bespreken hoe zij zich voorbereiden.
Twee uur. Registratie is gratis. Bekijk zelf hoe de workflow live wordt uitgevoerd.