← Terug naar kennisbank
AI Nieuws
·
Leestijd: 4 min
De snelle ontwikkeling van AI maakt systemen slimmer, maar ook lastiger te controleren. Een nieuw Nederlands-Amerikaans bedrijf probeert daar een oplossing voor te bieden: een onafhankelijke toets en certificering voor AI-agenten, speciaal gericht op gebruik binnen organisaties.
Wie zit erachter en wat doen ze?
De startup heet Artificial Intelligence Underwriting Company (AIUC). Het bedrijf is opgericht door Rune Kvist en Rajiv Dattani. Kvist werkte vroeg bij onderzoeksbedrijf Anthropic. Dattani is voormalig operationeel directeur (COO) van METR, een organisatie die zich bezighoudt met veiligheid van AI.
AIUC zegt bedrijven te helpen beoordelen hoe veilig hun AI-agenten zijn. Als klanten noemt het bedrijf onder meer Cursor, Lovable, Harvey en ElevenLabs.
Financiering trok snel aandacht. Recent kreeg AIUC een Series A-investering van 40 miljoen dollar van onder andere Ribbit Capital, met deelname van First Harmonic. Eerder kwam er al een seedronde van 15 miljoen dollar, onder meer van Nat Friedman via NFDG, Emergence, Terrain en Ben Mann. Daarmee staat de totale financiering op 55 miljoen dollar.
Hoe werkt hun aanpak?
AIUC gebruikt de werkwijze die veel beveiligingsteams al kennen, en past die toe op AI. Als inspiratie diende het veelgebruikte cybersecurity-keurmerk SOC 2, en AIUC ontwikkelde daarop een eigen standaard: AIUC-1. Met die standaard toetsen zij AI-agenten op veiligheid en betrouwbaarheid.
Het proces liep zo:
AIUC vroeg advies aan zo’n 250 beveiligings- en risicoleiders — vooral de mensen die AI-agenten zouden kopen.
Op basis van die feedback bouwde het bedrijf een testpakket.
Een AI-agent wordt door ongeveer 5.000 afzonderlijke tests gehaald. Die tests kijken naar situaties zoals jailbreaks (manieren om beperkingen te omzeilen), hallucinaties (wanneer een AI feiten verzint) en mogelijke datalekken.
Na de tests komt er een rapport van ongeveer 100 pagina’s. Dat geeft precies aan waar een agent betrouwbaar is en waar risico’s zitten.
Opvallend is dat AIUC deels AI gebruikt om de tests uit te voeren en de resultaten te analyseren. De eindcontrole en het officiële auditrapport worden echter door mensen gedaan.
Hoe verschilt dit van bestaand onderzoek?
Organisaties zoals METR voeren ook tests uit. METR test vooral hoe goed systemen taken uitvoeren. AIUC richt zich expliciet op de veiligheidsvragen die in bedrijven spelen: voldoen de systemen aan afspraken die organisaties met hun klanten hebben gemaakt? Kunnen ze op een betrouwbare manier ingezet worden zonder onverwachte risico’s?
Ook aan de kant van grote spelers groeit de bezorgdheid. Leiders bij vooraanstaande AI-bedrijven spreken publiekelijk over het tempo van ontwikkeling en over incidenten met slecht gedrag van AI. Sommige voorstellen gaan zelfs uit van een verplichting voor labors om onafhankelijke toezichthouders in te schakelen. AIUC pakt dit aan door een onafhankelijk oordeel te bieden, maar zonder zich fysiek in te regelen bij de klant.
Wat betekent dit voor bedrijven?
Voor organisaties kan zo’n onafhankelijke toetsing helpen bij beslissingen over aankopen en inzet van AI. Concreet betekent het:
Meer zicht op waar een AI-agent veilig kan worden gebruikt.
Concrete aanwijzingen over welke beperkingen of aanvullingen nodig zijn.
Een standaardrapport waarmee kopers risico’s kunnen vergelijken en verantwoorden.
Bedrijven kiezen steeds minder vaak een AI-systeem omdat het "slim genoeg" is. Ze besluiten eerder op basis van juridische en klantafspraken: wat mag het systeem wel en niet doen? Tot nu toe bestaat er voor veel van die vragen geen waterdicht, onafhankelijk antwoord. AIUC wil dat gat vullen.
Conclusie
AIUC biedt een onafhankelijke toets en een keurmerk voor AI-agenten, gebaseerd op een standaard die lijkt op bekende beveiligingsnormen. Met duizenden tests en uitgebreide rapporten wil het bedrijf duidelijk maken waar AI veilig en betrouwbaar werkt en waar niet. Voor organisaties die AI willen inzetten, kan zon externe beoordeling helpen om betere, verantwoorde keuzes te maken.
