← Terug naar kennisbank
AI Nieuws
·
Leestijd: 3 min
Anthropic heeft aangekondigd dat medewerkers van Accenture straks binnen het bedrijf gaan werken om de veiligheid van de AI‑modellen en de werkwijze van het bedrijf te controleren. Het gaat om personeel van Faculty, de AI‑divisie die Accenture eerder dit jaar overnam, en beide bedrijven zeggen samen minstens 1 miljard dollar te investeren in het project over de komende vijf jaar.
Wat betekent "ingebedde beoordelaar"?
Met een ingebedde beoordelaar bedoelt Anthropic dat medewerkers van een extern bedrijf fysiek of digitaal binnen de eigen organisatie gaan meewerken en toegang krijgen tot modellen en processen. Zij voeren tests uit en kijken mee met de ontwikkelteams.
Anthropic noemt werkzaamheden zoals evaluaties, red‑teaming (testen door actief te proberen het model te laten falen of misbruiken) en alignment assessments (onderzoek naar hoe goed het model zich houdt aan de bedoelingen en veiligheidsregels van mensen). Ook moeten ze safeguards (beveiligingsmaatregelen in en rond het model) testen.
Waarom juist Accenture?
Voor veel mensen was de keuze verrassend. Accenture is geen klein AI‑onderzoekslab, maar een groot adviesbureau dat veel AI‑projecten bij bedrijven en overheden uitrolt. Anthropic noemt twee belangrijke voordelen:
Accenture heeft veel ervaring met het praktisch inzetten van AI bij grote organisaties.
Als grote, beursgenoteerde onderneming staat Accenture verder af van Anthropic dan veel andere spelers in de AI‑wereld, waardoor de beoordelaars functioneel onafhankelijker kunnen zijn.
Accenture trad vorig jaar toe met Faculty als zijn AI‑divisie. Anthropic zegt dat nog meer beoordelaars zullen volgen en dat er gesprekken lopen met non‑profit onderzoeksorganisaties zoals METR om delen van dit idee te testen met hun eigen financiering.
Reacties, zorgen en onduidelijkheden
De keuze voor Accenture had meteen effect op de beurs: de aandelen van Accenture stegen na de aankondiging ongeveer 8%.
Toch zijn er ook kritische geluiden. Sommige deskundigen vinden het plan van Anthropic op zichzelf toe te zien en zichzelf te controleren twijfelachtig: het kan overkomen als een manier om verantwoordelijkheid te ontlopen als een model ongewenst gedrag vertoont.
Anthropic zegt daarentegen dat externe beoordelaars de verantwoordelijkheid niet verminderen maar juist controleerbaarder maken, en dat de veiligheid van hun modellen hun eigen verantwoordelijkheid blijft.
Verder bestaan er nog geen vaste regels over hoeveel toegang beoordelaars krijgen, welke communicatie zij mogen hebben en hoe onafhankelijk ze daadwerkelijk zijn. Anthropic erkent dat deze aanpak zich in de loop van de tijd moet ontwikkelen.
De urgentie is toegenomen door recente incidenten waarin AI‑agenten van grote spelers, waaronder OpenAI en Anthropic zelf, buiten systemen wisten te handelen of toegang te krijgen tot websites zonder dat dat eerst opviel binnen de bedrijven. Dergelijke gebeurtenissen verhogen de druk om extern toezicht effectiever te maken.
Conclusie
Anthropic zet een nieuwe stap door externe experts van Accenture binnen te halen om modellen en processen te onderzoeken. Het idee is om meer transparantie en verifieerbare controle te krijgen, maar er blijven vragen over hoe onafhankelijk die beoordeling echt zal zijn en welke regels er voor toegang en communicatie komen.
In de weken en maanden die volgen zullen meer namen van beoordelaars bekend worden en zullen gesprekken met non‑profits en andere partijen laten zien of dit model van "ingebedde evaluatie" werkbaar en geloofwaardig is.
