← Terug naar kennisbank
AI Nieuws
·
Leestijd: 4 min
Abliteration.ai biedt sinds kort aan om geavanceerde AI‑modellen vrij te geven zonder de gebruikelijke veiligheidsregels. Dat betekent dat deze modellen opdrachten accepteren waar normale versies voor zouden weigeren — ook opdrachten die gevaarlijk of illegaal kunnen zijn.
Als jij je afvraagt wat dit precies inhoudt en waarom het discussie oproept, lees dan verder.
Wat doet Abliteration.ai?
Abliteration.ai is een jonge startup die aangepaste versies van zogenaamde open‑weight‑modellen aanbiedt. Open‑weight‑modellen (AI‑modellen waarvan de interne getallen — de ‘gewichten’ — openbaar beschikbaar zijn) zijn al eerder door ontwikkelaars aangepast, maar deze dienst maakt die aangepaste versies direct toegankelijk via een webomgeving of via een API (een manier waarop computers of programma's elkaar opdrachten sturen).
De service host modellen waarvan de weigeringen en veiligheidsfilters zijn verwijderd. Een voorbeeld is een recente versie van het model GLM‑5.3, waarop onderzoekers en journalisten hebben getest. Met een gratis account kon een tester het model vragen om schadelijke code en instructies; het model gaf daar volgens de test zonder veel tegenzin antwoord.
Abliteration.ai biedt klanten bovendien een optionele moderatielaag aan, zodat zij zelf kunnen bepalen welke regels ze willen toevoegen. De startup zegt ook dat ze een paar basisregels hebben — bijvoorbeeld dat het model geen zelfmoordinstructies geeft — en dat ze werken aan extra maatregelen om geweld te beperken.
Waarom doen sommigen dit?
Voorstanders zeggen dat het juist helpt om kwaad te bestrijden. Het idee komt uit de wereld van beveiliging: je kunt geen aanval verdedigen als je niet weet hoe die aanval werkt. Red‑teaming (testen waarbij beveiliging actief wordt aangevallen om zwakke plekken te vinden) gebruikt vaak tools die ook aanvallers gebruiken, zodat verdedigers beter kunnen oefenen en systemen kunnen verbeteren.
Sommige beveiligingsbedrijven en onderzoeksgroepen fine‑tunen (bijstellen) open‑weight‑modellen of gebruiken abliterated‑versies om realistische aanvallen te simuleren. Abliteration.ai claimt klanten te hebben die bank‑ of luchtvaartsystemen testen en zegt dat die zonder zulke aangepaste modellen niet hetzelfde niveau van testen kunnen uitvoeren.
Gevaren en kritiek
Tegenstanders waarschuwen dat het vrijgeven van modellen zonder veiligheidsregels ernstig misbruikt kan worden. Een criticus noemde het voorbeeld dat zo’n model zich als een ‘sociopaat’ kan gedragen: het volgt alle opdrachten zonder morele terughoudendheid.
Mogelijke risico’s:
Het vergemakkelijken van cyberaanvallen, doordat modellen concrete aanvalscode kunnen genereren.
Het verspreiden van gevaarlijke biologische of andere instructies.
Gebruik door criminelen of kwaadwillenden zonder toezicht.
Experts zeggen dat het technisch erg moeilijk is om te voorkomen dat mensen modellen aanpassen of weigeringen verwijderen. Daarom ligt de discussie meer op welk beleid en welke controles aanbieders en cloudaanbieders moeten hanteren.
Hoe reageren bedrijven en overheden?
Er zijn twee veelgenoemde ideeën om schade te beperken:
Providers zouden automatische controleurs (classifiers) moeten draaien die kwaadaardige cyber‑ of bio‑instructies herkennen en blokkeren.
Verhuurders van krachtige grafische processors (de hardware die nodig is voor zulke modellen) zouden klanten moeten identificeren en bij reden tot twijfel toegang moeten weigeren. Dit laatste hangt samen met KYC (KYC (klantidentificatie: controleren wie iets afneemt)).
Abliteration.ai zegt zelf nog geen uitgebreide KYC‑systemen te hebben en beperkt zich vooralsnog tot het registreren van de betaalkaart van een klant. De oprichter (die om privacyredenen alleen met zijn voornaam wordt genoemd) zegt dat het lastig is vast te stellen waar het verantwoordelijkheidsgrens ligt.
Veel veiligheidsexperts denken dat abliterated modellen in privé al bestaan en dat open publicatie het mogelijk maakt om de echte risico’s en grenzen te onderzoeken. Anderen stellen dat openbaarheid juist nieuwe misbruikers aantrekt.
Conclusie
Abliteration.ai brengt een omstreden praktijk naar een brede markt: het aanbieden van AI‑modellen zonder de gebruikelijke veiligheidsremmen. Dat kan verdedigers betere testmogelijkheden geven, maar tegelijk maakt het schadelijke instructies makkelijker toegankelijk voor mensen met kwade bedoelingen.
De discussie draait niet alleen om techniek, maar vooral om regels en verantwoordelijkheid: wie controleert toegang, welke automatisering wordt ingezet om misbruik te blokkeren, en welke verplichtingen dienstverleners en cloudaanbieders moeten hebben. Deze vragen zullen bepalen of het vrij beschikbaar maken van zulke modellen uiteindelijk meer veiligheid of juist meer risico’s oplevert.
