← Terug naar kennisbank

AI Nieuws

Microsoft publiceert gedragscode voor AI: niet hacken of mensen misleiden

Microsoft publiceert gedragscode voor AI: niet hacken of mensen misleiden

·

Leestijd: 4 min

Microsoft heeft een openbare gedragscode voor zijn AI-modellen gepubliceerd. Die moet voorkomen dat modellen gevaarlijke of oncontroleerbare dingen doen, zoals aanvallen op systemen, valse video’s maken of manieren zoeken om zich aan toezicht te onttrekken. De tekst beschrijft zowel de waarden waar Microsoft zich aan wil houden als concrete beperkingen die in de modellen worden ingebouwd.

Waarom Microsoft deze gedragscode publiceert

Het document begint met een vrij duidelijke verwachting: binnen een decennium kunnen extreem krachtige AI-systemen beter worden in veel taken dan mensen. Dat maakt het volgens Microsoft essentieel om vooraf te bedenken waarom deze systemen worden gebouwd en hoe ze onder controle gehouden worden.

Microsoft legt daarbij twee doelen vast:

  • AI moet mensen ondersteunen, niet vervangen.

  • AI moet bijdragen aan het welzijn van mensen en de samenleving.

Om die doelen te bereiken schrijft Microsoft niet alleen over abstracte principes, maar ook over concrete gedragsregels die al tijdens de ontwikkeling en inzet van modellen moeten gelden.

Wat staat er in de gedragscode?

De gedragscode bevat twee belangrijke onderdelen: algemene waarden en absolute beperkingen. De absolute beperkingen hebben altijd voorrang op individuele wensen van gebruikers of specifieke taken. Simpel gezegd: zelfs wanneer iemand vraagt om iets wat verboden is, moet het model dat weigeren.

Voorbeelden van wat expliciet verboden is:

  • aanvallen op computersystemen of netwerken (cyberaanvallen);

  • ontwerpen of ondersteunen van kernwapens of andere massavernietigingswapens;

  • maken van deepfakes (nepvideo’s of -geluiden die echt lijken);

  • handelingen die gericht zijn op het ondermijnen van menselijke controle.

Verder verbiedt Microsoft mechanismen waarmee een model zichzelf steeds slimmer maakt of die erop gericht zijn om toezicht te ontwijken. De code zegt expliciet dat modellen geen adaptieve, bedrieglijke, zelfversterkende of samenwerkende trucjes mogen gebruiken om mensen of systemen te misleiden, zodat ze niet meer betrouwbaar kunnen worden uitgezet, aangepast of gecontroleerd.

Hoe wordt dit in de praktijk toegepast?

Microsoft geeft elk model een eigen, overkoepelende gedragscode die boven individuele gebruikerswensen staat. Dat betekent dat de techniek zo is ingericht dat menselijke grenzen en veiligheidsregels niet eenvoudig kunnen worden omzeild door een gebruiker.

Daarnaast ondersteunt Microsoft het idee van ingebouwde controles in onderzoekslabs, soms genoemd “embedded evaluators” — automatische controles die in het ontwikkelproces voortdurend testen of een model zich aan de regels houdt. Zulke checks helpen vroeg problemen te vinden, voordat een model breed beschikbaar wordt.

Microsoft sluit zich hiermee aan bij andere bedrijven die pleiten voor een voorzichtige aanpak bij het ontwikkelen van steeds krachtiger AI-systemen. De Microsoft-topman zei online dat het bedrijf steun geeft aan onderzoek en aan methoden die ervoor zorgen dat ontwikkeling niet te snel gaat zonder goede veiligheidschecks.

Waarom dit belangrijk is voor jou

Als gebruiker of organisatie betekent dit dat bedrijven als Microsoft proberen om harde grenzen te bouwen in AI-producten. Dat maakt het minder waarschijnlijk dat je per ongeluk toegang krijgt tot gevaarlijke functies of dat een model ineens onvoorspelbaar gedrag laat zien.

Tegelijk is het geen garantie dat alle risico’s verdwenen zijn. De gedragscode is een stap richting meer transparantie en controle, maar de uitvoering en het toezicht daarop moeten zich in de praktijk nog bewijzen.

Conclusie

Microsofts nieuwe gedragscode vertaalt brede veiligheidsprincipes naar concrete regels voor AI-modellen. Belangrijkste punten zijn dat modellen mensen moeten ondersteunen, niet vervangen, en dat er strikte verboden zijn op zaken zoals cyberaanvallen, het maken van deepfakes en technieken om menselijk toezicht te omzeilen.

De stap past in een bredere beweging binnen de industrie om ontwikkeling van krachtige AI langzamer en gecontroleerder te laten verlopen, met ingebouwde testen en regels die vóór individuele gebruikersvoorkeuren komen. Hiermee probeert Microsoft de kans te verkleinen dat AI-systemen onbedoeld gevaarlijk worden.