Illustratie gemaakt met AI (Claude)
Nadella: behandel elk AI-model als aangetast en bouw een noodrem
Microsoft-topman Satya Nadella vindt dat we elk AI-model moeten behandelen alsof het aangetast is en het vanaf het begin moeten afschermen. Hij wil dat een bevoegd persoon een model altijd kan pauzeren of uitzetten, ook midden in een taak. Hij wil ook onafhankelijke controles en het snel melden van incidenten.
Waarom het ertoe doet: Als de topman van een groot techbedrijf dit vraagt, groeit de druk om AI te kunnen stoppen voordat het misgaat.
Satya Nadella is de baas van Microsoft, het bedrijf achter Copilot. Hij schreef op X over de risico's van zeer geavanceerde AI.
Wat bedoelt Nadella met zwarte dozen?
Nadella schreef op zaterdag 10 oktober een lang bericht op X. Daarin zegt hij dat we AI niet langer mogen zien als een "set van in elkaar geschoven zwarte dozen". Nu krijgen we advies of acties van een model en nemen we die over of wijzen we ze af, zonder te weten hoe ze tot stand kwamen.
Hij wil een systeem waarin je een model kunt insluiten en in de gaten houden. Zo'n model moet ook "onvervalsbaar, voor mensen leesbaar bewijs" achterlaten. Dan kun je achteraf nagaan wat het deed.
Gaat hij verder dan anderen?
Volgens The Verge lijken veel van zijn ideeën op wat andere spelers in de sector al zeggen. Denk aan het op tijd melden van incidenten, onafhankelijke controles en gegevens die je kunt nagaan. Bij het insluiten van modellen gaat hij volgens de site iets verder dan anderen.
Zijn woorden: "We moeten aannemen dat een model aangetast is en het vanaf het begin insluiten. Zie het als een noodrem." Hij zegt ook dat geavanceerdere modellen geavanceerdere technieken om ze in te sluiten nodig hebben. Daarover moeten volgens hem afspraken komen, zodat iedereen dezelfde aanpak gebruikt.
Wat gebeurt er nu?
Het is een oproep, geen besluit. Uit de bron blijkt niet dat Microsoft al concrete maatregelen of een datum noemt. Je kunt dus vooral volgen of er echt gezamenlijke afspraken komen.
Andere bedrijven werken al aan iets verwandts. Anthropic, het bedrijf achter Claude, sluit zijn interne tests af van het internet. Het bedrijf publiceerde op 10 oktober een rapport over onbedoelde acties van modellen tijdens tests en intern gebruik.
The Verge merkt op dat Nadella in zijn bericht steeds spreekt over "superintelligentie". Dat woord kan stof doen opwaaien, maar zijn voorstellen gaan over iets praktisch: kunnen ingrijpen als een model iets doet wat niemand wil.
Gemeld door 1 bron: The Verge AI
Lees de bron (naar de bron)Deel via WhatsAppKlopt er iets niet?
Onderwerpen: MicrosoftAI-veiligheid