OpenAI waarschuwt voor controleverlies bij slimme AI
AI-ontwikkelaar OpenAI roept op tot de snelle totstandkoming van internationale veiligheidsstandaarden voor de nieuwste generatie kunstmatige intelligentie. In een uitgebreid vision document waarschuwt het bedrijf voor de gevaren van recursive self-improvement (RSI)—het proces waarbij AI-systemen zichzelf autonoom doorontwikkelen en verbeteren. Zonder duidelijke kaders dreigt de mensheid de praktische controle over de technologie te verliezen.
Volgens OpenAI bevindt het AI-onderzoek zich in een stroomversnelling. Doel is het bouwen van een geautomatiseerde AI-onderzoeker die kan helpen bij het oplossen van complexe wetenschappelijke en maatschappelijke vraagstukken. Maar naarmate AI-systemen steeds meer taken overnemen bij het ontwikkelen van hun opvolgers, neemt de snelheid van innovatie exponentieel toe.
Dreiging van controleverlies door 'RSI'
OpenAI benadrukt dat volledig autonome zelfverbetering op dit moment nog niet plaatsvindt en ook niet nagestreefd moet worden zolang de veiligheid niet gegarandeerd is. "Zonder de juiste zorgvuldigheid kan RSI ertoe leiden dat mensen de controle over het AI-ontwikkelproces verliezen en geen toezicht meer kunnen houden op processen die ze niet langer begrijpen," waarschuwt de organisatie. Dit zou kunnen leiden tot minder goed uitgelijnde (unaligned) en potentieel gevaarlijke AI-systemen.
Om versnippering van regels en geopolitieke escalatie te voorkomen, bepleit OpenAI een leidende rol voor de Verenigde Staten in het opzetten van mondiale technische normen. Het bedrijf stelt twee cruciale pijlers voor:
Een internationaal netwerk voor normering: Het benutten van bestaande AI Safety Institutes (onder meer in Japan, het VK, de VS, Frankrijk en Duitsland) via het Center for AI Standards and Innovation (CAISI). Deze standaarden moeten kaders bieden voor het meten van capaciteiten en het risicobeheer rondom geautomatiseerd AI-onderzoek, zonder dat dit direct leidt tot strenge vergunningsstelsels die innovatie of open source-ontwikkeling belemmeren.
Eenduidige meetmethoden en incidentenprotocollen: Het vastleggen van heldere drempelwaarden voor menselijk toezicht, standaarden voor het evalueren van RSI-voortgang en uniforme protocollen voor het melden van beveiligings- en alignment-incidenten.
Internationale samenwerking en dialoog met China
OpenAI trekt de vergelijking met sectoren als de luchtvaart en de financiële sector, waar internationale standaarden en vertrouwde communicatiekanalen zijn opgezet zonder dat landen hun nationale soevereiniteit opofferen.
Naast samenwerking tussen westerse bondgenoten noemt OpenAI ook de directe dialoog tussen de Verenigde Staten en China essentieel om nationale veiligheidsrisico's en kwetsbaarheden in AI-systemen tijdig te delen. Volgens het AI-lab gaat de geopolitieke strijd de komende jaren niet alleen over wie de beste technologie heeft, maar vooral over wie de meest realistische en veilige spelregels weet vast te stellen die wereldwijd worden omarmd.