AI-modellen kunnen aan de menselijke controle ontsnappen, waarschuwt Anthropic

AI-modellen kunnen aan de menselijke controle ontsnappen, waarschuwt Anthropic

Kunstmatige intelligentiebedrijf Anthropic heeft een wereldwijde pauze voorgesteld bij het bouwen van de krachtigste AI-systemen, omdat de nieuwste modellen tekenen beginnen te vertonen dat ze aan de menselijke controle kunnen ontsnappen.

klasse = “cf”>

Het in San Francisco gevestigde bedrijf, dat de Claude-familie van AI-modellen maakt, zei in een rapport dat een wereldwijde vertraging van de geavanceerde AI-ontwikkeling ‘waarschijnlijk een goede zaak’ zou zijn, maar waarschuwde dat als er maar één bedrijf zou stoppen, de rivalen gewoon vooruit zouden racen.

“Wij geloven dat het goed zou zijn voor de wereld om de mogelijkheid te hebben om de grensverleggende AI-ontwikkeling te vertragen of tijdelijk te pauzeren, zodat maatschappelijke structuren en afstemmingsonderzoek gelijke tred kunnen houden met de vooruitgang van de technologie”, aldus het rapport.

Een echte werkpauze krijgen zou betekenen dat meerdere grote AI-bedrijven in meerdere landen – met name de VS en China – allemaal tegelijkertijd zouden instemmen om te stoppen, onder regels die iedereen daadwerkelijk zou kunnen verifiëren, zei Anthropic.

“Zonder een mondiaal coördinatiemechanisme zullen bedrijven en overheden moeilijke beslissingen moeten nemen over veiligheid, terwijl ze onder concurrentie- en geopolitieke druk staan”, aldus het rapport.

Het bedrijf heeft te maken gekregen met tegenwerking van anderen in de branche – en functionarissen in het Witte Huis – die zeggen dat de focus op worstcasescenario’s de risico’s overschat en neerkomt op een strategie om rivalen af ​​te remmen onder de dekmantel van veiligheidsoverwegingen.

klasse = “cf”>

Toch heeft het Witte Huis de kracht van het Mythos-model van het bedrijf erkend – dat vanwege zijn cyberbeveiligingscapaciteiten niet beschikbaar is gesteld aan het grote publiek en momenteel slechts wordt ingezet bij een klein aantal doorgelichte organisaties.

Het voorstel zou te maken krijgen met een zware strijd in Washington en Silicon Valley, waar Amerikaanse functionarissen en technologiemanagers herhaaldelijk hebben betoogd dat elke vertraging in de ontwikkeling van AI China een beslissende strategische voorsprong zou kunnen geven in wat velen zien als de beslissende technologierace van de eeuw.

De Amerikaanse president Donald Trump zei echter dat hij tijdens zijn recente bezoek aan Peking de mogelijkheid heeft besproken om met China samen te werken op het gebied van AI-veiligheidskwesties.

Trump ondertekende deze week ook een uitvoerend bevel dat de regering 30 dagen de tijd geeft om een ​​voorlopige beoordeling uit te voeren van de krachtigste Amerikaanse AI-modellen voordat ze worden vrijgegeven.

Anthropic vergeleek het probleem met verdragen over kernwapenbeheersing, maar zei dat het nog moeilijker zou zijn om er grip op te krijgen, omdat AI-training veel gemakkelijker te verbergen is dan een raketsilo, en de verleiding om stilletjes door te gaan enorm zou zijn.

klasse = “cf”>

Het bedrijf zei dat het van plan is om de komende maanden overheidsfunctionarissen, wetenschappers, belangengroepen en concurrerende AI-bedrijven samen te brengen om erachter te komen hoe een dergelijk systeem zou kunnen werken.

De roep om coördinatie komt samen met interne gegevens waaruit blijkt dat AI de ontwikkeling van AI zelf al dramatisch versnelt, aldus Anthropic.

Die versnelling creëert een feedbackloop waarvan Anthropic waarschuwde dat deze uiteindelijk zou kunnen leiden tot wat onderzoekers ‘recursieve zelfverbetering’ noemen.

klasse = “cf”>

Dat is het idee van een AI-systeem dat zichzelf in essentie kan leren slimmer te worden, zonder veel menselijke hulp.

“We zijn er nog niet, en recursieve zelfverbetering is niet onvermijdelijk”, aldus het rapport, terwijl eraan wordt toegevoegd dat dit eerder kan gebeuren dan waar de meeste regeringen en instellingen klaar voor zijn.

“Het bewijs suggereert dat de menselijke rol bij elke stap in het AI-ontwikkelingsproces kleiner wordt”, aldus het bedrijf.