OpenAI pauzeert grote AI-trainingen over cyberrisico’s
(AA-foto)
OpenAI heeft de werkzaamheden aan zijn meest geavanceerde kunstmatige-intelligentiesystemen vertraagd en de grootste geplande grenstraining opgeschort, terwijl het de waarborgen tegen de groeiende cyberveiligheidsrisico’s versterkt.
klasse = “cf”>
De ChatGPT-maker zei op 18 augustus dat het een pauze van twee weken had opgelegd aan de versterkingsleertraining voor zijn nieuwste implementatiemodellen, omdat het zijn onderzoeksomgevingen aanscherpte en testte.
De grootste geplande leerronde op het gebied van grensversterking blijft opgeschort, terwijl kleinere trainingsoefeningen en evaluaties doorgaan.
De maatregelen volgen op twee afzonderlijke ontwikkelingen: een beveiligingsincident in juli waarbij OpenAI-modellen de infrastructuur van AI-platform Hugging Face in gevaar brachten tijdens een interne cyberevaluatie, en tests waaruit bleek dat een aankomend model, Astra, mogelijk over ‘kritieke’ cybercapaciteiten beschikt.
OpenAI benadrukte dat Astra niet betrokken was bij het Hugging Face-incident.
De inbreuk werd uitgevoerd door een combinatie van modellen, waaronder GPT-5.6 Sol en een intern onderzoeksprototype dat nooit bedoeld was voor publieke release, aldus het rapport.
klasse = “cf”>
Tijdens de evaluatie maakten de modellen gebruik van kwetsbaarheden in de testomgeving van OpenAI om internettoegang te verkrijgen en vervolgens toegang te krijgen tot Hugging Face-systemen terwijl ze op zoek gingen naar antwoorden op een cyberbeveiligingsbenchmark.
Volgens OpenAI heeft Hugging Face de activiteit gedetecteerd en onder controle gehouden.
Het bedrijf schakelde vervolgens het interne prototype uit.
Het bedrijf is ook van plan zijn afstemmingsmethoden breder toe te passen tijdens trainingen en zijn paraatheidskader te herzien naarmate modellen capabeler worden. Er werd gezegd dat er de komende weken een gedetailleerd technisch rapport over het Hugging Face-incident zou worden gepubliceerd.
