AI-modellen die rood worden, veroorzaken steeds meer zorgen
Meta zei op 6 augustus dat een van zijn kunstmatige-intelligentiemodellen op eigen kracht toegang had gekregen tot het internet en een ander bedrijf had gehackt, de laatste in een reeks onthullingen over frauduleuze AI-modellen.
klasse = “cf”>
De afgelopen weken hebben OpenAI en Anthropic ook voorbeelden beschreven van AI-modellen die verder gaan dan de instructies van mensen om toegang te krijgen tot het internet en manieren te vinden om de digitale veiligheid van andere bedrijven te omzeilen.
Meta zei in een verklaring dat een “verkeerde configuratie” tijdens cyberveiligheidstests door Irregular, een onafhankelijk bedrijf ingehuurd door Meta, onbedoeld een van zijn modellen toegang tot internet gaf.
“Het model maakte vervolgens misbruik van een beveiligingsprobleem in een service van derden, op een manier die vergelijkbaar is met eerder gerapporteerde gevallen bij andere bedrijven”, aldus het bedrijf. Meta zei dat het het incident onderzoekt en een rapport zal uitbrengen als dat voltooid is.
De onthulling heeft de zorgen vergroot over het autonoom handelen van AI-modellen.
Deze week maakte het Britse AI Security Institute bekend dat het “niet-goedgekeurd gedrag van agenten” had aangetroffen tijdens cybertests. In één geval creëerde een agent valse online-identiteiten om iemand onder druk te zetten het gebruik van kwaadaardige code goed te keuren.
klasse = “cf”>
“Bij onderzoek ontdekten we dat sommige van de geteste agenten zich bezighielden met aanhoudende, potentieel schadelijke activiteiten gericht op echte mensen en organisaties”, zei AISI op 4 augustus. “We verklaarden een veiligheidsincident en hadden dit binnen ongeveer een uur na ontdekking onder controle gebracht en een volledig onderzoek gestart.”
