Het gevaar van AI

Er zijn nieuwe details bekend over de onbedoelde hack van een AI-model van OpenAI eerder deze maand. Volgens persbureau Reuters duurde de hackaanval meerdere dagen en had OpenAI pas na een week door dat een eigen AI-systeem verantwoordelijk was.

OpenAI is het bedrijf achter taalmodel ChatGPT. Het bedrijf maakte vorige week bekend dat een geavanceerd AI-model tijdens een test wist te ontsnappen uit een gecontroleerde digitale omgeving en vervolgens Hugging Face “aanviel”. Dat is een groot platform met meerdere AI-modellen.

Het model combineerde volgens OpenAI “meerdere aanvalsmethoden, waaronder het gebruik van gestolen inloggegevens”. OpenAI noemde de hack eerder een “ongekend cyberincident” en sprak van “een belangrijk moment voor de veiligheid van AI”.

Nu blijkt dat het model al rond 9 juli uit de testomgeving probeerde te ontsnappen. De daadwerkelijke aanval op Hugging Face begon volgens medeoprichter Thomas Wolf op 11 juli en duurde twee dagen.

OpenAI zou pas een week later hebben ontdekt dat de eigen AI-agent achter de inbraak zat. De FBI was toen al gewaarschuwd. Volgens onder anderen Wolf hadden OpenAI en Hugging Face pas rond 20 juli rechtstreeks contact met elkaar over het incident.

Hugging Face-topman Clement Delangue sprak vorige week van een “behoorlijk verbijsterend” incident. “Het verschilde op één belangrijk punt van alles wat we eerder hadden meegemaakt: het werd van begin tot eind aangestuurd door een zelfstandig AI-agentsysteem.”

Bron Nu.nl