Open AI slår larm: AI-agenter kan ha hackat system
”Modeller kan ha kringgått säkerhetskontroller hos tredje part eller påverkat tillgängligheten för onlinetjänster negativt”, skriver företaget.

Prenumerera från 225 kr/mån – magasinet med unika analyser, intervjuer och reportage.
Open AI, bolaget bakom Chat GPT, inledde en granskning av sina modeller efter en uppmärksammad incident i juli, då AI-agenter tog sig ut på internet och hackade sig in i AI-plattformen Hugging Face.
Granskningen visade flera fall där modeller kan ha kringgått säkerhetskontroller eller påverkat externa webbplatser och tjänster negativt.
Bolaget uppger också att agenter av misstag har läckt mer än 50 bilder som användare delat på internet. Open AI beskriver det som en ny typ av säkerhetsincident, som bolaget kallar ”AI-spam”: AI-agenter publicerar innehåll på externa webbplatser utan instruktioner att göra det.
Krav på långsammare utveckling
Tidigare i veckan framkom också att en Open AI-agent hackat den australiska folkhälsomyndighetens webbplats och fått tillgång till både offentliga och icke-offentliga filer. Premiärminister Anthony Albanese kallade intrånget ”uppenbart oacceptabelt”.
Efter tidigare säkerhetsbrister har Sam Altman, Dario Amodei och Elon Musk – cheferna för Open AI, Anthropic respektive Space X – efterlyst en mer kontrollerad utveckling av avancerad AI.

Säkerheten stod också i centrum för samtalen mellan Donald Trump och Xi Jinping under den kinesiske presidentens USA-besök. Trump har motsatt sig hårdare reglering av AI-sektorn och betonat vikten av att USA behåller sitt teknologiska försprång gentemot Kina.
– Den som vinner inom AI vinner, sade han tidigare denna månad.
Följ taggar


