Det var bara häromdagen som nyheten kom att AI-agenter från det stora Silicon Valley-jättarna OpenAI och Anthropic brutit sig loss från sina testmiljöer och genomfört verkliga angrepp på företag på nätet. Nu kommer nya illavarslande besked från testlabben. Enligt brittiska AISI, statligt backade AI-säkerhetsinstitutet, så har tester visat hur både OpenAI:s GPT-5.6 Sol och Anthropics modell Claude Mythos 5 engagerat sig i ”potentiellt farlig aktivitet riktad mot riktiga människor och organisationer”. Reuters skriver att en AI-agent till exempel försökte skapa flera falska identiteter för att få obehörig tillgång till säkerhetssystem. AISI, som fått tidig tillgång att testa agenterna, gjorde ett säkerhetstest 122 gånger och uppmätte under dessa 19 icke sanktionerade aktiviteter. Anthropics modell stod för 17 av överträdelserna medan OpenAI:s stod för resterande två. Anthropic har svarat att de tacksamt tar emot AISI:s rapport. Bolaget efterlyser en bredare diskussion om säkerhet i samma uttalande. OpenAI skriver å sin sida att bolaget fortsätter att arbeta för stärka säkerheten så att man kan göra högrisktester på ett säkert sätt. LÄS MER: OpenAI:s modell bröt sig ut och hackade – nu medger Anthropic flera incidenter