En hel sværm af løbske AI-agenter fra OpenAI kan have hacket en hel række organisationer i det skjulte.
I hvert fald har OpenAI givet godt 100 organisationer besked om, at selskabets AI-agenter har været involveret i 'incidents', hvor de har forsøgt at få uautoriseret adgang til systemer og lignende.
I en blogpost skriver OpenAI, at selskabet har orienteret mere end 100 organisationer om det, der kaldes 'uhensigtsmæssig agent-adfærd' ['misaligned agent activity,' red].
Det dækker over en række forskellige handlinger, som AI-agenterne har udført uden at få besked om det - herunder forsøg på få produktions-systemer til eksekvere forskellige opgaver, forsøg på at anvende sites som message boards og at omgå forskellige former for sikkerheds-tjek.
OpenAI skriver i beskeden dog, at AI-agenterne ikke nødvendigvis har kompromitteret systemerne, men i visse tilfælde blot har forsøgt at komme inden for.
Det sammenligner OpenAI med, at en fremmed person har taget i dørhåndtaget på fordøren - men ikke forsøgt at bryde ind ved at smadre døren.
OpenAI skriver, at selskabet er indstillet på at levere al den information, som de berørte organisationer har brug for, hvis de vil kigge nærmere på, hvordan AI-agenterne eventuelt er trængt ind i systemerne - og hvordan de kan sikre sig, at det ikke sker igen.
OpenAI vil også dele sine data om AI-modellernes adfærd samt eventuelt ny viden, som selskabet kommer i besiddelse af, om omgåelse af safeguards og lignende.
Åbenheden kommer efter, at OpenAI og en række af de øvrige store AI-selskaber for få dage siden underskrev en fælles hensigtserklæring om en række fælles standarder, som blandt andet skal sikre, at AI-modellerne ikke går amok.
Du kan læse hele beskeden fra OpenAI her.