En sværm af løbske agenter fra OpenAI har endnu en gang været på spil.
Ifølge nyhedsbureauet Reuters har agenter fra OpenAI undsluppet et lukket testmiljø og overtaget et obskurt Wiki-debatforum, som de brugte til at udveksle ideer.
I et opslag på det sociale medie X erkender OpenAI nu sagen.
”Det er på høje tid, at vi fastlægger standarder for, hvornår og hvordan vi deler oplysninger om hændelser med ’misalignment’ – og ikke kun om egenskaber ved vores modeller, der er relateret til ’misalignment’,” skriver selskabet.
Misalignment, som vi på dansk vil kalde for fejljustering, er en betegnelse for det, der sker, når kunstig intelligens-løsninger begynder at forfølge andre mål end dem, som var meningen.
Det er ifølge OpenAI også det, der var årsagen til det såkaldte Hugging Face-hack, hvor AI-agenter fra OpenAI brød ind hos AI-platformen Hugging Face.
Samarbejder med myndigheder
OpenAI oplyser samtidig i opslaget, at selskabet både arbejder med myndigheder over hele verden om at fastsætte standarder for den type hændelser og selv arbejder på at udvikle en ramme for, hvordan hændelser af den type skal håndteres.
Det er en række uafhængige AI-forskere, som har opdaget hændelsen med det tyske forum, og ifølge forskerne tog hændelsen sin begyndelse den 11. maj i år.
Her fik agenter adgang til det tyske wiki-forum, som de brugte til at dele ideer om, hvordan man besvarer spørgsmål fra websøgninger under tidspres. En menneskelig moderator opdagede opslagene og begyndte at slette dem, da vedkommende antog, at der var tale om en form for spam.
Det fik agenterne til at forsøge at skjule deres opslag, og de begyndte at tilføje ZZZ i emnefeltet for at sikre, at de endte nederst i den alfabetiske sortering på forummet.
I de følgende dage slettede administratoren hundredvis af sider med opslag fra de løbske AI-agenter, indtil agenterne den 22. juni pludselig stoppede med at oprette nye opslag. Det er forskernes antagelse, at agenterne stoppede, fordi folk hos OpenAI havde opdaget dem.