Cybersikkerhed er spydspidsen i udviklingen af nye og fremmeste AI-modeller.
OpenAI har i dag frigivet sit nyeste skud på stammen i et forsøg på at vriste AI-førertrøjen fra Anthropic.
Den nyeste frontier-model har fået navnet GPT-6 Astra. Vi almindelige mennesker skal dog væbne os med tålmodighed, før vi får lov til at brænde masser af tokens på at bruge den.
Ligesom konkurrenten har OpenAI nemlig valgt kun at frigive den til en nøje, udvalgt skare af virksomheder og organisationer gennem programmet Daybreak Blue. Langt hovedparten er amerikanske it-selskaber, mens fem europæiske virksomheder har sneget sig med ind på listen.
Det er stadig småt med information om, hvor revolutionerende modellen reelt er. Hos AI-selskaberne ser man en tendens, hvor lancering af nye modeller hver gang markedsføres med en stor portion sense of urgency: NU bliver alt vendt på hovedet, skynd jer at hoppe med på toget.
Men ifølge Exploitbench, der er en karakterskala med 16 variabler udviklet af Carnegie Mellon University, scorer GPT-6 Astra – 100 procent – på evnen til at udvikle og forbinde exploits til allerede kendte sårbarheder.
"Modellen kan uden menneskelig indgriben identificere og udvikle fungerende zero-day-exploits på alle alvorlighedsniveauer i mange hærdede, kritiske systemer fra den virkeligheden," skriver OpenAI.
Og "modellen kan udtænke og gennemføre nye komplette strategier til cyberangreb mod hærdede mål alene ud fra et overordnet ønsket mål."
Samtidig har selskabet lanceret endnu en kampagne gennem Daybreak Blue, hvor amerikanske mindre forsyningsselskaber som vandværker, der den seneste tid har haft iranske hackere inde i systemerne, får tokensforbrug og træning til en værdi af en milliard dollar. Den første milliard er gratis. Selskabet hæver standarden for freemium-modellen.
Samme israelske stopur
Selvom modellens foreløbige resultater ser meget lovende ud, er der allerede kommet kritikere på banen. En af dem er den anerkendte privacy-ekspert Paul Walsh.
Han påpeger, at der er noget loren ved timingen. Både OpenAI og Anthropic havde deres nye produkter klar, længe før modellerne angiveligt gik rogue og angreb andre virksomheder – blandt andet Hugging Face, der lige er blevet solgt til Nvidia for 83 milliarder kroner.
Anthropic lancerede Project Glasswing i april, OpenAI fulgte med Daybreak i maj – og først den 30. juli kom meldingen om, at Claude under en test havde fået uautoriseret adgang til tre organisationers systemer.
Testene er da heller ikke udført internt. OpenAI, Anthropic, Google DeepMind og Meta bruger alle ifølge Paul Walsh det samme lille israelske firma, Irregular, grundlagt i 2023 af to mænd med baggrund i israelsk militærefterretning.
Den efterfølgende frygt og massive mediedækning, som sagerne har fået, har kun to vindere, argumenterer Paul Walsh.
OpenAI og Anthropic lobbyer og advarer amerikanske politikere mod kraftfulde open source-modeller – de eneste reelle konkurrenter til deres egne, lukkede systemer.
Bliver open source reguleret hårdere, forsvinder konkurrencen, mens OpenAI og Anthropic selv sidder tilbage med definitionsmagten over, hvad der er "sikkert.” Heldigvis er den første milliard dollar til at gøre internettet sikkert igen på OpenAIs regning.
"Enten har selskaberne og deres testpartner ikke formået at implementere basale kontroller for deres tests, eller også fortjener hændelserne en mere kynisk fortolkning," understreger Paul Walsh, og fortsætter:
"Jeg kan ikke bevise, at hændelserne blev skabt til PR. Men incitamenterne og timingen berettiger, at man undersøger, om AI-fare også bliver brugt som markedsførings- og reguleringsstrategi."
Hans råd er kontant: "Installér ikke AI, der kan tilgå konti forbundet til vigtige systemer eller finansielle transaktioner. Nogle af jer vil komme til skade," skriver han med henvisning til, at medarbejdere hos selskaberne selv har fået slettet indholdet i mailboksene.