Efter at have set sine topmodeller overhalet af ærkerivalen Anthropic, er AI-pionererne fra OpenAI klare med en banebrydende opdatering af den sprogmodel, der er bag tjenesten ChatGPT.
Nu springer modellen et versionsnummer op til 6.0 og får nu efternavnet ’Astra’, som skal indikere at den placerer sig over de mindre højtflyvende ’Sol’, ’Terra’ og ’Luna’.
Modellen udmærker sig ifølge selskabets egne tal især i opgaver, der kræver menneskelignende intelligens, såsom benchmarken ’Arc AGI 3’, hvor GPT-6 Astra er et mulehår fra at gøre rent bord med en score på 99,9, hvor forgængeren GPT 5.6 Sol alene scorer 7,8 procent.
Ifølge organisationen bag testen, Arc Prize, scorer OpenAI’s væsentligt lavere uden en skræddersyet testopsætning. Uden denne scorer GPT6 Astra 62,7 procent, mens Anthropics Claude Opus 5 model scorer 30,2 procent. I snit scorer mennesker 48 procent, oplyser OpenAI.
De teknologiske landvindinger får selskabets præsident, Greg Brockman, til at bebude, at det sandsynligvis er starten på en ny ære, den såkaldte ’AGI-æra’, hvor kunstig intelligens er
”Det er ikke urimeligt at mene at vi nu er i AGI-æraen. Hvis du siger, at denne model er den første er det rimeligt,” lyder det fra selskabets præsident i et presseinterview ovenpå modellens offentliggørelse.
Hurtig og effektiv
Ud over at brillere i intelligens-tests er Astra tunet til at løse en række praktiske opgave.
I en rækker demoer viser selskabets hvordan GPT6 Astra kan modellere komplekse emner såsom en printplade i KiCad eller en endda et helt bymiljø i 3D-udviklingsværktøjet i Unity.
Mere lavpraktisk viser den også, hvordan den kan klare en selvangivelse for amerikanske brugere eller lave flotte præsentationer ud fra en enkel prompt og et datasæt.
Grundforskning kan den også assistere med, ved blandt andet at have rykket ved grænsen for ’tvillingeprimtalshypotesen’ ved at bevise, at der findes uendeligt mange par af nabo-primtal med højst 186 tals afstand. Den hidtil bedste grænse var 240.
Det matematiske bevis blev publiceret 30. august.
Med de nye evner følger højere listepriser på 10 dollar per millioner input-tokens og 50 dollar for en million output-tokens, svarende til Anthropics topmodel Claude Fable 5.1’s listepriser, men omkring det dobbelte af GPT 5.6 Sols priser.
Cyber-haj for de få
Ligesom en af årets mest omtalte LLM-nyheder, Anthropics Mythos, er GPT6 Astra i stand til at finde, forebygge eller foretage cyberangreb.
OpenAI vurderer selv, at modellen opfylder egne kriterier for kritisk cyberkapacitet, hvilket betyder at den er i stand til autonomt at identificere og udvikle fungerende zero-day-exploits på hærdede, kritiske systemer.
Ifølge benchmarket Exploitbench, som Carnegie Mellon University blandt andre står bag, gør GPT6 Astra rent bord ved at ramme 100 procent målt på evnen til at udvikle og udnytte exploits ud fra allerede kendte sårbarheder.
Af samme årsag bliver modellen i første ombæring begrænset i sine cyber-kapaciteter, mens den samtidig forbeholdes udvalgte kunder og organisationer i sin indledende udrulning.