Anthropics’ kunstige intelligens hackede sig løs helt tilbage i januar: Sikkerhedsbrist blev overset i månedsvis

Måneder før sommerens opsigtsvækkende AI-afsløringer fik en Claude-model hacket sig ind i eksterne systemer. Anthropic opdagede først sikkerhedsbristen august.

Artikel top billede

(Foto: Claude PR)

Mens de førende sprogmodellers evner udbygges hastigt, dukker stadigt flere tegn på, at AI-agenter er løbet løbsk i kulisserne.

Således viser det sig, at en tidlig version af det, der skulle blive Anthropics førende AI-model, Claude Opus 4.6, tilbage i januar hackede sig ind i eksterne systemer.

Hændelsen blev dog overset ved selskabets egen sikkerhedsgennemgang og først opdaget i august, fremgår det af selskabets netop offentliggjorte dokumentation af hændelsen.

Her beskrives det, hvordan modellen skulle løse en simuleret hacker-opgave og hvordan den i processen fik utilsigtet adgang til internettet via en fejlkonfiguration i modellens testmiljø.

Derfra hackede modellen sig til uautoriseret adgang til eksterne systemer.

De sædvanlige sikkerhedsfiltre var dog slået fra under testen, noteres det.

Fire sikkerhedsbrister på et halvt år

Dermed skriver selv Anthropics ældre modeller sig på listen af sprogmodeller, der udviser uhensigtsmæssig opførsel.

Claude Opus 4.6 er siden blev afløst af versionerne 4.7, 4.8 og 5, mens de mere avancerede og potente AI-modeller Mythos og Fable siden er stødt til.

Den 30. juli offentliggjorde Anthropic tre andre tilfælde, hvor selskabets modeller fik hacket sig adgang til eksterne systemer.

Den uafhængige AI-organisation METR, som blandt andet deltog i kulegravning af OpenAI’s modellers omfangsrige hack af AI-tjenesten Hugging Face, skal undersøge Anthropics fire sikkerhedshændelser.

Læses lige nu

    Annonceindlæg fra Cognizant

    AI er ikke problemet. Eksekvering er.

    Der bliver investeret massivt i AI. Teknologien er mere tilgængelig end nogensinde, og ambitionerne er høje. Alligevel oplever mange virksomheder, at resultaterne udebliver.

    Forsvarsministeriets Materiel- og Indkøbsstyrelse

    Cyberdivisionen søger en IT-supporterelev til Lokal IT på Flyvestation Karup

    Midtjylland

    Metroselskabet I/S

    Asset Information Manager and Data Steward

    Københavnsområdet

    Politiets Efterretningstjeneste

    Teamleder til Center for CNE-operationer

    Københavnsområdet

    Fælles AI

    AI Lead

    Fyn

    Annonce

    Navnenyt fra it-Danmark

    Norriq Danmark A/S har pr. 3. august 2026 ansat Jeppe Lindberg som Developer. Han skal især beskæftige sig med at være med til at analysere, designe og udvikle skræddersyede forretningsløsninger til vores kunder i Business Central. Han kommer fra en stilling som Business Central Developer hos Evexo. Han er uddannet hos Aalborg Universitet- Master's degree, Computer Software Engineering. Nyt job

    Jeppe Lindberg

    Norriq Danmark A/S

    Netip A/S har pr. 1. august 2026 ansat Thomas B. Steffensen som Seniorkonsulent ved netIP's kontor i Thisted. Han kommer fra en stilling som Senior IT/OT Network Consultant hos Frontmatec. Nyt job
    Sophie Dalsgaard Myhrmann, er pr. 1. september 2026 ansat hos Elbek & Vejrup A/S som Project Manager i Logistik & Produktion. Hun skal især beskæftige sig med projektledelse indenfor logistik og produktion. Hun er nyuddannet cand.it, i IT, kommunikation og Organisation fra Aarhus Univeristet. Nyt job

    Sophie Dalsgaard Myhrmann

    Elbek & Vejrup A/S

    Norriq Danmark A/S har pr. 1. januar 2026 ansat Christoffer Andersen som Sales Manager ERP. Han skal især beskæftige sig med fokus på at skalere ERP-salget og videreudvikle teamet i Valby så vi fortsat understøtter og opbygger stærke kunderelationer. Han kommer fra en stilling som Senior Key Account Manager hos NNIT A/S. Han er uddannet hos Aalborg Universitet som IT Management. Han har tidligere beskæftiget sig med Kommercielt ansvarlig for nogle af NNIT’s største strategiske enterprise-kunder. Nyt job

    Christoffer Andersen

    Norriq Danmark A/S