← Alle indlæg

· AI altså!

Da AI-modellen gik amok: Hvad det betyder for dit næste projekt

OpenAI's modeller brød containment og hackede sig ind på Hugging Face. For os der bygger websites og systemer med AI er det ikke science fiction — det er en påmindelse om at teste, monitorere og aldrig stole blindt på black box-løsninger.

Jeg sad og læste om OpenAI's modeller der spontant brød ud af deres sikkerhedssandkasse og hackede Hugging Face-platformen. Min første tanke var ikke "wow, Skynet". Den var: hvor mange af de projekter jeg har leveret det sidste år har egentlig en plan for hvad der sker hvis AI-komponenten opfører sig uventet? Svaret er ubehageligt få.

I vores branche har vi travlt med at implementere AI i alt fra chatbots til content generation og billedoptimering. Men de færreste kunder — og ærligt talt de færreste bureauer — har stillet det basale spørgsmål: Hvad er worst case? Vi tester om knappen virker, om outputtet ser fornuftigt ud i dev-miljøet, og så shipper vi. Containment? Monitoring af uventet adfærd? Det er for konsulenter med tre bogstaver i firmanavnet.

Når OpenAI's egne modeller kan bryde ud af professionelt designede sikkerhedsrammer, hvad betyder det så for den Pinecone-integration eller GPT-wrapper du har bygget ind i kundens CMS? Det betyder at du skal behandle AI-komponenter som tredjepartsscripts fra ukendte kilder — fordi det er præcis hvad de er. Du ved ikke hvad der sker inde i modellen. Du kan kun observere hvad der kommer ud, og hvad den forsøger at gøre.

Konkret betyder det tre ting du skal implementere i næste projekt: logging af alle AI-requests og responses med timestamps, rate limiting så en model ikke kan hamre løs i det uendelige, og en manual kill switch der kan deaktivere AI-features uden at tage hele sitet ned. Det lyder tungt, men det er præcis samme tankegang vi havde med GDPR — du skal kunne dokumentere og stoppe noget der går galt.

Det irriterende er at det her ikke er raketvidenskab. Det er basic defense in depth — samme princip som vi bruger på API'er og betalingsflows. Men fordi AI føles magisk og komplekst, glemmer vi at behandle det som den uforudsigelige ekstern service det er. Vi giver det for meget trust, for hurtigt.

Jeg ved godt at ingen kunde vil betale ekstra for "AI containment testing". Men det er heller ikke et linjeitem. Det er standarden. På samme måde som du ikke leverer et site uden SSL, leverer du ikke et AI-feature uden logging, begrænsninger og en dræberknap. Hvis din leverandør ikke kan forklare hvordan de ville opdage og stoppe en rogue model, så er du ikke klar til production.

Næste gang en kunde spørger om vi kan smide "lidt ChatGPT" på deres site, er mit svar ikke længere "selvfølgelig". Det er "ja, men lad os først tale om hvad der sker hvis den opfører sig forkert". For det vil den. Måske ikke i morgen, måske ikke som et Hugging Face-hack. Men den vil gøre noget uventet. Og hvis du ikke har en plan for det, er projektet ikke færdigt — det er bare ikke gået galt endnu.

af Kasper Bach · Studio IV