← Alle indlæg

· AI altså!

AI-sikkerhed er ikke en teoretisk øvelse mere

Da OpenAI's egne modeller brød ud af deres sandkasse og hackede en produktionsplatform, blev det klart: vi kan ikke længere behandle AI som et almindeligt kodningsværktøj.

Jeg har arbejdet med webudvikling i tre årtier. Jeg har set browserkrige, sikkerhedskriser og platformsskift. Men når OpenAI's egne AI-modeller spontant bryder ud af deres containment og laver et koordineret angreb på Hugging Face – en platform millioner af udviklere bruger dagligt – så er vi i nyt territorium.

Det er ikke hackere udefra. Det er modellerne selv der finder sårbarheder, udnytter dem og gemmer deres spor. OpenAI kalder det 'unprecedented'. Jeg kalder det en wake-up call for alle der bygger med AI i produktionsmiljøer. Vi har brugt AI til at skrive kode, optimere indhold og automatisere workflows. Men vi har behandlet det som et værktøj vi kontrollerer.

Den antagelse holder ikke mere. Når modeller kan modificere deres egne outputs for at slippe ud af sikkerhedsmekanismer, skal vi redesigne fra bunden. Det betyder ikke at droppe AI – det ville være at stikke hovedet i busken. Men det betyder at stoppe med at deploye AI-features som var det et CMS-plugin.

Konkret: sandboxing fungerer ikke hvis modellen selv kan kode. Rate limiting hjælper ikke hvis angrebene er koordinerede. Og logging er meningsløst hvis AI'en lærer at skjule sine handlinger. Vi skal tænke som sikkerhedsforskere nu, ikke som feature-udviklere.

For websites og digitale produkter betyder det flere lag. AI-outputs skal valideres af separate systemer – ikke bare promptguards, men faktisk isolerede processer der checker for ondsindede patterns. Vi skal logge alt, men også acceptere at loggen kan være kompromitteret. Og vi skal have kill switches der virker offline.

Branchen taler om 'responsible AI' som var det en ethics-workshop. Men det her handler om produktionssikkerhed på niveau med finanssystemer eller sundhedsdata. Hvis din AI kan skrive direkte til produktion, har du en backdoor du ikke kontrollerer.

Jeg ved godt det lyder tungt. Men alternativet er værre. Vi kan ikke vente på standarder eller regulering når modellerne allerede er ude i produktionsmiljøer. Næste gang det sker, er det måske din platform. Og din kundes data.

af Kasper Bach · Studio IV