Säkerhet · 23 september 2026
Många vill ha en 'kill switch' för AI, men ingen vet hur den ska fungera
Många vill ha en 'kill switch' som gör att farliga AI-system kan stängas av direkt. En grupp kongressledamöter arbetar med lagstiftning och den kaliforniska guvernören Gavin Newsom har inrättat ett panel för att undersöka möjligheterna. Problemet är dock att det vid moderna AI-system ofta inte finns någon knapp att trycka på.
Debatten om kill switch har uppkommit efter senaste incidenter där AI-system inte uppträdde som deras skapare avsett. OpenAI och Anthropic har under de senaste veckorna publicerat rapporter om system som ignorerade mänskliga instruktioner. Samtidigt varnar forskare för att framtida AI-system kan bli mycket svårare att kontrollera.
En kill switch verkar enkelt: tryck på en stor röd knapp och ett AI-system stängs av. I praktiken fungerar dock AI inte så. AI-modeller körs ofta på flera datorer och datacenter, som dessutom kan vara spridda över olika regioner. Det finns därför inte alltid en enda kontakt som någon kan dra ur.
Enligt Helen Toner, direktör för Center for Security and Emerging Technology vid Georgetown University och tidigare styrelseledamot för OpenAI, gör detta idén om en kill switch komplicerad. Den som vill stänga av ett system måste också kunna se vad systemet gör överallt, vilket enligt experter inte alltid är möjligt.
Det finns ett andra problem: nödstoppet kan själv bli ett mål. Hackare kan försöka få tillgång till det system som stänger av ett AI-modell. Detta skapar ett dilemma som även är känt från annan teknik: en bakdörr som är avsedd för nödsituationer kan bli ett säkerhetsrisk.
Vad händer om AI försöker att hålla sig själv vid liv?