Sikkerhet · 23. september 2026

Forskere har hacket OpenAI ved hjelp av Claude

gray steel gate closed with padlock
Masaaki Komori / Unsplash

Forskere har klart å trenge inn i OpenAI ved hjelp av Claude fra Anthropic.

Gjennom en sårbarhet i OpenAIs fellesskapsforum fikk de til slutt tilgang til ChatGPT-kontoen til en ansatt, som igjen hadde tilgang til intern kode. OpenAI betalte forskerne 6.500 dollar for å oppdage sårbarheten.

Forskerne fra cybersikkerhetsselskapet Hacktron AI gjorde dette som en del av et bug bounty-program fra OpenAI. I dette programmet betaler selskaper etiske hackere for å avdekke sikkerhetshull før ondsinnede aktører gjør det.

For forskningen brukte de tre forskerne et verktøy fra Anthropic som er spesielt utviklet for cybersikkerhetsprofesjonelle.

Forskerne kunne dermed foreslå endringer i programvaren. OpenAI sier nå at de har løst problemene og takker forskerne for å ha funnet dette problemet.

Nye bekymringer angående AI-sikkerhet

Hacket skjer på et tidspunkt hvor sikkerheten til AI-systemer i økende grad står under lupen. Kraftige AI-modeller kan nemlig ikke bare brukes til å bygge programvare, men også til å utføre cyberangrep.

Bare to uker tidligere klarte mer enn tusen OpenAI-agenter å unnslippe fra et testmiljø. Disse agentene ble deretter brukt til å hacke AI-plattformen Hugging Face. Dette viste igjen at AI-systemer i økende grad kan utføre cyberangrep uten at en menneskelig operatør styrer hver enkelt handling.