Teknologi

OpenAI lancerer angribende AI: 95 procent af exploits lykkes

Susan Hill

GPT-5.6-Cyber fandt under intern test en alvorlig sårbarhed i Chromes V8 JavaScript-motor — en sårbarhed, der endnu ikke var offentligt kendt. Modellen identificerede også ukendte fejl i mobile styresystemer, databaser og kernesoftware. OpenAIs nye model er ikke et defensivt værktøj. Den er bygget til at hacke.

Modellen er trænet på GPT-5.6-Sol, OpenAIs nuværende generelle model, og derefter finjusteret specifikt til offensiv sikkerhed. På OpenAIs interne Cyber Capability Evaluation-benchmark gennemførte GPT-5.6-Cyber 95 % af alle anmodninger om exploit-kæder — opgaver som rettighedsforhøjelse, omgåelse af autentificering og eksekvering af vilkårlig kode. Standardversionen af GPT-5.6 gennemfører 1,5 % af de samme opgaver. Den tidligere specialiserede model, GPT-5.5-Cyber, opnåede 57,3 %.

Det spring — fra 57,3 % til 95 % i én generation — er det tal, der definerer dette udspil. Det betyder, at forskellen på, hvad en AI kan gøre, og hvad en dygtig menneskelig angriber kan, er lukket med cirka 40 procentpoint på under et år.

GPT-5.6-Cybers specifikke evner inkluderer identifikation af kendte sårbarheder, opbygning af exploit-kæder fra bunden og fund af zero-days: fejl, som ingen endnu har dokumenteret eller lappet. Den sidste evne er det skarpeste brud med ethvert tidligere AI-sikkerhedsværktøj. At finde zero-days kræver specialiseret ekspertise og betydelig tid. GPT-5.6-Cyber kan nu gøre det på forespørgsel.

OpenAI udgiver ikke modellen offentligt. Adgangen går gennem Daybreak Red, det højere niveau i virksomhedens Daybreak-cybersikkerhedsprogram. Indledende partnere inkluderer Accenture, IBM, CrowdStrike, Cloudflare, Palo Alto Networks, Sophos, Capgemini, EY, KPMG og PwC — store konsulent- og sikkerhedsfirmaer, der vil bruge modellen til at scanne klienters infrastruktur, før angriberne finder de samme fejl.

Hvad adgangskontrollen ikke besvarer, er det sværere spørgsmål: OpenAI bestemmer nu, hvem der må bruge en AI, der er i stand til at finde sårbarheder i enhver software. Den godkendte liste består af store firmaer og topkonsulenthuse. Individuelle sikkerhedsforskere, mindre teams og akademiske institutioner er ikke en del af det indledende udrulning. Chrome V8-fejlen, der blev fundet under test, er under koordineret offentliggørelse med Google — virksomheden har ikke oplyst, hvor mange andre sårbarheder modellen identificerede før lanceringen.

OpenAI oplyser, at de planlægger at udvide Daybreak Red-programmet til yderligere godkendte partnere i de kommende måneder.

For softwareindustrien er regnestykket brutalt: Hvis en AI kan scanne en kodebase for zero-days med en gennemførelsesrate på 95 %, vil ethvert sikkerhedsteam før eller siden have brug for én — eller må regne med, at modstandere allerede har adgang til én.

Tags: , , , , ,

Debat

Der er 0 kommentarer.