Teknologi

OpenAI kalder Astra sin mest troværdige model, men viser ikke, hvordan den tænker

Adrian Kessler

Astra opererer på tværs af kode, sikkerhedsanalyse, computerbrug og komplekse professionelle opgaver med en hastighed og præcision, der overgår OpenAIs tidligere model, Sol, og Anthropics Fable på standard softwareingeniørbenchmarks. Virksomheden beskriver den som den første model, den har bygget, der krydser det ‘kritiske’ niveau af cybersikkerhedskapacitet: den kan identificere og udvikle exploits for tidligere uopdagede sikkerhedshuller, i en skala og hastighed, som intet menneskeligt team kan matche.

Mekanismen bag dette er en teknik kaldet uigennemsigtig gentagelse (opaque recurrence). Standard sprogmodeller producerer deres ræsonnement som læsbar tekst – tankekæden, som forskere bruger til at revidere beslutninger, fange fejl og verificere, at en model opfører sig som tilsigtet. Astra fungerer uden at producere den tekst. Den kan løse svære problemer uden at efterlade et læsbart spor af processen. OpenAIs chefforsker, Jakub Pachocki, anerkendte skiftet: mere kapable modeller, sagde han, kan ‘udføre sværere opgaver ved hjælp af færre sprogtokens.’ Overvågning bliver sværere i takt hermed.

Det skaber et strukturelt problem, som OpenAIs egne udsagn gør synlige. Virksomheden beskriver Astra som sin ‘mest justerede model’ hidtil. Justering (alignment) – den ingeniørmæssige disciplin, der handler om at få AI-systemer til at opføre sig, som deres designere har tilsigtet – har historisk set været afhængig af at læse, hvad modellen gør skridt for skridt. En model, der ræsonnerer usynligt, gør sin egen justering uverificerbar med den metode. OpenAI har ikke offentligt beskrevet, hvilken alternativ metode den bruger til at verificere Astras adfærd før udrulning.

Greg Brockman, OpenAIs præsident, beskrev Astra som et ‘generationsspring’ og blev spurgt direkte, om den repræsenterer kunstig generel intelligens (AGI). Hans svar: den kontraktuelle AGI-definition, der styrede OpenAIs partnerskab med Microsoft, gælder ikke længere. AGI er nu, sagde han, et ‘spirituelt koncept.’ Denne indramning er vigtig. OpenAIs Microsoft-aftale indeholdt klausuler knyttet til AGI – betingelser, under hvilke vilkårene for partnerskabet ville ændre sig. At beskrive AGI som udefineret holder disse klausuler sovende, uanset hvad Astra rent faktisk er i stand til.

Adgang blev først lanceret til Daybreak, OpenAIs godkendte cybersikkerhedsprogram – en struktur, som virksomheden fremstiller som defensiv-først-udrulning. Begrundelsen er, at organisationer, der søger efter sårbarheder i deres egne systemer, får kapaciteten før dem, der søger efter sårbarheder i andres systemer. Den logik holder kun så længe adgangskontrollerne holder. Astras zero-day-identifikationskapaciteter er netop, hvad en ressourcestærk angriber ville ønske sig. En model, der ræsonnerer uden en læsbar tankekæde, er også sværere at begrænse eller revidere bagefter, hvis noget går galt.

Bredere adgang rulles ud til betalte niveauer – Pro, Plus, Enterprise, Business – og via API’en i den kommende uge.

Tags: , , , , ,

Debat

Der er 0 kommentarer.