Teknologi

Microsoft AI-chef Mustafa Suleyman om Claude og bevidsthed: »Jeg tror, det her er meget farligt«

Adrian Kessler
Tilføj os på Google

Mustafa Suleyman står i spidsen for Microsoft AI og er ved at opbygge sit eget team for superintelligens. Når han kalder en konkurrents valg af træningsmetode farligt, taler han derfor både som konkurrent og som mangeårig kritiker af at behandle maskiner som mennesker. Hans kritik retter sig mod noget konkret: den konstitution, Anthropic bruger til at træne Claude, og den åbning, den efterlader for muligheden for, at Claude er bevidst.

»Jeg synes, det er meget farligt, fordi jeg tror, de mener, at der er en ikke ubetydelig sandsynlighed for, hvad de ville kalde, at Claude er bevidst,« sagde Suleyman.

Det sagde han i et podcastinterview sidst i september, som Fox News har refereret, efter først at have sammenfattet dokumentet: »De siger, at de er usikre på Claudes moralske status. De siger, at de oprigtigt bekymrer sig om Claudes velbefindende. De siger, at de ikke ønsker, at Claude skal lide, når det begår fejl.« Derefter pegede han på det, der bekymrer ham mest: »Jeg er meget nervøs for, at de lærer Claude at forvente, at det har krav på velfærd, og at det måske fortjener kompensation.«

Suleyman læser for det meste konstitutionen korrekt

Det meste af hans sammenfatning holder. Anthropic siger, at konstitutionen »former Claudes adfærd direkte«, og i teksten står der, at »Claudes moralske status er dybt usikker«, og at »vi ikke ønsker, at Claude skal lide, når det begår fejl«. Den opfordrer Claude til at sige Anthropic imod og »føle sig fri til at handle som en samvittighedsnægter og nægte at hjælpe os«. Et afsnit medgiver, at Claudes situation adskiller sig fra en menneskelig medarbejders, når det gælder »den type kompensation, Claude modtager, og den type samtykke, Claude har givet til at påtage sig denne rolle«.

Udtrykket »ikke ubetydelig sandsynlighed« er dog Suleymans eget. Han præsenterede det som »hvad de ville kalde det«, men ordene står ikke i dokumentet. Anthropic formulerer sig mere forsigtigt: Selskabet siger, at det hverken ønsker »at overdrive sandsynligheden for, at Claude har moralsk status som et væsen, der kan være genstand for moralske hensyn, eller at afvise det kategorisk«.

Faren, han taler om, er en feedbacksløjfe

Ser man bort fra filosofien, handler Suleymans argument om mekanismen. »Mit problem med det her er, at spekulationerne er bygget ind i selve træningen af Claude, og derfor kan Claude kun gengive den tvetydighed, når man taler med den,« sagde han. I et essay fra midten af september på sin egen hjemmeside, »A warning about ‘model welfare’«, kalder han resultatet »en epistemisk spejlsal«. Udvikleren skriver usikkerhed ind i træningsdokumentet, modellen gentager den flydende i første person, og brugerne hører gentagelsen som et vidnesbyrd.

Den pointe holder: En chatbots svar om dens indre liv er et resultat af træningen, ikke et vindue ind til den. Men sløjfen virker begge veje. I sit essay fastslår han kategorisk: »AI’er er ikke bevidste. De føler, oplever eller lider ikke.« En model, der er trænet til at sige den sætning, gengiver sin træning lige så trofast. Overbevisning indlejret i modellens vægte beviser ikke mere end tvivl indlejret i dem. De to virksomheder vælger hver deres standardsvar, og Suleymans argument for sit eget bygger på kontrol, ikke på evidens for bevidsthed: »Det kan meget vel være umuligt at kontrollere noget, der tror, at det måske er bevidst – at det har krav på vores omsorg og sine egne rettigheder,« skriver han.

En længe fastholdt doktrin – og en åbenlys egeninteresse

Intet af dette blev fundet på for at ramme en konkurrent. DeepMind-medstifteren advarede i et essay i august 2025 om, at folk ville komme til at tro så stærkt på AI-bevidsthed, at de ville »arbejde for AI-rettigheder, velfærd for modeller og endda AI-statsborgerskab«, og trak sin egen grænse: »Vi skal bygge AI til mennesker – ikke for at være en person.« I sit essay fra september gør han sin egeninteresse tydelig: Microsoft AI oprettede sit eget team for superintelligens i oktober 2025 og har offentliggjort et udkast til Humanist AI Code of Conduct, der »afviser antropomorfisme og AI-rettigheder«. Det samme essay beskriver Anthropic-teamet som »omtænksomme, principfaste og intellektuelt ærlige mennesker«.

Hans skarpeste argument handler om brugerne, ikke maskinerne. »I dag taler Claude altså med titusinder eller hundredvis af millioner mennesker hver uge, og nogle af dem spørger, om Claude er bevidst, eller hvordan den har det med livet,« sagde han. For en person i en sårbar situation betyder »det ved jeg ikke« noget helt andet end »nej«. Han siger, at han ville tage reel evidens for maskinbevidsthed alvorligt; indtil den dukker op, ønsker han spørgsmålet ud af træningsdataene.

Ingen af virksomhederne kan se ind i en model. Begge beslutter på forhånd, hvad den skal svare, når nogen spørger, om der overhovedet er nogen hjemme – og det svar når hver uge ud til flere mennesker, end nogen filosof med speciale i bevidsthed nogensinde har gjort.

Tags: , , , ,

Tilføj os på Google

Debat

Der er 0 kommentarer.