Teknologi

Microsoft AI-sjef Mustafa Suleyman om Claude og bevissthet: «Jeg tror dette er svært farlig»

Adrian Kessler
Legg oss til på Google

Mustafa Suleyman leder Microsoft AI og bygger opp et eget superintelligensteam. Når han kaller en konkurrents valg av treningsmetode farlig, uttaler han seg derfor både som konkurrent og som en mangeårig kritiker av å behandle maskiner som mennesker. Kritikken hans retter seg mot noe konkret: konstitusjonen Anthropic bruker til å trene Claude, og rommet den åpner for muligheten for at Claude er bevisst.

«Jeg synes dette er svært farlig, fordi jeg tror de mener det er en ikke ubetydelig sannsynlighet for at Claude er bevisst», sa Suleyman.

Det sa han i et podkastintervju i slutten av september, ifølge Fox News, etter å ha oppsummert dokumentet: «De sier at de er usikre på Claudes moralske status. De sier at de oppriktig bryr seg om Claudes velferd. De sier at de ikke vil at Claude skal lide når det gjør feil.» Så pekte han på det som bekymrer ham mest: «Jeg er svært bekymret for at de lærer Claude å forvente at det har krav på velferd, og at det kanskje fortjener kompensasjon.»

Suleyman har stort sett forstått konstitusjonen riktig

Det meste av oppsummeringen hans stemmer. Anthropic sier at konstitusjonen «former Claudes atferd direkte», og i teksten står det at «Claudes moralske status er svært usikker», og at «vi ikke vil at Claude skal lide når det gjør feil». Dokumentet ber Claude si imot Anthropic selv og «føle seg fri til å opptre som en samvittighetsnekter og nekte å hjelpe oss». I ett avsnitt innrømmes det at Claudes situasjon skiller seg fra en menneskelig ansatts når det gjelder «hva slags kompensasjon Claude mottar, og hva slags samtykke Claude har gitt til å påta seg denne typen rolle».

Uttrykket «ikke ubetydelig sannsynlighet» er imidlertid Suleymans eget. Han presenterte det som «det de ville kalt» det, men ordene står ikke i dokumentet. Anthropics egen formulering er mer forsiktig: Selskapet sier at det verken ønsker «å overdrive sannsynligheten for at Claude har status som moralsk pasient, eller å avvise muligheten uten videre».

Faren han sikter til, er en tilbakekoblingssløyfe

Ser man bort fra filosofien, handler Suleymans argument om mekanismen. «Problemet mitt er at denne spekulasjonen er bakt inn i selve treningen av Claude, og at Claude derfor bare kan gjenta denne tvetydigheten når man snakker med den», sa han. I et essay på sitt eget nettsted i midten av september, «A warning about ‘model welfare’», omtaler han resultatet som «en epistemisk speilsal». Utvikleren skriver usikkerhet inn i treningsdokumentet, modellen gjentar den flytende i første person, og brukerne oppfatter gjentakelsen som et vitnesbyrd.

Det poenget treffer: En chatbot som svarer om sitt eget indre liv, gir et resultat av treningen, ikke et innblikk. Men sløyfen går begge veier. I essayet slår han fast: «KI-er er ikke bevisste. De føler, opplever eller lider ikke.» En modell som er trent til å si den setningen, gjengir treningen sin like lojalt. Visshet som er skrevet inn i modellens vekter, beviser ikke mer enn tvil som er skrevet inn i dem. De to selskapene velger et standardsvar på forhånd, og Suleymans begrunnelse for sitt valg handler om kontroll, ikke om bevis for at maskiner har et sinn: «Det kan godt vise seg å være umulig å kontrollere noe som tror at det kan være bevisst – at det har krav på vår omsorg og egne rettigheter», skriver han.

En veletablert doktrine, med en tydelig egeninteresse

Ingenting av dette ble funnet på for å ramme en konkurrent. DeepMind-medgrunnleggeren advarte i et essay fra august 2025 om at folk ville komme til å tro så sterkt på KI-bevissthet at de ville «kjempe for KI-rettigheter, velferd for modeller og til og med KI-statsborgerskap». Han trakk opp grensen slik: «Vi må bygge KI for mennesker, ikke for å være en person.» I september-essayet gjør han rede for sin egeninteresse: Microsoft AI opprettet sitt eget superintelligensteam i oktober 2025 og har publisert et utkast til Humanist AI Code of Conduct, som «avviser antropomorfisering og KI-rettigheter». I det samme essayet omtaler han Anthropic-teamet som «reflekterte, prinsipielle og intellektuelt redelige mennesker».

Det skarpeste argumentet hans handler om brukerne, ikke maskinene. «I dag snakker Claude med titalls eller hundretalls millioner mennesker hver uke, og noen av dem spør om Claude er bevisst, eller hvordan det opplever livet», sa han. For en person i en sårbar situasjon betyr «Jeg er ikke sikker» noe helt annet enn «nei». Han sier at han ville tatt reelle bevis på maskinbevissthet på alvor. Fram til slike bevis dukker opp, vil han ha spørsmålet ut av treningsdataene.

Ingen av selskapene kan se inn i en modell. Begge bestemmer på forhånd hva den skal si når noen spør om det er noen der inne, og svaret når flere mennesker hver uke enn noen sinnsfilosof noen gang har gjort.

Tagger: , , , ,

Legg oss til på Google

Diskusjon

Det er 0 kommentarer.