Teknologi

Fei-Fei Li når AMD kjøper World Labs: «Universet består ikke av ord, men av virkelige ting…»

Da Fei-Fei Li kunngjorde at World Labs selges til AMD, gjentok hun ideen laboratoriet ble bygget på. Fra en brikkeprodusents kommende forskningssjef høres det mindre ut som filosofi og mer som et veddemål på maskinvare.
Adrian Kessler
Legg oss til på Google

Fei-Fei Li er forskeren som lærte maskiner å se, og nå har hun solgt laboratoriet hun bygget opp for å få kunstig intelligens til å bevege seg forbi språk. Da hun kunngjorde at World Labs blir en del av AMD, brikkeprodusenten ledet av hennes tidlige støttespiller Lisa Su, formulerte hun på én setning overbevisningen selskapet ble grunnlagt på – en påstand som også utfordrer KI-æraen der alt begynner med ord.

«Universet består ikke av ord, men av virkelige ting. Mange av de viktigste problemene KI skal løse, fra vitenskap til underholdning og robotikk, krever modeller som kan resonnere ut fra den fysiske verdens struktur og oppførsel.»

Li skrev dette i «World Labs to AMD», et innlegg på Substack-bloggen sin, og The Register siterte det i sin omtale av avtalen. Setningen rett før slår fast premisset: Selskapet var «styrt av den grunnleggende overbevisningen om at språk alene ikke er nok til å utvikle modeller».

AMD har gått med på å kjøpe World Labs i en aksjehandel verdsatt til rundt 8,2 milliarder dollar. Avtalen ventes å bli sluttført innen utgangen av 2026, forutsatt at myndighetene godkjenner den. Li blir konserndirektør og sjefsforsker i AMD, med direkte rapportering til Su. San Francisco-laboratoriet, som hun grunnla sammen med Ben Mildenhall og Justin Johnson tidlig i 2024, utvikler det bransjen kaller verdensmodeller: systemer som genererer, rekonstruerer og simulerer 3D-miljøer ut fra tekst, bilder og video. Mens en stor språkmodell spår neste ord, forestiller en verdensmodell seg miljøet og arbeider videre med problemet derfra, slik The Register beskriver det.

Den nærliggende tolkningen er å plassere utsagnet i samme leir som Yann LeCun, Metas tidligere sjefsforsker innen KI, som har antydet at store språkmodeller kan være en blindvei. Lis versjon er mer avgrenset; The Register var nøye med å påpeke at hun ikke er motstander av store språkmodeller. Den nyeste modellen fra laboratoriet hennes låner nettopp fra oppskriften deres: Atlas, skriver hun, forutsier neste visning ut fra en samling 2D-bilder, på samme måte som en språkmodell forutsier neste token. Hun er ikke uenig i metoden, men i materialet. Tekst er en skildring av verden skrevet av mennesker; poenget hennes er at problemene det er verdt å løse – fra vitenskap til underholdning og robotikk – finnes i det teksten beskriver.

Det som gir setningen tyngde, er hvem som betaler for å gjøre den til virkelighet. En brikkeprodusent bruker ikke milliarder i aksjer på en filosofi. I AMDs kunngjøring begrunnes oppkjøpet med datakraft: Etter hvert som KI tas i bruk innen robotikk, simulering og fysisk KI, «blir kravene til datainfrastrukturen mer varierte». Sus egen formulering røper hensikten: «Å bygge dataplattformene for neste generasjon KI krever en dyp forståelse av hvordan modellene utvikler seg.» Kort sagt vil AMD se den neste typen arbeidsbelastning før selskapet utvikler silisiumet som skal håndtere den. Sammenlignet med Nvidia er AMDs kapasitet innen programvareutvikling liten, påpeker The Register; World Labs gir selskapet et eget forskningsteam, bare noen uker etter at det gikk med på å kjøpe oppstartsselskapet Taalas, som bygger modellvekter direkte inn i silisium.

Li beskriver den samme mekanismen fra den andre siden. «Uten en målrettet satsing på maskinvare blir KI hemmet når det gjelder effektivitet. Og skala. Og i vår sammenheng forblir den fanget i den digitale verden», skriver hun. Det er dette sitatet egentlig handler om. En modell som resonnerer om fysisk rom, er bare så nyttig som maskinen som kan kjøre den raskt nok til å styre en robot. Li har bestemt seg for at den raskeste veien til en slik maskin er å gå inn i selskapet som lager den.

Ordene får tyngde på grunn av karrieren som ligger bak dem. Li begynte i fagfeltet i 2000, på jakt etter visuell intelligens både i maskiner og i hjernen. Arbeidet med ImageNet ved laboratoriet hennes bidro til å åpne døren til den moderne KI-æraen. Senere grunnla hun Googles KI-enhet som sjefsforsker og ble den første direktøren for Stanford-instituttet Human-Centered AI. Et kvart århundre senere er argumentet det samme. Det som står på spill, har endret seg. Når avtalen er sluttført, vil professoren som fremmet denne saken, rapportere til Su.

Hvis hun har rett, har AMD sikret seg et tidlig innblikk i arbeidsbelastningene som vil forme neste generasjon KI-maskinvare. Hvis hun tar feil og språk fortsetter å sluke alt, har selskapet kjøpt en dyr forsikring – nettopp slik The Register tolket avtalen: en sikring mot at store språkmodeller viser seg å være en blindvei.

Lis setning begynner som en påstand om universet. Når avtalen er sluttført, vil den være en spesifikasjon.

Tagger: , , , ,

Legg oss til på Google

Diskusjon

Det er 0 kommentarer.