Teknologi

Meta slipper Muse Glimmer — AI-agent på 30B parametere for din GPU

Adrian Kessler

Meta har bygget en AI-agent på 30 milliarder parametre som kjører utelukkende på forbrukerhardware – og har frigitt kildekoden gratis. Modellen, kalt Muse Glimmer, sender ikke oppgavene dine via Metas servere. Den kjører lokalt på din egen GPU, og med et minneavtrykk på 18 til 20 gigabyte etter kvantisering, passer den innenfor rekkevidden til dagens avanserte skjermkort for forbrukermarkedet.

Det er viktig fordi forrige generasjon lokale modeller – variantene på 7 og 13 milliarder parametre som fylte Ollama-biblioteket de siste to årene – var dyktige tekstgeneratorer, men dårlige autonome agenter. De slet med flertrinns resonnering, verktøykall som brøt midtveis, og oppgaver som krevde å huske hva som skjedde tre steg tilbake. Muse Glimmer er spesifikt designet for slike arbeidsflyter: koding, verktøykall, planlegging, filorganisering og flertrinns oppgavesekvenser som automatisk gjenopptas når et verktøykall feiler.

Den underliggende arkitekturen er en destillasjon av Muse Spark, den kommersielle modellen Meta begynte å selge API-tilgang til forrige måned. Gjennom logit-destillasjon og forsterkende læring komprimerte selskapet sitt lukkede flaggskip til en form som får plass på et 24-gigabyte skjermkort – RTX 5090, Apple M5 Max eller M4 Max. Spekulativ dekoding øker gjennomstrømmingen ytterligere: RTX 5090 kjører modellen 3,1 ganger raskere enn uten, M5 Max 1,8 ganger, M4 Max 1,5 ganger. I praksis er det forskjellen mellom en agent som føles responsiv og en som krever tålmodighet.

Modellen behandler sammenvevd tekst og bilder – skjermbilder, dokumenter, innhold med blandede formater – og opererer på over 100 språk. Den kobler seg naturlig til rammeverkene lokale AI-brukere allerede kjører: Ollama, LM Studio, llama.cpp, MLX. Hvis du allerede henter modeller fra Hugging Face og kjører dem på din egen hardware, glir Muse Glimmer rett inn i den arbeidsflyten uten ekstra verktøy.

Lisensen er Apache 2.0, noe som betyr at det ikke er noen kommersielle begrensninger. Enkeltpersoner, bedrifter og forskere kan bruke den uten å betale Meta. Det plasserer den i en annen kategori enn OpenAIs og Anthropics modeller, som krever betaling per token selv for utviklingsarbeid. Opp mot Googles Gemma4-31B og Alibabas Qwen3.6-27B – dens nærmeste åpenvekt-konkurrenter i størrelse – posisjonerer Meta Muse Glimmer som sterk for sin størrelse på agentiske og generelle språkmodell-benchmarks, uten å komme med mer spesifikke påstander om hvilke oppgaver den vinner.

Hardware-terskelen forblir selektiv. Å få 18 gigabyte modellvekter til å passe på et GPU-kort høres tilgjengelig ut helt til du regner ut hvilket GPU-kort som kreves. Et RTX 5090 koster i dag over to tusen dollar. Apple M5 Max-maskiner starter på nærmere tre tusen. Dette er lokal AI for en bestemt inntektsgruppe, ikke en erstatning for skyen for de fleste brukere. Den kvantiserte versjonen er også en søskenmodell med redusert kvalitet til Muse Spark: den arver treningssignalet fra den kommersielle modellen, men er ikke den kommersielle modellen. Meta fortsetter å selge tilgang til versjonen med høyere kapasitet.

Det som endrer seg med denne lanseringen, er nivået på dyktige agenter blant lokale modeller. Å kjøre en modell på 30 milliarder parametre trent for autonom oppgaveløsning er noe annet enn å kjøre en chattemodell med samme parameterantall. Forskjellen ligger i hvordan modellen håndterer verktøysfeil og flertrinnssekvenser – ikke i hvor godt den fullfører en enkelt setning.

Vektene er tilgjengelige på Hugging Face fra 10. august, under Apache 2.0. Meta har bekreftet optimaliseringspartnerskap på enhetsnivå med AMD, Arm, Dell, Intel og Nvidia, med ytterligere tilpassede bygg for spesifikke hardwarekonfigurasjoner på vei. Det lokale AI-miljøet vil stressteste modellen i løpet av dager, slik det gjør med alle betydelige lanseringer – det miljøets benchmarkresultater vil gi et klarere bilde av hvor Muse Glimmer faktisk står innen to uker fra i dag.

Tagger: , , , , ,

Diskusjon

Det er 0 kommentarer.