Teknologi

Meta udgiver Muse Glimmer: en AI-agent med 30 mia. parametre til din GPU

Adrian Kessler

Meta har bygget en AI-agent med 30 milliarder parametre, der kører udelukkende på forbrugerelektronik – og har frigivet kildekoden gratis. Modellen, kaldet Muse Glimmer, sender ikke dine opgaver gennem Metas servere. Den udføres lokalt på din egen GPU, og med et kvantiseret hukommelsesaftryk på 18 til 20 gigabyte passer den inden for rammerne af de nuværende high-end grafikkort til forbrugere.

Det er vigtigt, fordi den forrige generation af lokale modeller – varianterne med 7 og 13 milliarder parametre, der har fyldt Ollama-biblioteket de seneste to år – var gode tekstgeneratorer, men dårlige autonome agenter. De havde svært ved flertrinsræsonnement, toolkald der gik i stå midtvejs, og opgaver der krævede at huske, hvad der skete tre trin tilbage. Muse Glimmer er specifikt designet til disse arbejdsgange: kodning, funktionskald, kalenderstyring, filorganisering og flertrinsopgavesekvenser, der automatisk genoptages, når et toolkald bryder sammen.

Den underliggende arkitektur er en destillation af Muse Spark, den kommercielle model som Meta begyndte at sælge API-adgang til i sidste måned. Gennem logit-destillation og forstærkningslæring har virksomheden komprimeret sit lukkede flagskib til en form, der passer på en 24-gigabyte GPU – RTX 5090, Apples M5 Max eller M4 Max. Spekulativ afkodning skubber gennemløbet yderligere: RTX 5090 kører modellen 3,1 gange hurtigere end uden, M5 Max 1,8 gange, M4 Max 1,5 gange. I praksis er forskellen grænsen mellem en agent der føles responsiv, og en der kræver tålmodighed.

Modellen behandler sammenflettet tekst og billeder – skærmbilleder, dokumenter, blandede input – og fungerer på over 100 sprog. Den forbinder naturligt til de frameworks som lokale AI-brugere allerede kører: Ollama, LM Studio, llama.cpp, MLX. Hvis du allerede henter modeller fra Hugging Face og kører dem på din hardware, falder Muse Glimmer ind i den arbejdsgang uden ekstra værktøjer.

Licensen er Apache 2.0, hvilket betyder at der ikke er kommercielle begrænsninger. Enkeltpersoner, virksomheder og forskere kan bruge den uden at betale Meta. Det placerer den i en anden kategori end OpenAIs og Anthropics modeller, som kræver betaling per token selv til udviklingsarbejde. Over for Googles Gemma4-31B og Alibabas Qwen3.6-27B – dens nærmeste open-weight konkurrenter i størrelse – positionerer Meta Muse Glimmer som stærk for sin størrelse på agentiske og generelle sprogmodel-benchmarks, uden at komme med mere specifikke påstande om hvilke opgaver den vinder.

Hardware-tærsklen er stadig selektiv. At få 18 gigabyte modelvægte til at passe på en GPU lyder tilgængeligt, indtil du regner ud, hvilken GPU det kræver. En RTX 5090 koster i øjeblikket over 15.000 kroner. Apples M5 Max-maskiner starter omkring 22.000 kroner. Dette er lokal AI for en bestemt indkomstgruppe, ikke en erstatning for skyen for de fleste brugere. Den kvantiserede version er også en reduceret-fidelity søskende til Muse Spark: den arver træningssignalet fra den kommercielle model, men den er ikke den kommercielle model. Meta fortsætter med at sælge adgang til versionen med højere kapacitet.

Det, der ændrer sig med denne frigivelse, er det dygtige agent-niveau for lokale modeller. At køre en model med 30 milliarder parametre trænet til autonome opgaveafslutninger er anderledes end at køre en chatmodel med samme parametertal. Forskellen ligger i, hvordan modellen håndterer tool-fejl og flertrinssekvenser – ikke i hvor godt den fuldfører en enkelt sætning.

Vægtene er tilgængelige på Hugging Face fra 10. august under Apache 2.0. Meta har bekræftet enhedsniveau-optimeringspartnerskaber med AMD, Arm, Dell, Intel og Nvidia, med yderligere tilpassede builds til specifikke hardwarekonfigurationer på vej. Det lokale AI-fællesskab vil stressteste modellen inden for få dage, som det gør med enhver større frigivelse – det fællesskabs benchmarkresultater vil give et klarere billede af, hvor Muse Glimmer faktisk står inden for to uger fra i dag.

Tags: , , , , ,

Debat

Der er 0 kommentarer.