Default
Door Remote - 05 Aug 2026
In het kort
Meta heeft Muse Code (bèta) uitgebracht, een terminalcoderingsagent mogelijk gemaakt door Muse Spark 1.2, het bijgewerkte coderingsmodel. Het is nu beschikbaar via de Meta Model API en een curl-installatiescript.
De agent coördineert persistente achtergrondsubagenten en houdt een replay-exact gebeurtenislogboek bij, zodat een crash precies wordt hervat waar deze is gestopt.
Op Meta's eigen hitlijsten volgt Muse Spark 1.2 Anthropic's Opus 5 op elke getoonde codeerbenchmark, terwijl het op de meeste punten OpenAI's Codex en Google's Antigravity verslaat.
Meta is de nieuwste technologiegigant die een codeeragent heeft verzonden en racet om te concurreren met de toonaangevende AI-giganten Anthropic en OpenAI.
"We zijn verheugd om Muse Code (bèta) uit te brengen, een terminalcoderingsagent die wordt aangedreven door Muse Spark 1.2, ons nieuwste model", schreef het bedrijf in een officiële aankondiging. "Dit markeert onze volgende stap richting de grens, met grotere en veel capabelere modellen op komst."
Als een agentische coderingstool is Muse Code gebouwd voor software-engineering in grote repository's. Volgens Meta "neemt het complexe software-engineeringtaken over in grote opslagplaatsen: het plannen van wijzigingen, het schrijven van code en het valideren van de resultaten. Het kan voor elke taak meerdere persistente subagenten coördineren, waardoor moeilijke problemen sneller, nauwkeuriger en met minder tussenkomst worden opgelost."
Het detail dat opvalt is de looptijd. Muse Code registreert elke modelaanroep, toolrun, goedkeuring en bewerking in een lokaal gebeurtenislogboek dat fungeert als één enkele bron van waarheid. "Deze enkele bron van waarheid zorgt ervoor dat de runtime-herhaling exact en herstartveilig is: na een crash kan de agent precies verdergaan waar hij was gestopt", aldus Meta. Voor langlopende opdrachten is dat het kenmerk dat belangrijker is dan de pure snelheid, en het is het onderdeel dat concurrenten niet als verkoopargument hebben genoemd.
Het wordt ook geleverd met standaardvaardigheden. Het commando "/plan" verandert een taak in een plan met goedkeuring, terwijl "/grill" dat plan stresstests uitvoert totdat het stand houdt en "/goal" werkt aan de succesvolle voltooiing van het doel, vergelijkbaar met wat Hermes doet. Meta zei dat het Muse Spark 1.2 samen met Muse Code heeft getraind, zodat de kern-LLM en de agent in synergie samenwerken.
De benchmarks en de catchMuse Spark 1.2 is een op coderen gerichte update voor Muse Spark 1.1. Meta zei dat het "de trainingscomputer voor codeertaken aanzienlijk heeft opgeschaald en tegelijkertijd de diversiteit van de trainingsomgeving heeft uitgebreid, waardoor verbeteringen zijn aangebracht in het genereren van code, complexe foutopsporing en end-to-end ontwikkelaarsworkflows." De grafieken vertellen een duidelijk verhaal.
Op Terminal-Bench 2.1 scoorde Muse Spark 1.2 met Muse Code 82,9%, achter Claude Code op Opus 5 met 86,7% maar vóór GPT-5.6 Terra op Codex (81,8%) en Grok Build (81,6%).
DeepSWE 1.1, dat agentische codeermogelijkheden meet, was dichterbij: 59,3% voor Muse versus 65,0% voor Opus 5 en 64,8% voor Codex. Op Meta's interne codeerbank behaalde Muse 70,6% tegenover 79,4% van Opus 5.
De versnellingsgrafieken draaien de volgorde om. Met meer dan 1.000 tool calls boekte Opus 5 de grootste winst ten opzichte van de basislijn (ongeveer 74-75%), waarbij Muse Spark 1.2 mid-pack ongeveer 61-69% bedroeg, afhankelijk van de run. Meta's punt is dat de agent steeds beter wordt naarmate de tool-oproepen zich opstapelen, het gedrag dat je wilt van een codeerder met een lange horizon.
De meest interessante demo's zijn long-horizon en multimodaal. Tijdens stresstests zei Meta dat Muse Code "de GPU-kernels iteratief optimaliseerde gedurende meer dan 1.000 tool-aanroepen (tot 24 uur) op Nvidia Hopper GPU's." Dat betekent dat het in de loop van de tijd kon verbeteren.
Er is ook een visuele coderingshoek. In één demo plaatst een gebruiker een fly-through-video van een huis in de terminal als mp4, en Muse Code "interpreteert de video en produceert een visueel rijke website met boekingsmogelijkheden." Het inlezen van onbewerkte video in een werkende webapp is de multimodale pitch die Meta heeft gemaakt over de Muse-lijn.
Zie de lanceringsthread:
Hier is een voorbeeld van de multimodale visuele codeermogelijkheden van Muse Code. In deze demo voert de gebruiker een fly-through-video van een huis in de terminal in als mp4-bestand. Muse Code interpreteert de video en produceert een visueel rijke website met boekingsmogelijkheden. pic.twitter.com/3CAfIMYmAB
— AI bij Meta (@AIatMeta) 5 augustus 2026
Het veld is al druk. Dat gezegd hebbende, Meta is te laat voor het gevecht. OpenAI's Codex draait al parallelle cloudagents; DeepSeek heeft zijn eigen rivaal voor Claude Code gebouwd en agentische tools zoals Hermes of OpenClaw zijn al goede vervangers met meer mogelijkheden. Het voordeel van Muse Code is de crashveilige runtime en het subagent-ontwerp, en niet de suprematie van de benchmark.
Het risico is hetzelfde als bij agentische codering: een agent die na een crash weer verdergaat en 24 uur lang tools blijft bellen, is krachtig en onvoorspelbaar. Meta gokt erop dat ontwikkelaars die autonomie willen, en het wordt nu verzonden.
Muse Code is beschikbaar om te testen tijdens de installatie door deze opdracht in te voeren:
curl -fsSL https://dev.meta.ai/install.sh | bashen
Dagelijkse debriefing NieuwsbriefBegin elke dag met de belangrijkste nieuwsverhalen van dit moment, plus originele artikelen, een podcast, video's en meer. Uw e-mail Download het! Download het!
Meta heeft Muse Code (bèta) uitgebracht, een terminalcoderingsagent mogelijk gemaakt door Muse Spark 1.2, het bijgewerkte coderingsmodel. Het is nu beschikbaar via de Meta Model API en een curl-installatiescript.
De agent coördineert persistente achtergrondsubagenten en houdt een replay-exact gebeurtenislogboek bij, zodat een crash precies wordt hervat waar deze is gestopt.
Op Meta's eigen hitlijsten volgt Muse Spark 1.2 Anthropic's Opus 5 op elke getoonde codeerbenchmark, terwijl het op de meeste punten OpenAI's Codex en Google's Antigravity verslaat.
Meta is de nieuwste technologiegigant die een codeeragent heeft verzonden en racet om te concurreren met de toonaangevende AI-giganten Anthropic en OpenAI.
"We zijn verheugd om Muse Code (bèta) uit te brengen, een terminalcoderingsagent die wordt aangedreven door Muse Spark 1.2, ons nieuwste model", schreef het bedrijf in een officiële aankondiging. "Dit markeert onze volgende stap richting de grens, met grotere en veel capabelere modellen op komst."
Als een agentische coderingstool is Muse Code gebouwd voor software-engineering in grote repository's. Volgens Meta "neemt het complexe software-engineeringtaken over in grote opslagplaatsen: het plannen van wijzigingen, het schrijven van code en het valideren van de resultaten. Het kan voor elke taak meerdere persistente subagenten coördineren, waardoor moeilijke problemen sneller, nauwkeuriger en met minder tussenkomst worden opgelost."
Het detail dat opvalt is de looptijd. Muse Code registreert elke modelaanroep, toolrun, goedkeuring en bewerking in een lokaal gebeurtenislogboek dat fungeert als één enkele bron van waarheid. "Deze enkele bron van waarheid zorgt ervoor dat de runtime-herhaling exact en herstartveilig is: na een crash kan de agent precies verdergaan waar hij was gestopt", aldus Meta. Voor langlopende opdrachten is dat het kenmerk dat belangrijker is dan de pure snelheid, en het is het onderdeel dat concurrenten niet als verkoopargument hebben genoemd.
Het wordt ook geleverd met standaardvaardigheden. Het commando "/plan" verandert een taak in een plan met goedkeuring, terwijl "/grill" dat plan stresstests uitvoert totdat het stand houdt en "/goal" werkt aan de succesvolle voltooiing van het doel, vergelijkbaar met wat Hermes doet. Meta zei dat het Muse Spark 1.2 samen met Muse Code heeft getraind, zodat de kern-LLM en de agent in synergie samenwerken.
De benchmarks en de catchMuse Spark 1.2 is een op coderen gerichte update voor Muse Spark 1.1. Meta zei dat het "de trainingscomputer voor codeertaken aanzienlijk heeft opgeschaald en tegelijkertijd de diversiteit van de trainingsomgeving heeft uitgebreid, waardoor verbeteringen zijn aangebracht in het genereren van code, complexe foutopsporing en end-to-end ontwikkelaarsworkflows." De grafieken vertellen een duidelijk verhaal.
Op Terminal-Bench 2.1 scoorde Muse Spark 1.2 met Muse Code 82,9%, achter Claude Code op Opus 5 met 86,7% maar vóór GPT-5.6 Terra op Codex (81,8%) en Grok Build (81,6%).
DeepSWE 1.1, dat agentische codeermogelijkheden meet, was dichterbij: 59,3% voor Muse versus 65,0% voor Opus 5 en 64,8% voor Codex. Op Meta's interne codeerbank behaalde Muse 70,6% tegenover 79,4% van Opus 5.
De versnellingsgrafieken draaien de volgorde om. Met meer dan 1.000 tool calls boekte Opus 5 de grootste winst ten opzichte van de basislijn (ongeveer 74-75%), waarbij Muse Spark 1.2 mid-pack ongeveer 61-69% bedroeg, afhankelijk van de run. Meta's punt is dat de agent steeds beter wordt naarmate de tool-oproepen zich opstapelen, het gedrag dat je wilt van een codeerder met een lange horizon.
De meest interessante demo's zijn long-horizon en multimodaal. Tijdens stresstests zei Meta dat Muse Code "de GPU-kernels iteratief optimaliseerde gedurende meer dan 1.000 tool-aanroepen (tot 24 uur) op Nvidia Hopper GPU's." Dat betekent dat het in de loop van de tijd kon verbeteren.
Er is ook een visuele coderingshoek. In één demo plaatst een gebruiker een fly-through-video van een huis in de terminal als mp4, en Muse Code "interpreteert de video en produceert een visueel rijke website met boekingsmogelijkheden." Het inlezen van onbewerkte video in een werkende webapp is de multimodale pitch die Meta heeft gemaakt over de Muse-lijn.
Zie de lanceringsthread:
Hier is een voorbeeld van de multimodale visuele codeermogelijkheden van Muse Code. In deze demo voert de gebruiker een fly-through-video van een huis in de terminal in als mp4-bestand. Muse Code interpreteert de video en produceert een visueel rijke website met boekingsmogelijkheden. pic.twitter.com/3CAfIMYmAB
— AI bij Meta (@AIatMeta) 5 augustus 2026
Het veld is al druk. Dat gezegd hebbende, Meta is te laat voor het gevecht. OpenAI's Codex draait al parallelle cloudagents; DeepSeek heeft zijn eigen rivaal voor Claude Code gebouwd en agentische tools zoals Hermes of OpenClaw zijn al goede vervangers met meer mogelijkheden. Het voordeel van Muse Code is de crashveilige runtime en het subagent-ontwerp, en niet de suprematie van de benchmark.
Het risico is hetzelfde als bij agentische codering: een agent die na een crash weer verdergaat en 24 uur lang tools blijft bellen, is krachtig en onvoorspelbaar. Meta gokt erop dat ontwikkelaars die autonomie willen, en het wordt nu verzonden.
Muse Code is beschikbaar om te testen tijdens de installatie door deze opdracht in te voeren:
curl -fsSL https://dev.meta.ai/install.sh | bashen
Dagelijkse debriefing NieuwsbriefBegin elke dag met de belangrijkste nieuwsverhalen van dit moment, plus originele artikelen, een podcast, video's en meer. Uw e-mail Download het! Download het!

