Meta enfrenta Claude Code e Codex com um agente de IA de baixo custo
Meta lança Muse Code em beta em 5 de agosto de 2026, seu primeiro agente IA de codificação, em um mercado já controlado por Claude Code e Codex. A empresa promete uma ferramenta robusta, projetada para gerenciar grandes bases de código sem interrupção. No entanto, as pontuações de desempenho apresentam um cenário menos favorável.

Em resumo
- Meta lança Muse Code (beta), um agente de codificação de terminal impulsionado pelo modelo Muse Spark 1.2.
- No Terminal-Bench 2.1, a ferramenta alcança 82,9 %, atrás do Claude Code no Opus 5 (86,7 %) mas à frente do Codex no GPT-5.6 Terra (81,8 %).
- O argumento central da Meta é a robustez: o agente registra cada ação e pode retomar exatamente de onde parou após uma falha.
Meta chega tardiamente, mas com um argumento técnico inédito
A chegada da Meta lembra um padrão bem conhecido: o novato compensa seu atraso apostando na confiabilidade em vez do desempenho bruto, uma lógica já observada na corrida por agentes IA aplicados a cripto.
Muse Code se insere nessa sequência. Em seu anúncio oficial, a Meta apresenta a ferramenta como “um agente de codificação de terminal impulsionado pelo Muse Spark 1.2” e promete “modelos maiores e mais performáticos a caminho“.
Projetada para engenharia de software em grandes repositórios de código, a ferramenta planeja modificações, escreve código e verifica resultados. Também coordena vários subagentes persistentes para um mesmo projeto, o que acelera a resolução de tarefas complexas com menos intervenção humana.
O detalhe que realmente distingue o Muse Code está em seu funcionamento interno. O agente registra cada chamada de modelo, cada execução de ferramenta, cada validação e cada modificação em um diário de eventos que serve como única fonte de verdade. A Meta explica que essa arquitetura torna o sistema “reproduzível de forma idêntica e capaz de reiniciar sem perdas”. Para tarefas que executam por horas, esse argumento conta mais do que a velocidade bruta.
A ferramenta também inclui comandos prontos para uso:
- “/plan” transforma uma tarefa em um plano submetido à validação,
- “/grill” testa sua robustez antes da execução, e
- “/goal” impulsiona o agente para a conclusão do objetivo definido.
Meta especifica que treinou conjuntamente Muse Spark 1.2 com Muse Code para fazer o modelo e o agente trabalharem em conjunto.
As pontuações permanecem aquém frente a Claude Code e Codex
Nos testes oficiais, a Meta reivindica um progresso significativo do Muse Spark 1.2. A empresa indica ter “aumentado consideravelmente o poder de computação dedicado ao treinamento em tarefas de código”. No entanto, os números publicados contam uma história mais nuançada.
No Terminal-Bench 2.1, Muse Spark 1.2 combinado com Muse Code alcança 82,9 %, atrás do Claude Code no Opus 5 (86,7 %) mas à frente do GPT-5.6 Terra no Codex (81,8 %) e Grok Build (81,6 %). No DeepSWE 1.1, que mede as capacidades de codificação agente, a diferença diminui: 59,3 % para Muse contra 65,0 % para Opus 5 e 64,8 % para Codex. No benchmark interno da Meta, Muse atinge 70,6 % contra 79,4 % para Opus 5.
As curvas de progresso ao longo do tempo invertem parcialmente essa classificação. Em mais de mil chamadas consecutivas de ferramentas, Opus 5 mostra o ganho mais significativo em relação à sua performance base, em torno de 74 a 75 %, enquanto Muse Spark 1.2 fica no meio da tabela, entre 61 e 69 % segundo os testes. A Meta destaca que seu agente continua melhorando conforme acumula chamadas de ferramentas.
As demonstrações mais marcantes envolvem esse tipo de cenário. A Meta indica que Muse Code “otimizou iterativamente núcleos GPU por mais de mil chamadas de ferramentas, ou até 24 horas, em GPUs Nvidia Hopper“.
A empresa também apresenta um uso multimodal: um usuário importa o vídeo de uma casa filmada em voo no terminal, e Muse Code “interpreta o vídeo e produz um site visualmente rico com funcionalidades de reserva”.
Um mercado já saturado de agentes IA de codificação
Essa citação, frequentemente usada para descrever a ambição dos agentes IA de codificação, resume o desafio que a Meta tenta enfrentar com atraso:
Não é simplesmente uma questão de autocompletar, é desbloquear a criatividade em larga escala.
OpenAI já opera agentes na nuvem em paralelo com Codex, DeepSeek construiu seu próprio concorrente ao Claude Code, e ferramentas agentes como Hermes ou OpenClaw já oferecem capacidades comparáveis, ou até superiores em alguns usos. O diferencial do Muse Code está em sua arquitetura resiliente a falhas e gestão de subagentes, não em supremacia numérica nos benchmarks.
O risco reside na própria natureza dessa autonomia. Um agente que reinicia após uma falha e continua executando ferramentas durante vinte e quatro horas seguidas permanece poderoso, mas imprevisível. A Meta aposta que os desenvolvedores valorizarão essa autonomia mais que a performance pura e decidiu lançá-lo agora, em vez de esperar uma versão mais amadurecida. A ferramenta está disponível para teste via um simples comando de instalação no terminal.
Em suma, Muse Code chega a um setor onde a competição não se limita mais às pontuações de desempenho, mas se estende à confiabilidade operacional dos agentes. Três fatores vão influenciar sua adoção: a robustez real do sistema de retomada após falha em condições de produção, a capacidade da Meta de reduzir o gap de desempenho com Claude Code nas próximas versões, e o apetite dos desenvolvedores por uma ferramenta multimodal ainda jovem. A aposta da Meta é arriscada, mas pode redefinir os critérios de avaliação desses agentes IA além da simples classificação dos benchmarks.
Maximize sua experiência na Cointribune com nosso programa "Read to Earn"! Para cada artigo que você lê, ganhe pontos e acesse recompensas exclusivas. Inscreva-se agora e comece a acumular vantagens.
Passionné par le Bitcoin, j'aime explorer les méandres de la blockchain et des cryptos et je partage mes découvertes avec la communauté. Mon rêve est de vivre dans un monde où la vie privée et la liberté financière sont garanties pour tous, et je crois fermement que Bitcoin est l'outil qui peut rendre cela possible.
As opiniões e declarações expressas neste artigo são de responsabilidade exclusiva do autor e não devem ser consideradas como recomendações de investimento. Faça sua própria pesquisa antes de tomar qualquer decisão de investimento.