la crypto pour tous
Rejoindre
A
A

Meta s’attaque à Claude Code et Codex avec un agent IA à bas prix

10h00 ▪ 7 min de lecture ▪ par Fenelon L.
S'informer Intelligence Artificielle
Résumer cet article avec :

Meta lance Muse Code en bêta le 5 août 2026, son premier agent IA de codage, sur un marché que Claude Code et Codex contrôlent déjà. L’entreprise promet un outil robuste, conçu pour gérer de larges codebases sans interruption. Les scores de performance dressent pourtant un tableau moins flatteur.

Robot inspiré de Meta sprintant dans un datacenter futuriste, poursuivi par deux concurrents, puces lumineuses en main, style comics années 70 dynamique.

En bref

  • Meta lance Muse Code (bêta), un agent de codage en terminal propulsé par le modèle Muse Spark 1.2.
  • Sur Terminal-Bench 2.1, l’outil obtient 82,9 %, derrière Claude Code sur Opus 5 (86,7 %) mais devant Codex sur GPT-5.6 Terra (81,8 %).
  • L’argument central de Meta porte sur la robustesse : l’agent journalise chaque action et peut reprendre exactement où il s’est arrêté après un crash.

Meta débarque tardivement, mais avec un argument technique inédit

L’arrivée de Meta rappelle un schéma bien connu : le dernier venu compense son retard par un pari sur la fiabilité plutôt que sur la performance brute, une logique déjà observée dans la course aux agents IA appliqués à la crypto.

Muse Code s’inscrit dans cette séquence. Dans son annonce officielle, Meta présente l’outil comme « un agent de codage en terminal propulsé par Muse Spark 1.2 » et promet « des modèles plus grands et plus performants à venir ». 

Conçu pour l’ingénierie logicielle sur de grands dépôts de code, l’outil planifie les modifications, écrit le code et vérifie les résultats. Il coordonne aussi plusieurs sous-agents persistants pour un même projet, ce qui accélère la résolution de tâches complexes avec moins d’intervention humaine.

Le détail qui distingue vraiment Muse Code tient à son fonctionnement interne. L’agent consigne chaque appel de modèle, chaque exécution d’outil, chaque validation et chaque modification dans un journal d’événements qui fait office de source de vérité unique. Meta explique que cette architecture rend le système « rejouable à l’identique et capable de redémarrer sans perte ». Pour des tâches qui tournent pendant des heures, cet argument compte davantage que la vitesse brute.

L’outil embarque aussi des commandes prêtes à l’emploi : 

  • « /plan » transforme une tâche en plan soumis à validation, 
  • « /grill » teste sa solidité avant exécution, et 
  • « /goal » pousse l’agent vers l’achèvement de l’objectif fixé. 

Meta précise avoir coentraîné Muse Spark 1.2 avec Muse Code pour faire travailler le modèle et l’agent en tandem.

Les scores restent en retrait face à Claude Code et Codex

Sur les bancs d’essai officiels, Meta revendique une progression nette de Muse Spark 1.2. La firme indique avoir « considérablement augmenté la puissance de calcul consacrée à l’entraînement sur des tâches de code ». Les chiffres publiés racontent toutefois une histoire plus nuancée.

Sur Terminal-Bench 2.1, Muse Spark 1.2 associé à Muse Code obtient 82,9 %, derrière Claude Code sur Opus 5 (86,7 %) mais devant GPT-5.6 Terra sur Codex (81,8 %) et Grok Build (81,6 %). Sur DeepSWE 1.1, qui mesure les capacités de codage agentique, l’écart se resserre : 59,3 % pour Muse contre 65,0 % pour Opus 5 et 64,8 % pour Codex. Sur le benchmark interne de Meta, Muse plafonne à 70,6 % contre 79,4 % pour Opus 5.

Les courbes de progression dans le temps inversent partiellement ce classement. Sur plus de mille appels d’outils consécutifs, Opus 5 affiche le gain le plus marqué par rapport à sa performance de base, autour de 74 à 75 %, tandis que Muse Spark 1.2 se situe en milieu de tableau, entre 61 et 69 % selon les tests. Meta met en avant le fait que son agent continue de s’améliorer au fil des appels d’outils accumulés.

Les démonstrations les plus marquantes concernent ce type de scénario. Meta indique que Muse Code a « optimisé de façon itérative des noyaux GPU sur plus de mille appels d’outils, soit jusqu’à 24 heures, sur des GPU Nvidia Hopper ». 

L’entreprise met aussi en scène un usage multimodal : un utilisateur importe la vidéo d’une maison filmée en survol dans le terminal, et Muse Code « interprète la vidéo et produit un site web visuellement riche avec des fonctionnalités de réservation ».

Un marché déjà saturé d’agents de codage IA

Cette citation, souvent reprise pour décrire l’ambition des agents de codage IA, résume l’enjeu que Meta tente de relever avec retard : 

Ce n’est pas simplement une question d’autocomplétion, c’est débloquer la créativité à grande échelle

OpenAI fait déjà tourner des agents cloud en parallèle avec Codex, DeepSeek a construit son propre concurrent à Claude Code, et des outils agentiques comme Hermes ou OpenClaw offrent déjà des capacités comparables, voire supérieures sur certains usages. L’atout de Muse Code réside dans son architecture résistante aux pannes et sa gestion de sous-agents, pas dans une suprématie chiffrée sur les bancs d’essai.

Le risque, lui, tient à la nature même de cette autonomie. Un agent qui redémarre après un crash et continue d’exécuter des outils pendant vingt-quatre heures d’affilée reste puissant, mais imprévisible. Meta parie que les développeurs valoriseront cette autonomie plus que la performance pure, et l’entreprise a choisi de le lancer maintenant, plutôt que d’attendre une version plus aboutie. L’outil est disponible pour test via une simple commande d’installation dans le terminal.

En somme, Muse Code arrive dans un secteur où la compétition ne se limite plus aux scores de performance mais s’étend désormais à la fiabilité opérationnelle des agents. Trois catalyseurs vont peser sur son adoption : la solidité réelle du système de reprise après crash en conditions de production, la capacité de Meta à combler l’écart de performance avec Claude Code sur les prochaines versions, et l’appétit des développeurs pour un outil multimodal encore jeune. Le pari de Meta reste risqué, mais il pourrait redéfinir les critères d’évaluation de ces agents IA au-delà du simple classement des benchmarks.

Maximisez votre expérience Cointribune avec notre programme 'Read to Earn' ! Pour chaque article que vous lisez, gagnez des points et accédez à des récompenses exclusives. Inscrivez-vous dès maintenant et commencez à cumuler des avantages.



Rejoindre le programme
A
A
Fenelon L. avatar
Fenelon L.

Passionné par le Bitcoin, j'aime explorer les méandres de la blockchain et des cryptos et je partage mes découvertes avec la communauté. Mon rêve est de vivre dans un monde où la vie privée et la liberté financière sont garanties pour tous, et je crois fermement que Bitcoin est l'outil qui peut rendre cela possible.

DISCLAIMER

Les propos et opinions exprimés dans cet article n'engagent que leur auteur, et ne doivent pas être considérés comme des conseils en investissement. Effectuez vos propres recherches avant toute décision d'investissement.