Por Canuto  

Meta lanza Muse Code, un agente de codificación que supera a Codex y Antigravity, pero no a Claude Opus 5. Con un registro de eventos a prueba de fallos y subagentes paralelos, la compañía apuesta al costo para competir.
***

  • Meta lanza Muse Code en beta con Muse Spark 1.2.
  • Supera a Codex y Antigravity en benchmarks, pero pierde ante Opus 5.
  • Registro de eventos local y subagentes en paralelo para una mayor fiabilidad.


El mercado de agentes de codificación con IA se ha convertido en un campo de batalla entre gigantes tecnológicos. OpenAI, Google y Anthropic ya tienen sus ofertas, y ahora Meta entra con su propio agente: Muse Code.

La compañía de Mark Zuckerberg lanzó esta herramienta en beta el 5 de agosto de 2026, según Cryptopolitan. Muse Code está impulsado por Muse Spark 1.2, una versión mejorada del modelo de codificación que Meta abrió a desarrolladores de EE. UU. en julio.

El lanzamiento ocurre en un momento de intensa competencia, donde la capacidad de un modelo para generar código de calidad puede definir el liderazgo en IA.

Meta presenta Muse Code

Meta ha lanzado Muse Code como un agente de terminal que asume tareas completas de ingeniería de software. Según la publicación oficial, puede planificar cambios, escribir código y validar resultados en grandes repositorios.

El agente funciona con Muse Spark 1.2, que Meta describe como un “próximo paso hacia la frontera”. La compañía afirma que esta versión es mejor en generación de código, depuración y comprensión de bases de código complejas.

Mark Zuckerberg, CEO de Meta, destacó en una publicación que el agente distribuye tareas grandes a subagentes separados. Estos subagentes trabajan en paralelo en árboles de trabajo aislados para evitar colisiones.

Zuckerberg añadió: “Tu copia de trabajo nunca se toca. En las pruebas, logró construir seis características para un juego simultáneamente sin colisiones”.

La instalación es sencilla: los desarrolladores pueden instalar el agente en macOS o Linux con un solo comando curl.

Desempeño en benchmarks: supera a Codex pero no a Opus 5

Según Cryptopolitan, Meta publicó sus propios benchmarks para Muse Spark 1.2 y los comparó con los competidores. En la mayoría de las pruebas, su modelo supera a Codex de OpenAI y a Antigravity de Google.

Sin embargo, en todos los benchmarks mostrados, Claude Opus 5 de Anthropic se mantiene por delante. Esto significa que Meta aún no ha logrado alcanzar el nivel de su rival más fuerte.

Este resultado no sorprende, dado que Anthropic ha invertido fuertemente en modelos de código de alta calidad. Opus 5 ha sido el estándar de oro en muchas evaluaciones de programación.

A pesar de la derrota, Meta destaca que su modelo es más eficiente en costo. La compañía compite en precio, algo que podría ser atractivo para desarrolladores que buscan alternativas más baratas.

Meta también menciona que tiene un modelo más grande, con nombre clave Watermelon, que aún está en entrenamiento. Eso podría cambiar el panorama competitivo en el futuro.

Características clave: registro de eventos y subagentes

Una de las características más innovadoras de Muse Code es su registro de eventos local. Este registro guarda todas las llamadas de modelo, ejecuciones de herramientas, aprobaciones y ediciones.

Este registro funciona como una fuente de verdad que hace que el runtime sea exacto en la reproducción y seguro al reiniciar. Si ocurre un fallo, el agente puede retomar desde donde quedó sin perder trabajo.

Además, Muse Code mantiene subagentes en segundo plano durante toda la sesión. Esto permite que las tareas se distribuyan en paralelo, mejorando la eficiencia.

Los comandos integrados incluyen /plan, que convierte una solicitud en un plan aprobado; /grill, que somete ese plan a pruebas de estrés; y /goal, que avanza hacia la finalización del objetivo.

En un caso de estudio, Muse Spark 1.2 reescribió núcleos de GPU para chips NVIDIA Hopper a lo largo de más de 1000 llamadas de herramientas y durante hasta 24 horas. Trabajó desde una línea base que se le indicó no copiar de bibliotecas existentes.

Estrategia de precios y costos

Meta está compitiendo en precio, ya que sus modelos no superan a Opus 5 en benchmarks. La compañía ha comunicado que espera gastar entre USD $125.000 millones y USD $145.000 millones este año en infraestructura.

Esa inversión masiva en chips, centros de datos y otros equipos busca fortalecer su posición en IA. Sin embargo, los resultados de Muse Code muestran que la brecha con Anthropic aún es considerable.

El precio es un factor clave para los desarrolladores. Muse Spark 1.2 está disponible a través de la API del Modelo Meta, y el agente se puede instalar de forma gratuita (aunque el uso de la API tiene costo).

Meta ha utilizado datos de entrenamiento generados por el antiguo Muse Spark 1.1. Este bucle de entrenamiento ayudó al modelo más nuevo a seguir instrucciones de cerca.

La decisión de competir en costo podría ser una estrategia inteligente mientras trabajan en modelos más avanzados como Watermelon. Si logran igualar la calidad de Opus 5, tendrían una ventaja significativa.

Implicaciones para el desarrollo de software

El lanzamiento de Muse Code refleja la tendencia hacia agentes de IA que pueden manejar proyectos completos, no solo fragmentos de código. Esto podría cambiar la forma en que los equipos de desarrollo trabajan.

Con la capacidad de registrar cada acción y reanudar después de fallos, Meta ofrece una solución robusta para entornos de producción. La paralelización mediante subagentes aumenta la productividad.

Sin embargo, los desarrolladores que necesiten el máximo rendimiento en calidad de código probablemente sigan prefiriendo Opus 5. La competencia seguirá impulsando mejoras en todos los actores.

Meta también se enfrenta a un desafío: su gasto masivo en infraestructura no se ha traducido en liderazgo en benchmarks. La compañía deberá mostrar avances concretos para justificar esas inversiones.

Con Watermelon en entrenamiento, Meta podría cerrar la brecha. Solo el tiempo dirá si la apuesta por el costo y la fiabilidad es suficiente para atraer a los desarrolladores.


ADVERTENCIA: DiarioBitcoin ofrece contenido informativo y educativo sobre diversos temas, incluyendo criptomonedas, IA, tecnología y regulaciones. No brindamos asesoramiento financiero. Las inversiones en criptoactivos son de alto riesgo y pueden no ser adecuadas para todos. Investigue, consulte a un experto y verifique la legislación aplicable antes de invertir. Podría perder todo su capital.

Suscríbete a nuestro boletín