Muse Spark 1.3 de Meta: un modelo de IA que entiende video, imágenes y documentos para codificar mejor
Meta ha lanzado Muse Spark 1.3, un modelo de IA entrenado para flujos de trabajo agénticos y codificación competitiva. Ofrece mayor precisión en el primer intento, llamadas a herramientas fiables y percepción multimodal nativa: puede procesar video, imágenes y documentos, y su razonamiento visual se ejecuta en un entorno real. El modelo está disponible a través de Meta Model API, con un contexto de 1M tokens y precios que van desde $1.25 por millón de tokens de entrada.
Muse Spark percibe video, imágenes y documentos, y su razonamiento visual se ejecuta en un entorno de ejecución real en lugar de pasos guionizados.
- simonw
llm -m meta-ai/muse-spark-1.3 "Genera un SVG de un pelícano montando una bicicleta"
https://tools.simonwillison.net/markdown-svg-renderer?url=ht...
4.2266 centavos, 38 segundos.
Para comparar, aquí está Muse Spark 1.2, que lo animó sin que se lo pidiera: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...
El 1.3 es definitivamente mejor: mejor cuadro de bicicleta, mejor ala, mejor sombrero de pelícano.
ACTUALIZACIÓN: Aquí hay otro con cinco pelícanos para cada uno de los cinco niveles de razonamiento de Muse Spark 1.3: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...
El más caro fue el nivel de razonamiento xhigh: 7.5 centavos, 1m34s.
Y también ejecuté cinco pelícanos en todos los niveles de razonamiento para 1.2, aquí: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...
- superfrank
Empecé a usar Spark 1.2 para desarrollo porque si estás dispuesto a dejar que Meta entrene con tus datos, era muy barato y realmente me sorprendió gratamente. No es un modelo de frontera ni mucho menos, pero para trabajos que no requerían un modelo de primera línea, disfruté mucho usándolo.
Lo estoy antropomorfizando un poco, pero sentía que conocía sus debilidades y no intentaba imponerme sus opiniones. Lo que quiero decir es que hacía lo que le decía y si había algo inesperado en el código que producía, a menudo era porque le daba instrucciones ambiguas o contradictorias. No intentaba ir más allá y simplemente actuaba como una herramienta, que es lo que quiero de un agente de codificación el 90%+ de las veces. También sentí que seguía mucho mejor los patrones establecidos en mi código que muchos de los otros modelos actuales. Soy un gran fan de los modelos de OpenAI y Spark 1.2 es lo que esperaba que fuera 5.6 Luna.
Tengo curiosidad y un poco de emoción por usar 1.3, pero honestamente un poco preocupado de que a medida que Meta presione por mejores benchmarks, Spark empiece a caer en la trampa de intentar ser "servicial" de maneras que no quiero.
Tangencial, pero cuando empecé a usar Spark 1.2, me hizo darme cuenta de cuánto extraño a 5.3 Codex. Ese modelo fue el pico de los modelos de codificación, en mi opinión, en el sentido de que sabía escribir buen código, pero no intentaba extralimitarse ni ser "servicial" de maneras inesperadas. Eso me hizo pensar en cómo los grandes laboratorios parecen estar alejándose de los modos centrados en la codificación […]
- bertili
DeepSWE puntúa 75.4: esa es la mejor puntuación hasta ahora. ¡Y es increíblemente barato!
Google mantuvo el primer puesto hace unas horas hoy con Gemini 3.8 Flash, pero ahora es segundo detrás de Spark 1.3. ¡Toda esta competencia hará bajar los precios!
- Lucasoato
Un modelo que (al menos en benchmarks) se acerca al estado del arte. Una clara separación entre lo que se usa para mejorar sus productos y lo que no (al menos eso es lo que afirman).
¡Buen trabajo Meta! En serio. Esto casi me hace olvidar la demanda de 18 mil millones de dólares por la adicción de los niños a las redes sociales.
- jmward01
muse-spark-1.3-contributor. Di lo que quieras y Meta, al cambiar los precios para decir explícitamente 'entrenamos con esto y lo valoramos tanto' es lo que todo proveedor de modelos debería hacer. Como nota al margen, ahora es completamente obvio cuánto vale para los proveedores de modelos robarme mis tokens para entrenar. Evito/pago extra/hago todo lo posible para asegurarme de que no me entrenen, pero parece que sigue apareciendo que me perdí una configuración en algún lugar. Este es el primer número cuantificable que he visto de un proveedor de modelos. Tal vez pueda ayudar en demandas para cuantificar los daños por derechos de autor u otras cosas.
- apodolny
Me gusta el enfoque de ofrecer una versión con descuento de la API que se usa para entrenar versus la versión a precio completo. Parece razonable y transparente.
- keyle
Estoy muy impresionado con este modelo hasta ahora. Es rapidísimo y parece ser lo suficientemente inteligente como para hacerlo muy bien. Su trabajo de UI (una UI simple en Python) es muy limpio y funcional. La UX estaba 'ahí'.
- 7734128
Prácticamente gratis para "contribuidores" a 0.2 USD/mtok. Va a ser difícil decir que no para los aficionados.