Meta выпускает Muse Spark 1.3: модель для агентных рабочих процессов с высокой точностью кода

Meta выпускает Muse Spark 1.3: модель для агентных рабочих процессов с высокой точностью кода

Meta представила Muse Spark 1.3 — модель, обученную для длительных агентных сценариев и оптимизированную для конкурентного программирования. Разработчики получат более высокую точность с первой попытки и надежный вызов инструментов. Muse Spark 1.3 отслеживает контекст и предыдущие результаты, обрабатывает запутанные или конфликтующие входные данные и запрашивает уточнения при необходимости. Модель также обладает нативным мультимодальным восприятием: понимает видео, изображения и документы, а ее визуальные рассуждения выполняются в реальной среде исполнения, а не по скриптам. Доступна через Meta Model API и OpenRouter.

Muse Spark воспринимает видео, изображения и документы, а его визуальные рассуждения выполняются в реальной среде исполнения, а не по скриптам.
  1. simonw

    llm -m meta-ai/muse-spark-1.3 "Сгенерируй SVG пеликана на велосипеде"

    https://tools.simonwillison.net/markdown-svg-renderer?url=ht...

    4,2266 цента, 38 секунд.

    Для сравнения, вот Muse Spark 1.2, который анимировал его без моей просьбы: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...

    Версия 1.3 определённо лучше — рама велосипеда лучше, крыло лучше, шляпа пеликана лучше.

    ОБНОВЛЕНИЕ: Вот ещё один вариант с пятью пеликанами для каждого из пяти уровней рассуждений Muse Spark 1.3: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...

    Самый дорогой был уровень рассуждений xhigh — 7,5 центов, 1 мин 34 сек.

    И я также запустил пять пеликанов на всех уровнях рассуждений для 1.2, вот здесь: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...

  2. superfrank

    Я начал использовать Spark 1.2 для разработки, потому что если вы готовы позволить Meta обучаться на ваших данных, это было дёшево, и я был действительно приятно удивлён им. Это ни в коем случае не модель переднего края, но для работы, не требующей самой топовой модели, мне очень нравилось им пользоваться.

    Я немного очеловечиваю его, но казалось, что он знает свои слабости и не пытается навязывать мне своё мнение. Я имею в виду, что он делал то, что я ему говорил, и если в коде, который он выдавал, было что-то неожиданное, это часто было потому, что я давал ему неоднозначные или противоречивые инструкции. Он не пытался превзойти ожидания и просто вёл себя как инструмент, а это то, что я хочу от агента для кодинга в 90%+ случаев. Я также заметил, что он гораздо лучше следует устоявшимся паттернам в моём коде, чем многие другие современные модели. Я большой поклонник моделей OpenAI, и Spark 1.2 — это то, чем, как я ожидал, будет 5.6 Luna.

    Мне любопытно, и я немного взволнован попробовать 1.3, но, честно говоря, немного обеспокоен тем, что по мере того, как Meta стремится к лучшим бенчмаркам, Spark начнёт попадать в ловушку попыток быть «полезным» так, как мне этого не нужно.

    Отступление, но когда я впервые начал использовать Spark 1.2, я осознал, как сильно скучаю по 5.3 Codex. Эта модель была пиком моделей для кодинга, на мой взгляд, в том смысле, что она умела писать хороший код, но не пыталась выходить за рамки или быть «полезной» неожиданными способами. Это заставило меня задуматься о том, как крупные лаборатории, похоже, отходят от моделей, специализированных на кодинге [...]

  3. bertili

    DeepSWE набирает 75,4 — это лучший результат на данный момент. И это безумно дёшево!

    Google сегодня несколько часов удерживал первое место с Gemini 3.8 Flash, но теперь он второй после Spark 1.3. Вся эта конкуренция приведёт к снижению цен!

  4. Lucasoato

    Модель, которая (по крайней мере, в бенчмарках) приближается к SOTA. Чёткое разделение того, что используется для улучшения их продуктов, а что нет (по крайней мере, они так утверждают).

    Молодец, Meta! Серьёзно. Это почти заставляет меня забыть об иске на 18 миллиардов долларов за вызывающую зависимость у детей социальную сеть.

  5. jmward01

    muse-spark-1.3-contributor. Говорите что хотите, но Meta, которая меняет цены, чтобы явно указать «мы обучаемся на этом и ценим это вот так», — это то, что должен делать каждый поставщик моделей. Как примечание: теперь совершенно очевидно, сколько стоит для поставщиков моделей кража моих токенов для обучения. Я избегаю/плачу дополнительно/изо всех сил стараюсь не попадать под обучение, но, похоже, постоянно всплывает, что я где-то пропустил настройку. Это первое количественное число, которое я видел от поставщика моделей. Может быть, оно поможет в судебных исках оценить ущерб за нарушение авторских прав или другие вещи?

  6. apodolny

    Мне нравится подход с предоставлением версии API со скидкой, которая используется для обучения, по сравнению с версией по полной цене. Это выглядит разумно и прозрачно.

  7. keyle

    Я очень впечатлён этой моделью пока что. Она быстрая и, кажется, достаточно умная, чтобы действительно хорошо справляться. Её работа с UI (простой Python UI) очень чистая и функциональная. UX был «на месте».

  8. 7734128

    Практически бесплатно для «contributors» по 0,2 доллара за миллион токенов. Хоббистам будет трудно отказаться.

Ещё за этот день

2026-09-02