Anthropic выпустила Claude Haiku 5.5 — самую быструю и дешёвую модель
Anthropic представила Claude Haiku 5.5 — самую быструю и дешёвую модель в своей линейке. Она предназначена для высоконагруженных задач: суммаризации, классификации, работы в качестве субагента при кодинге. По сравнению с Haiku 4.5 стоимость снижена примерно на 75%, а результаты в бенчмарках выросли в разы: Terminal-Bench 4.0 — с 0% до 39.2%, OSWorld 2.1 — с 15.7% до 72.4%. Также Anthropic вдвое снизила цену кэш-чтений для Sonnet 5.5 и вводит ежемесячные API-кредиты для подписчиков Max и Team.
«Мы очень впечатлены Claude Haiku 5.5, особенно его скоростью. По сравнению с моделью, которую мы используем сегодня, мы увидели более чем 30%-ное снижение задержки при выполнении задач и до 2,5 раза более быстрый инференс на каждый ход агента. Это заметно более отзывчивый опыт».
- simonw
Пеликаны на велосипедах для Haiku на разных уровнях размышления: https://tools.simonwillison.net/markdown-svg-renderer?url=ht...
Low портит раму велосипеда, но medium/high/xhigh/max все правильно рисуют раму велосипеда.
Max занял 5 минут 9 секунд и стоил 3.3826 цента. Самый дешёвый (low) стоил 0.0936 цента и занял 7 секунд.
Последний релиз моего плагина llm-anthropic запрашивает список моделей Anthropic напрямую через API, так что мне не пришлось обновлять плагин, чтобы добавить поддержку этой модели:
llm install llm-anthropic -U
llm anthropic refresh
llm -m claude-haiku-5.5 'prompt goes here'
EDIT: Вот пеликан от Haiku 4.5 годичной давности для сравнения, он был ужасен: https://simonwillison.net/2025/Oct/15/claude-haiku-45/
- minimaxir
Ценообразование... немного странное.
Ввод
$0.10 / MTok для промптов до 100 000 токенов
$0.50 / MTok для промптов свыше 100 000 токенов
Вывод
$0.50 / MTok для промптов до 100 000 токенов
$2.50 / MTok для промптов свыше 100 000 токенов
100k токенов — это абсурдно низкий порог, и он применим только к Haiku, но не к Sonnet или Opus. Это настолько низкий порог, что его быстро превысишь, если делаешь что-либо с агентами; для типичной генерации или классификаторов в стиле Jev это выгодная цена, и, как отмечено в статье, это, по-видимому, подавляющее большинство случаев использования Haiku.
В обоих случаях всё ещё намного дешевле, чем $1 за ввод / $5 за вывод у Haiku 4.5, и эти цены лучше конкурируют с GPT-6 Luna. ($0.10 за ввод / $0.50 за вывод, но без порога по токенам [EDIT: порог для Luna, по-видимому, 272k])
- charlesabarnes
> Во-вторых, на этой неделе мы запустим новый ежемесячный API-кредит для всех подписчиков Max и Team для использования на Claude Platform. Пользователи Max 5x получат $100 кредитов в месяц, Max 20x — $200, а подписчики Team получат до $500, распределённых между их пользователями
Это очень большое преимущество для меня. Теперь я могу выпускать реальные фичи с ИИ в рамках своей подписки, не платя дополнительно и не полагаясь полностью на модели на устройстве. Меня беспокоит, что это может быть способом смягчить удар от недружественных к пользователям изменений
- chriddyp
Прогнали наш бенчмарк DataAnalyticsBench на ней: https://plotly.com/blog/claude-haiku-5-5-plotly-data-analyti...
В 9 раз дешевле Haiku 4.5 и на две буквенные оценки лучше. Также теперь это самая быстрая модель (при использовании скоростей по умолчанию, без попыток задействовать «Fast» режим других моделей) для прохождения экзамена.
Примерно на одном уровне с Luna по цене, стоимости и точности. Это очень дешёвые модели: $0.38, чтобы ответить на 40 углублённых вопросов по анализу данных (по сравнению с $15 для Opus 5.5 или $20 для Astra).
В целом очень хороша в анализе данных — правильно отвечает на все простые вопросы по аналитике. Она не справилась с ответами на некоторые вопросы, требовавшие более глубокого статистического анализа, например, изучения других переменных. Иными словами, она не так настойчива в своём анализе, как другие модели, что, я думаю, и следовало ожидать от того, как они позиционируют модель.
По сравнению с OpenAI: GPT-6 Luna справилась немного лучше и стоила около 30% от стоимости Haiku 5.5. GPT-6.1 Sol ответила правильно на все вопросы, но была в 10 раз дороже.
- simonw
Моя претензия к Haiku 4.5 была в том, что она стоила в 10 раз дороже GPT-6 Luna.
> Claude Haiku 5.5 стоит на 90% меньше, чем Claude Haiku 4.5, для запросов до 100 000 токенов, и на 50% меньше для запросов свыше 100 000 токенов
Haiku и Luna теперь имеют абсолютно одинаковую цену до 100 000 токенов. Luna теперь дешевле для всего, что свыше 100 000 токенов, даже после собственного повышения цен Luna на 270 000 она всё ещё дешевле Haiku.
Так что похоже, что они напрямую решили эту проблему. Их собственные заявленные бенчмарки тоже все выше, чем у Luna.
- jjcm
Прогнал тесты image -> html для этой модели. Мне было любопытно, достаточно ли хороша эта меньшая модель для сложного UI. Не достаточно.
Haiku 5.5: https://html.non.io/lcars-haiku-5.5/
Opus 5.5 для сравнения: https://html.non.io/lcars-opus-5.5
Дизайны, из которых она строила: https://diffui.ai/app/canvas/5093e689-1e74-4f26-b632-2a4500f...
Одна интересная вещь: она взглянула на поставленную задачу и сразу делегировала её Opus 5.5. По крайней мере, она знает, в чём не сильна. Хотя очень быстрая, и, вероятно, лучше всего подходит для небольших задач субагентов / чётко очерченной работы.
- seaal
Ежемесячные API-кредиты для плана Max выглядят фантастически, особенно с учётом цен Haiku. Возможность реально использовать свой план Claude для других обвязок и сценариев поверх обычного использования CC — это всё, чего я хотел.
Anthropic в последние несколько недель действительно делает всё правильно, в то время как OpenAI продолжает запороть дело.
- wyrdcurt
Наконец-то Anthropic выпустила конкурентоспособную дешёвую модель. Haiku 4.5 уже несколько месяцев была слишком дорогой по сравнению со своей производительностью (на самом деле я не помню, чтобы был сильно впечатлён даже в момент её выпуска). Эта модель действительно выглядит стоящей использования в некоторых сценариях. Если она действительно настолько лучше Luna, как показывают их бенчмарки, она, вероятно, заменит Luna в моих рабочих процессах. 100k токенов — довольно низкий порог до повышения цены, но я обычно использую эти меньшие модели для небольших задач в любом случае.
- bouk
Это отлично! Использовал GPT 6 Luna для декомпиляции любимой игры детства (Age of Mythology), и это значит, что я могу добавить в смесь ещё и Haiku. Пока совпало 17352/21965 функций...
- d1l
На работе мы используем haiku 4.5 для нескольких чувствительных к задержке задач, которые довольно просты. Она хорошо справляется. Только начал тестировать 5.5, так как предвкушал приятное улучшение после тизера. Результаты пока мусор. Даже утечка промпта. И она медленнее. Думаю, она дешёвая, но, по-моему, они неправильно выставили баланс.