Claude Opus 5.5 генерирует токены на 30% быстрее и обходит Opus 5 на высоком усилии

Prompting Claude Opus 5.5

Claude Opus 5.5 генерирует токены на 30% быстрее и обходит Opus 5 на высоком усилии

Anthropic выпустила руководство по промптингу для Claude Opus 5.5. Модель генерирует выходные токены более чем на 30% быстрее, чем Claude Opus 5, и решает те же задачи с меньшим числом токенов. На среднем уровне усилия она догоняет или превосходит Opus 5 на высоком в кодинге и интеллектуальной работе. Разбираются калибровка усилия, поведение при отключённом мышлении, отказы предохранителей, обновления прогресса, многоагентные сценарии и работа с визуальными данными.

Claude Opus 5.5 генерирует выходные токены более чем на 30 процентов быстрее, чем Claude Opus 5, и, как правило, завершает ту же задачу с меньшим количеством токенов.
  1. skeledrew

    Всё, что бросается мне в глаза, — это то, как они настроили его отказываться давать пользователям thinking-токены и промпты для полного рассуждения в выводе. Это только ещё больше меня отталкивает; возможно, я пока не перестану полностью использовать Claude, но я переведу ещё большую часть своей основной рабочей нагрузки на китайских провайдеров. Вот где теперь открытость и свобода.

  2. bluegatty

    Это провал AI-фаундри; если нам приходится использовать совершенно разные техники промптинга для каждой модели, это не сработает.

    ИИ быстро насыщает свою способность быть полезным, и этим продуктам пора начать взрослеть.

    Управлять 50 разными сломанными MCP и их разнообразием способов, которыми они сломаны, — это не «весело».

    В начале это было «весело», теперь это просто «сломанная технология».

    Astra и Opus 5.5 — это «отправная точка» для следующей эры ИИ, где мы ожидаем надёжный инструментарий.

  3. prodigycorp

    Opus 5.5 — хорошая модель, но я пытался понять экстремальный хайп вокруг неё в соцсетях насчёт способности Opus выполнять 2D-работу, как у нас было с Astra, выполняющей 3D-работу. В обоих релизах моделям требовался обширный доступ к сторонним API для генерации ассетов, и большая часть работы модели по сути сводилась к координации всего.

    Есть так много всего в духе «x сгенерировал это с одного раза, это AGI», что создаётся впечатление, будто можно вайб-оперировать современными моделями так же, как вы оперировали моделями прошлого года. Всё гораздо сложнее. Это требует от вас веры в скачок возможностей моделей, который наверняка был бы пустой тратой времени на предыдущих моделях.

    Не уверен, к чему я веду, кроме того, что, думаю, большинство поймёт: это выматывает — успевать за всем этим. Не могу представить, каково это — воспитывать ребёнка, который за год прошёл путь от малыша до пубертата, и планировать его поступление в колледж на следующий год. Эта индустрия движется так быстро, что становится фактом: именно пользователь «держит это неправильно» каждые полгода.

  4. jryan49

    Я только что протестировал его на выходных, и у меня была 33-часовая сессия с Claude полностью без присмотра, с минимальным промптингом. Всё, что он сгенерировал, тоже выглядит хорошо. Это безумие.

  5. silversmith

    «Биологические меры предосторожности такие же, как у Claude Fable 5.1... Повседневные вопросы здоровья и образования не затронуты»

    И вот мы здесь: «почему мои икры болят сильнее любых других мышц после тренировки» классифицируется как неприличный вопрос.

  6. bob1029

    > В-четвёртых, если длинные ходы с вызовом инструментов всё ещё затихают дольше, чем вам хочется, попросите ваш harness запрашивать обновление

    Я не уверен, что понимаю эту сложность. Во всех harness, которые я когда-либо использовал, сами вызовы инструментов отображаются пользователю как индикатор прогресса. Когда UI/UX вокруг этого хорошо спроектирован, пользователь должен быть в состоянии примерно понять, что происходит. У разных инструментов разные идеальные способы представления. Нельзя всё свести к простым текстовым блокам.

    Если бы мне абсолютно необходимы были обновления прогресса внутри хода, я бы накапливал отдельную стенограмму для каждого хода и с детерминированными интервалами подавал её в более дешёвую модель.

  7. bronlund

    Первое, что он сделал, когда я попробовал, — рыскал по файлам в директориях далеко за пределами проекта. Я пытался заставить его объяснить, почему он это сделал, несколько раз, но так и не получил ничего похожего на объяснение.

  8. _superposition_

    Anthropic — это новая Microsoft.

    Просто моё чутьё. Я буду держаться подальше от их продуктов. Надеюсь, это пойдёт на пользу моей карьере так же, как и фокус на открытых стандартах вместо какого-то проприетарного дерьма, которое меняется каждые 3 месяца.

Ещё за этот день

2026-09-28