Claude Opus 5.5 генерирует токены на 30% быстрее и обходит Opus 5 на высоком усилии
Prompting Claude Opus 5.5
Anthropic выпустила руководство по промптингу для Claude Opus 5.5. Модель генерирует выходные токены более чем на 30% быстрее, чем Claude Opus 5, и решает те же задачи с меньшим числом токенов. На среднем уровне усилия она догоняет или превосходит Opus 5 на высоком в кодинге и интеллектуальной работе. Разбираются калибровка усилия, поведение при отключённом мышлении, отказы предохранителей, обновления прогресса, многоагентные сценарии и работа с визуальными данными.
Claude Opus 5.5 генерирует выходные токены более чем на 30 процентов быстрее, чем Claude Opus 5, и, как правило, завершает ту же задачу с меньшим количеством токенов.
- skeledrew
Всё, что бросается мне в глаза, — это то, как они настроили его отказываться давать пользователям thinking-токены и промпты для полного рассуждения в выводе. Это только ещё больше меня отталкивает; возможно, я пока не перестану полностью использовать Claude, но я переведу ещё большую часть своей основной рабочей нагрузки на китайских провайдеров. Вот где теперь открытость и свобода.
- bluegatty
Это провал AI-фаундри; если нам приходится использовать совершенно разные техники промптинга для каждой модели, это не сработает.
ИИ быстро насыщает свою способность быть полезным, и этим продуктам пора начать взрослеть.
Управлять 50 разными сломанными MCP и их разнообразием способов, которыми они сломаны, — это не «весело».
В начале это было «весело», теперь это просто «сломанная технология».
Astra и Opus 5.5 — это «отправная точка» для следующей эры ИИ, где мы ожидаем надёжный инструментарий.
- prodigycorp
Opus 5.5 — хорошая модель, но я пытался понять экстремальный хайп вокруг неё в соцсетях насчёт способности Opus выполнять 2D-работу, как у нас было с Astra, выполняющей 3D-работу. В обоих релизах моделям требовался обширный доступ к сторонним API для генерации ассетов, и большая часть работы модели по сути сводилась к координации всего.
Есть так много всего в духе «x сгенерировал это с одного раза, это AGI», что создаётся впечатление, будто можно вайб-оперировать современными моделями так же, как вы оперировали моделями прошлого года. Всё гораздо сложнее. Это требует от вас веры в скачок возможностей моделей, который наверняка был бы пустой тратой времени на предыдущих моделях.
Не уверен, к чему я веду, кроме того, что, думаю, большинство поймёт: это выматывает — успевать за всем этим. Не могу представить, каково это — воспитывать ребёнка, который за год прошёл путь от малыша до пубертата, и планировать его поступление в колледж на следующий год. Эта индустрия движется так быстро, что становится фактом: именно пользователь «держит это неправильно» каждые полгода.
- jryan49
Я только что протестировал его на выходных, и у меня была 33-часовая сессия с Claude полностью без присмотра, с минимальным промптингом. Всё, что он сгенерировал, тоже выглядит хорошо. Это безумие.
- silversmith
«Биологические меры предосторожности такие же, как у Claude Fable 5.1... Повседневные вопросы здоровья и образования не затронуты»
И вот мы здесь: «почему мои икры болят сильнее любых других мышц после тренировки» классифицируется как неприличный вопрос.
- bob1029
> В-четвёртых, если длинные ходы с вызовом инструментов всё ещё затихают дольше, чем вам хочется, попросите ваш harness запрашивать обновление
Я не уверен, что понимаю эту сложность. Во всех harness, которые я когда-либо использовал, сами вызовы инструментов отображаются пользователю как индикатор прогресса. Когда UI/UX вокруг этого хорошо спроектирован, пользователь должен быть в состоянии примерно понять, что происходит. У разных инструментов разные идеальные способы представления. Нельзя всё свести к простым текстовым блокам.
Если бы мне абсолютно необходимы были обновления прогресса внутри хода, я бы накапливал отдельную стенограмму для каждого хода и с детерминированными интервалами подавал её в более дешёвую модель.
- bronlund
Первое, что он сделал, когда я попробовал, — рыскал по файлам в директориях далеко за пределами проекта. Я пытался заставить его объяснить, почему он это сделал, несколько раз, но так и не получил ничего похожего на объяснение.
- _superposition_
Anthropic — это новая Microsoft.
Просто моё чутьё. Я буду держаться подальше от их продуктов. Надеюсь, это пойдёт на пользу моей карьере так же, как и фокус на открытых стандартах вместо какого-то проприетарного дерьма, которое меняется каждые 3 месяца.