Харнесс — вот что главное: как один разработчик обходится без дорогих моделей

The Harness Is the Thing

Харнесс — вот что главное: как один разработчик обходится без дорогих моделей

Скотт Фрайкселл рассказывает, как за восемнадцать месяцев агентное программирование изменило его работу: теперь он управляет LLM через «харнесс» — единую среду, объединяющую Cursor, Claude и Pi. Он делится техникой планирования и исполнения задач, которая сократила использование дорогих моделей на 75%, и объясняет, почему переход с Cursor на Codex его больше не пугает. Главный вывод: харнесс, а не модель, определяет продуктивность.

Харнесс — это и есть главное; точка опоры, где мои ожидания встречаются с возможностями LLM.
  1. andai

    Я очень доволен Luna, но мой подход — это «много мелких правок», для которых модели, по сути, достигли насыщения год назад.

    (Я тоже пробовал подход «дать массивной модели вносить масштабные изменения» и до сих пор психологически восстанавливаюсь после этого опыта. Кодовая база, возможно, никогда не восстановится!)

    Кстати, Luna и Flash сейчас, похоже, на одном уровне, только Luna быстрее и дешевле?

  2. AirMax98

    Читая это, я действительно жалею, что у меня нет рабочего процесса получше. Я настолько полностью завишу от Fable, что не использую другие модели, и уже достиг точки, когда каждую неделю упираюсь в лимиты использования. Я буквально живу взаймы — когда Anthropic наконец обрушит свой 50-процентный рост использования в конце августа, мне точно придется менять свой рабочий процесс. Когда это случится, мне трудно представить, что я останусь с одной моделью у одного провайдера.

  3. esalman

    Что я усвоил за последнюю неделю, так это то, что харнесс — это по сути цикл while.

    На каждой итерации вы делаете вызов LLM, выполняете некоторую работу (например, вызов инструмента), дополняете промпт (добавляете или сжимаете и т.д.) — не обязательно в таком порядке — и продолжаете.

    Пока не выполнится условие завершения. Тогда вы выходите из цикла.

  4. nullbio

    Адаптивное обучение LoRA с использованием моделей с открытым весом и ваших собственных трассировок рассуждений — вот это да. У больших лабораторий впереди гигантская работа, если они хотят конкурировать с запуском собственной модели — им придется предоставить каждому пользователю свою собственную постоянную виртуальную машину. Когда все будет сказано и сделано, я думаю, их единственным реальным рвом останется роль поставщика инференса/оборудования. Покупка OpenRouter компанией Stripe была очень умной ставкой.

  5. dnnehgf

    Сомневаюсь. Когда-нибудь харнессы станут настолько сложными, что вы начнете просить модели интерпретировать и модифицировать их.

    Схема наслоения детерминированного, вероятностного, детерминированного, вероятностного. Это странная схема, но она кажется какой-то естественной.

Ещё за этот день

2026-08-27