Что такое harness для ИИ-агентов?
What Is a Harness?

Статья объясняет, что такое агентный harness, сравнивая его с альпинистской страховочной системой. Harness — это программное обеспечение, которое предоставляет среду для работы ИИ-модели, включая системный промпт, инструменты, агентный цикл и слой перевода для совместимости с разными моделями. В отличие от самих моделей, harness можно настраивать и владеть им, что даёт пользователям контроль и независимость от AI-лабораторий. Автор упоминает примеры: Pi, OpenClaw, Lefos, и подчёркивает важность открытых и нейтральных harness для сохранения свободы.
Если люди могут владеть и запускать свои собственные harness локально на своих компьютерах, это означает, что они сохраняют свою самостоятельность.
- Syntaf
Недавно я работал над harness для бухгалтерских агентов на своей работе, и это был довольно интересный опыт.
Изначально мы начали с создания CLI-инструмента, чтобы наши LLM могли легче взаимодействовать с нашей платформой. Не могу переоценить ценность наличия внутреннего CLI. Его и весело создавать, и он чрезвычайно полезен для агентов.
Сначала мы использовали skills, но обнаружили, что то, как люди создают skills, часто слишком предписывающе и ограничено конкретной функцией автора в компании. Skill из 2000 строк страдает теми же пробелами, что и мы: если агент просто следует списку инструкций, он с меньшей вероятностью будет рассуждать о запросе, который выполняет.
Поэтому мы спросили себя: а что, если просто позволить агенту рассуждать о предстоящей работе и предоставить только инструменты и ограничения для сбора контекста и выполнения бухгалтерских задач?
Оказалось, что передовые модели ХОРОШИ в своем деле: они превзошли наши строго предписывающие skills и смогли работать с более широким набором задач, даже без инструкций о том, как их выполнять.
Это глоток свежего воздуха после десятилетия CRUD, над которым я работал; инженерия harness очень интересна.
- FinnLobsien
Я думаю, что harness станут чрезвычайно важны для корпоративных ИИ-агентов.
Сейчас каждый инструмент выпускает какого-то ИИ-агента, но я не могу избавиться от мысли, что ИИ-агенты в крупных компаниях в конечном итоге станут чем-то вроде внутреннего приложения с внутренними MCP, CLI, API и т.д.
Могут быть разные harness для разных случаев использования, и у разных людей могут быть разные уровни доступа к ним.
Это имело бы смысл для инженеров платформ/инфраструктуры, которые могут создать модульный harness, к которому человек или команда могут получить доступ.
Можно было бы иметь агентов, которых члены команды используют локально с включенной памятью для персонализации, и агентов, которых любой может использовать для вопросов о контексте компании, которые не будут персонализировать вещи.
- xrd
Есть ли у кого-нибудь предложение по harness, который хорошо справляется с передачей (handoff)?
Когда я говорю о передаче, я имею в виду:
* передачу из терминального CLI в веб-интерфейс (на телефоне)?
* передачу от одного члена команды другому?
* передачу от одного способа общения, например, написания промпта в TUI, к электронной почте?
* передачу от одной модели к другой или от одного провайдера (openrouter) к другому (llama.cpp)
Существует ли такое?
Раньше я думал, что PR будет хорошим местом для централизации всего этого. Неважно, какая IDE, разработчик или местоположение. Но теперь я чувствую, что harness для агентов может лучше это содержать.
Почему я хочу передачу? Я постоянно теряю контекст того, где работает мой harness. Иногда я внутри изолированной ВМ. Иногда я на ноутбуке, иногда на домашней машине с большой GPU для локальных моделей. Если бы я мог запустить harness, который мог бы идентифицировать себя внутри моей сети Tailscale, то, вероятно, у меня был бы единый веб-интерфейс, который позволял бы мне держать весь этот контекст в порядке.
Мне хочется поэкспериментировать с Pi для настройки такой вещи. Но, возможно, уже существуют паттерны с harness, которые я не рассматривал.
- theturtletalks
Harness — это следующий рубеж. Если LLM — это электричество, то harness — это "электроника". Сейчас это как AC против DC между Claude и ChatGPT, но когда это устаканится, harness станут реальными поставщиками ценности.
И Pi — лучший harness из-за удивительной системы расширений. Вы можете создавать расширения, которые превращают Pi в биржевого трейдера, фабрику программного обеспечения, что угодно. Я пытался перейти на другой harness, но ни у одного нет такой хорошей функциональности расширений, как у Pi.
Даже если появляется новый harness или проект агента, я говорю Pi покопаться в кодовой базе, а затем сделать мне расширение, которое привносит эту функциональность в Pi. Я сделал это с harness от Prime Intellect и Deepseek, и они построены на Pi.
- ni10c
Автор здесь. Ирония в том, что этот пост явно был рассчитан на не-хакеров. Но раз уж мы здесь... другая аналогия, которую я рассматривал, была:
harness = шасси,
модель = двигатель,
топливо = токены,
агент = автомобиль
Мне интересно, что вы думаете и несет ли эта аналогия больше объяснительной силы.
- jascha_eng
Хайповое слово 2026 года после "агента" в 2025 году для любого приложения на основе LLM.
Ну, вроде того, я не удивлюсь, если увижу, что некоторые вещи, продаваемые как агенты, на самом деле являются старым добрым детерминированным ПО.
- childofhedgehog
Ясно, актуально и легко понять. Спасибо, что написали это, я поделюсь этой ссылкой со всеми своими нетехническими друзьями!
- tosh
Мне тоже нравится аналогия с рюкзаком.
Harness — это то, что вы берете с собой в поездку/на задачу.
То, что вы берете с собой, не бесплатно (системный промпт, инструменты, навыки...).
Некоторые модели очень хороши, даже если вы берете почти без навыков, инструментов или системного промпта.
Harness — это дополнение к модели.
Чем лучше модель, тем минималистичнее может быть harness.
Harness вроде pi [0] и smol [1] находятся на более минималистичном конце спектра.