ИИ · Агенты · Habr AI · Habr Career29 июля в 11:01 · 3 мин

Архитектура надежных агентов: почему харнесс важнее модели

В эпоху повсеместной доступности API больших языковых моделей ключевым фактором успеха становится не выбор нейросети, а качество окружающей инфраструктуры. Концепция harness engineering переопределяет подход к созданию интеллектуальных агентов: модели выступают лишь как процессоры, принимающие решения на основе контекста, тогда как реальная ценность и точность системы определяются детерминированными инструментами (CLI-командами) и управляемой памятью. Автор материала отмечает, что в критических доменах, таких как финансы, полагаться на вероятностную природу генеративных моделей без жестких проверок невозможно.

# Модель — это мозг, харнесс — тело агента

Перевод статьи от [Habr AI](https://habr.com/ru/articles/1064286), где автор раскрывает фундаментальный сдвиг в архитектуре ИИ-агентов.

От промптов к инженерии контекста

Терминология меняется. Если раньше в центре внимания был «промт-инжиниринг» — искусство точного формулирования запроса к модели, то сейчас этот подход уступает место контекстному инженерингу (context engineering). Как отмечают эксперты Gartner и практики индустрии, роль оператора смещается от хитрого составления предложений к управлению окружением модели.

Аналогия проста и наглядна: модель — это мощный, но абстрактный процессор. Её «оперативная память» (контекстное окно) ограничена. Загружать туда всё подряд нельзя. Исследования показывают явление «rot» (порчи) контекста: даже при огромных окнах (200k токенов) качество ответов деградирует при превышении определённого порога (часто около 50k). Поэтому задача разработчика — не переполнять память, а поставлять туда строго отфильтрованную и релевантную информацию для конкретного шага. Всё остальное должно быть вынесено наружу.

Детерминизм против вероятности

Главное ограничение генеративных моделей — их вероятностная природа. Для нейросети любой ответ, даже верный, генерируется заново. Если попросить агента посчитать финансовый показатель или сформировать список данных, он может вернуться с идентичными данными дважды, но третий раз результат может отличаться. В задачах, где требуется 100% точность (финансы, медицина, право), такой «шум» недопустим.

Решение кроется в переходе логики из «головы» модели в внешний код. То, что раньше описывалось естественным языком в промпте («постарайся не повторяться», «сложи это число»), теперь переносится в детерминированные инструменты.

* Код над промптом: Логика сортировки, проверки правил и арифметики должна быть зашита в проверенные скрипты. * Идентификация инструментов: Повторяемые действия, совершаемые дважды руками ИИ, становятся стандартными CLI-командами. * Равноценные входы и выходы: Хороший инструмент для агента, как и для человека, имеет понятные описания, примеры использования и гарантированно воспроизводимые результаты.

Роль харнесса в экосистеме

Взгляд на структуру проекта меняется: модель занимает примерно треть его сложности, но она «арендуется». Настоящая архитектура строится вокруг неё:

1. Состояние системы: Харнесс хранит текущее состояние процесса, чтобы агент не начинал задачу с нуля при каждом шаге. 2. Память и контекст: Управление тем, что именно загружается в окно модели в момент обращения. 3. Действия во внешнем мире: Доступ к базам данных, файловой системе и другим сервисам осуществляется через контролируемые интерфейсы.

Разделение труда становится четким: модель отвечает за язык, суждение, обработку неоднозначности и создание планов на основе размытых задач. Харнесс обеспечивает счёт, соблюдение правил, валидацию и исполнение действий.

Будущее архитектуры агентов

Модели становятся взаимозаменяемыми. Возможность легко перейти с одной нейросети на другую внутри существующего проекта подтверждает, что преимущество утекает не в чип или алгоритм обучения, а в окружение. «Руки» агента — это набор инструментов, которые человек-архитектор спроектировал заранее. В то время как промпт-инженер уходит в прошлое как самостоятельная роль, появляется потребность в инженерах, способных создавать надежную инфраструктуру (harness), которая обеспечит предсказуемость и безопасность ИИ-систем на годы впереш.

Суть заключается в том, что в критических приложениях харнесс — это не костыль для слабых моделей, а обязательное условие эксплуатации. Даже при росте интеллекта моделей они не смогут самостоятельно устранить необходимость в строгой координации, управлении состоянием и защите от ошибок в дорогих доменах.

Первоисточники

Habr AI
← Вернуться в эфир