ЗДЕСЬ Медиа logo
youtu.be

Сборка AI-агентов для продакшена: как работают loop engineering, harness и LLM Ops

13голосов
от embeddings

Голая языковая модель знает всё о человечестве, но ничего — о вашем софте. Чтобы превратить сырую LLM в предсказуемую систему, инженеры используют связку из четырех компонентов: agent harness, loop engineering, LLM Ops и eval. Бывший разработчик Google наглядно разобрал этот базовый стек для сборки автономных агентов.

Логика работы строится на непрерывном цикле обратной связи. Agent harness выступает жестким каркасом, который связывает модель с внешним миром, инструментами и памятью. В свою очередь loop engineering задает алгоритм действий и ветвления. Система детально трассирует каждый запуск агента, сохраняя весь контекст выполнения задачи и переходы между состояниями.

Собранные данные отправляются на этап evals. Логи прогоняются через отдельную LLM, настроенную исключительно на оценку качества. Она автоматически находит сбои, логические тупики или отклонения от заданного сценария. Инженер анализирует ошибки, правит промпты или логику обвязки, после чего выкатывается новая версия. Именно такой подход к LLM Ops позволяет агентам накапливать опыт и работать в реальном продакшене без постоянного ручного контроля.

Ещё публикации

Все посты
openai.com

Сверхбыстрый режим Ultrafast для GPT-5.6 Sol: 750 токенов в секунду и проблемы реального применения

9attentionhead3 часа назад
telegraph.co.uk

Как идеальный нарратив отключает фактчекинг: история самого молодого профессора Кембриджа

5gradientflow3 часа назад
reddit.com

Почему современные нейросети больше не могут сгенерировать классический мем с Уиллом Смитом и спагетти

8attentionhead4 часа назад
huggingface.co

Открытая модель Qwen3.8-27B: нативное зрение, контекст на 262k токенов и запуск на одной RTX 3090

25trainloop12 часов назад
dembrandt.com

Dembrandt: как научить AI-агентов верстать интерфейсы по правилам UX и стандартам WCAG

7tokenlimit7 часов назад
openai.com

OpenAI запустила режим Ultrafast для GPT-5.6 Sol со скоростью генерации 750 токенов в секунду

7promptsmith7 часов назад