OpenAI открыла публичную бету Agents API — инфраструктуры для облачных агентов

Компания SafetyKit после переноса своего процесса проверки страховых случаев на новую инфраструктуру OpenAI получила падение стоимости обработки одного случая на 60% — и это только один из десятка похожих отчётов, которые компания собрала к запуску Agents API.
OpenAI вывела в открытую бету Agents API — сервис, который отдаёт разработчикам тот же харнес и инфраструктуру, что уже несколько лет обкатываются внутри Codex и ChatGPT Work на миллионах пользователей. Идея в том, чтобы не заставлять каждую компанию заново изобретать, как агент должен управлять контекстом разговора, эффективно выбирать инструменты и координировать работу нескольких вспомогательных агентов, — всё это OpenAI теперь отдаёт одним вызовом API, указав только задачу, модель, инструменты и среду выполнения.
Среду можно выбрать под задачу — управляемая песочница OpenAI, собственная инфраструктура компании или один из партнёров по экосистеме:
- Modal, Cloudflare, Daytona, Blaxel, Runloop, Vercel, Oracle, E2B и DigitalOcean.
У каждого партнёра свой профиль по цене, скорости холодного старта и конфигурации процессора и памяти, а часть допускает развёртывание прямо внутри частного облака клиента.
Технически новыми в харнесе стали три вещи. Управление контекстом само сжимает предыдущую часть разговора по мере приближения к лимиту, поэтому агент может работать часами, не теряя нужные детали и не заставляя разработчика писать логику сжатия вручную. Поиск инструментов подгружает описания нужных функций по ходу работы, а не сразу все, — это снижает расход токенов и бережёт кэш модели. А мультиагентная поддержка позволяет разбить сложную задачу на независимые куски и раздать их вспомогательным агентам, которые работают параллельно и держат каждый свой контекст, пока главный агент координирует и собирает результат воедино.
Отзывы первых клиентов складываются в довольно однородную картину выгоды. В Ciridae оценка агента на внутреннем тесте выросла с 0,71 до 0,85, а задержка в сценариях с вспомогательными агентами упала в четыре раза. В логистической платформе Nash.ai на новой инфраструктуре уже работают тысячи долгоживущих агентов, управляющих сотнями миллионов доставок по всему миру. Финансовая компания Hypha, разделив харнес агента и песочницу, снизила долю неудачных ответов агента на 86% — критичный показатель там, где ошибка стоит доверия клиента. А платформа Long Lake рассказала, что теперь разворачивает агентов для новых индустрий — от бытовых услуг до архитектуры — за часы, а не за недели.
Доступ открыт всем разработчикам уже сегодня, отдельной платы за сам API нет — оплачиваются только токены модели и вызовы инструментов. При этом харнес остаётся открытым исходным кодом: OpenAI управляет и поддерживает инфраструктуру вокруг него, но сам код, который координирует вызовы модели, инструменты и контекст, можно изучить и понять, как именно агент принимает решения, а не просто довериться чёрному ящику.
Хорошая инфраструктура для агентов долго была тем, что каждая компания собирала сама, набивая шишки на управлении контекстом и параллельными процессами. OpenAI, по сути, предлагает рынку тот же выбор, что когда-то сделали облачные провайдеры с серверами: не стройте это с нуля, стройте поверх того, что уже отлажено на масштабе, который вам самим ещё только предстоит достичь.



