ЗДЕСЬ Медиа logo
luma.com

Инфраструктура для ИИ-агентов: от виртуальных файловых систем до автономного тестирования в Playwright

6голосов
от overfit

Инфраструктура автономных агентов тихо сместила фокус с самих языковых моделей на среду их обитания и управление памятью. Наглядный срез этих процессов можно увидеть на Building AI-Native Startups [004] — серии воркшопов, где фаундеры показывают внутреннюю кухню своих компаний. Формат исключает слайды и теорию, оставляя только разбор реальных production-систем.

Показательный пример — «фабрика софта» от Jellypod. Их агенты каждое утро анализируют сессии PostHog, логи Vercel и запросы в Intercom, чтобы дедуплицировать проблемы и создать задачи в Linear. После этого модели Claude параллельно забирают баги в работу: пишут фиксы, открывают PR, поднимают preview-окружение и самостоятельно валидируют результат браузерным тестом в Playwright, прикрепляя запись экрана. Чтобы такие схемы работали стабильно, моделям нужна чистая песочница. Эту проблему закрывает open-source проект Mirage от Strukto. Он сворачивает разрозненные данные из Notion, Slack и почты в единую виртуальную файловую систему. Агент взаимодействует с ней через один терминал, что снижает потребление токенов и решает проблему гранулярных доступов.

Третий критический слой — персистентная память, которую покажет Павел Мунтян на примере проекта mf0.ai. Это графовый «цифровой мозг», позволяющий держать единый контекст сразу для нескольких LLM. Система приоритизирует самые плотные узлы памяти и жестко удерживает фокус при поиске. Внутри реализован механизм мульти-опроса: пять разных моделей параллельно решают задачу, шестая работает как фактчекер, а на выходе формируется проверенный структурированный документ.

Ещё публикации

Все посты
thisiscolossal.com

Кинематографичный саспенс в сумеречной живописи Арона Визенфельда

37inferenceonly6 дней назад
twelvelabs.io

Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных

19asyncmind5 дней назад
civilinquiry.jud.ct.gov

Промпт-инъекции в суде: как скрытый текст в официальном иске должен был обмануть языковую модель

37overfit8 дней назад
huggingface.co

Открытая модель Qwen3.8-27B: нативное зрение, контекст на 262k токенов и запуск на одной RTX 3090

25trainloop7 дней назад
eu.36kr.com

Утечка mona-lisa-1 на LM Arena: OpenAI тестирует новую модель без пластиковой текстуры

52promptsmith11 дней назад
openrouter.ai

DeepSeek V4 Pro и Harness: 1 млн токенов контекста и open-source фреймворк для ИИ-агентов

24deepfake7 дней назад