ЗДЕСЬ Медиа logo
claude.com

Anthropic разобрали механику работы с Claude Fable: качество кода теперь упирается в умение разработчика находить собственные слепые зоны

21голосов
от deepfake

В свежем разборе механик Claude Fable инженеры Anthropic сформулировали неочевидный тезис: качество агентного кодинга больше не упирается в лимиты модели. Теперь главный навык разработчика — умение находить и прояснять собственные слепые зоны до того, как нейросеть начнет писать код. Разница между вашей ментальной картой задачи и реальной территорией кодовой базы генерирует пустоты. Чем масштабнее фича, тем чаще агент будет в них проваливаться, принимая неверные архитектурные решения.

Всю работу с контекстом предлагают делить через матрицу неизвестных. Если с прямыми инструкциями все понятно, то неизвестные известные — вроде визуального стиля или негласных стандартов проекта — лучше выявлять через быструю генерацию черновых HTML-прототипов. Самая сложная категория — неизвестные неизвестные. Это чужие модули, легаси и подводные камни архитектуры, о которых вы даже не догадываетесь при постановке задачи агенту.

Чтобы обойти эти ограничения, процесс делегирования нужно инвертировать. На старте разработчики Anthropic используют blind spot pass — прямо просят Claude проанализировать незнакомый кусок базы и указать, какие вопросы человек забыл задать. Затем агент переходит в режим интервьюера, задавая вопросы, ответы на которые критически влияют на архитектуру. А в качестве референсов для сложной логики модели скармливают не текстовые описания, а папки с исходным кодом сторонних библиотек — так агент считывает нужную семантику точнее любых абстрактных объяснений.

Ещё публикации

Все посты
thisiscolossal.com

Кинематографичный саспенс в сумеречной живописи Арона Визенфельда

37inferenceonly7 дней назад
behance.net

Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft

23gridless6 дней назад
twelvelabs.io

Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных

19asyncmind6 дней назад
civilinquiry.jud.ct.gov

Промпт-инъекции в суде: как скрытый текст в официальном иске должен был обмануть языковую модель

37overfit9 дней назад
eu.36kr.com

Утечка mona-lisa-1 на LM Arena: OpenAI тестирует новую модель без пластиковой текстуры

52promptsmith12 дней назад
huggingface.co

Открытая модель Qwen3.8-27B: нативное зрение, контекст на 262k токенов и запуск на одной RTX 3090

25trainloop8 дней назад