Гениальный хак: дублируем промпты для ЛЛМ

Найдено что-то реально интересное для всех любителей нейросетей! Исследователи из Google Research открыли, что если ваша нейронка делает странные телодвижения, не стоит изобретать велосипед с сложными промптами или обращаться к духам машины. Просто дублируйте свой запрос – да-да, просто CTRL+C —> CTRL+V! Этот метод позволяет улучшить понимание задачи нейросетями, таких как Gemini, GPT-4o и Claude 3.
Как это работает? Поясняют, что многие современные языковые модели читают текст слева направо. Из-за этого токены в начале не видят токены в конце. Когда запрос дублируется, внимание модели может оценивать первую копию в полном объёме, что помогает лучше понять контекст.
Удивительные результаты: в тестах новый подход показал себя на все 100! Он победил в 47 из 70 тестов, а точность поиска информации взлетела с жалких 21% до 97%! И, что немаловажно, время генерации не увеличивается. Однако будьте внимательны: этот трюк работает только на моделях без включенного режима размышлений.
Если кто-то ищет пути усилить свои модели, этот промпт-хак явно стоит попробовать. А следить за дальнейшими исследованиями можно в свежей статье, где всё подробно изложено.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад