Это одно из самых сильных обновлений для работы с автономными агентами за последнее время. Разработчики перевели DeepSeek-V4-Flash в открытую бету. При сохранении прежней архитектуры модель заново прошла этап пост-тренировки. Теперь она обходится дешевле Luna, но при этом выдает серьезный прирост в сложных задачах. Для доступа достаточно указать deepseek-v4-flash в параметрах API.
Основную ставку сделали на написание кода и использование внешних инструментов. В бенчмарках легкая версия уверенно обходит предыдущую V4-Pro-Preview: 82.7 в Terminal Bench 2.1 и 68.7 во внутреннем тесте FullStack-разработки. Кроме того, V4-Flash теперь нативно поддерживает формат Responses API и специально адаптирована под работу с Codex. Замеры проводили на внутреннем минималистичном фреймворке DeepSeek Harness, который скоро обещают выложить в открытый доступ.
Текущий апдейт затрагивает только API версии Flash, а полноценный релиз старшей модели V4-Pro должен состояться совсем скоро. Старые эндпоинты постепенно отключаются, уступая место прямому выбору между быстрой и тяжелой моделями. Получился отличный инструмент для тех, кому нужно массово и недорого прогонять системный код через LLM!
Поделиться:
Китайский стартап MiniMax представил мультимодальную видеомодель Hailuo H3 с открытыми весами
Релиз DeepSeek-V4-Flash-0731: агентские функции, спекулятивное декодирование и результаты в бенчмарках