В OpenRouter стала доступна модель DeepSeek V4 Pro 0813. Это Mixture-of-Experts архитектура с окном контекста на 1 048 576 токенов. Лимит генерации увеличен до 384 000 токенов на один ответ. Стоимость API держится на уровне $0.43 за миллион входящих и $0.87 за миллион исходящих токенов. Скорость выдачи через балансировщики достигает 67 токенов в секунду.
Релиз модели совпал с выходом DeepSeek Harness. Это open-source среда для разработки автономных ИИ-агентов. Архитектура построена на плагинах. Разработчик подключает модели, инструменты, песочницу и политики доступа как независимые модули. Фреймворк работает как инфраструктурный слой. Он напрямую конкурирует с решениями вроде Claude Code. В документации указана нативная интеграция Harness с семейством моделей V4.
Модель V4 Pro поддерживает потоковую передачу reasoning-токенов. В API можно управлять этим процессом через параметр reasoning. Ответ возвращает массив reasoning_details, показывая цепочку рассуждений до генерации финального текста. При многошаговых сессиях агента этот массив передается обратно в модель. Вызовы идут через стандартный OpenAI-совместимый формат, требуя только замены базового URL.
Поделиться:
Свежий Журналус: отличная база по дизайну ИИ-интерфейсов и продуктовым фреймворкам
Alibaba начал раскатку API для видеогенератора Wan 3.0: цены за секунду рендера и конкуренция провайдеров