Официальный запуск API в бета-версии
31 июля 2026 года компания DeepSeek официально перевела свою модель V4-Flash в стадию публичного бета-тестирования, выпустив обновление DeepSeek-V4-Flash-0731. Этот релиз знаменует переход от стадии предварительного просмотра к полноценному продукту, демонстрируя значительный прирост производительности в задачах программирования и автономных агентных вычислений. Согласно официальной документации модели, архитектура осталась неизменной: 284 млрд параметров в структуре Mixture-of-Experts (MoE) с активацией 13 млрд параметров на токен и поддержкой контекстного окна в 1 миллион токенов.
Прирост производительности через дообучение
Улучшения в версии 0731 достигнуты исключительно за счет интенсивного дообучения (re-post-training), без внесения изменений в архитектуру. Бенчмарки, опубликованные DeepSeek, показывают впечатляющие результаты: в тесте Cybergym модель набрала 76.7 баллов против 38.7 в версии preview. В бенчмарке DeepSWE результат вырос с 7.3 до 54.4. Эти данные свидетельствуют о значительно возросшей способности модели справляться со сложными задачами разработки ПО и многошаговым агентным рассуждением.
Развертывание и доступность
DeepSeek-V4-Flash-0731 теперь доступна через API по цене $0.14 за 1 млн входных токенов при промахе кэша, что примерно в три раза дешевле стоимости версии V4-Pro. Такая ценовая политика ориентирована на стартапы и разработчиков, позволяя запускать агентные циклы без высоких затрат на инфраструктуру. Модель распространяется по лицензии MIT. При этом для локального развертывания (on-premise) требуются значительные вычислительные мощности: для полноценной работы в исходной точности необходим узел 4×GB300, а для версии с 3-битной квантованием — около 110 ГБ оперативной памяти.

