DeepSeek V4.1-Flash выпущен: функции, бенчмарки и как получить доступ к нему
2026-09-11
DeepSeek выпустила свой последний эффективный флагман, DeepSeek V4.1 Flash, позиционируя новую модель DeepSeek как решающий шаг вперед в возможностях, скорости, стоимости и масштабируемости.
Выпущенная около 10 сентября 2026 года, модель описана компанией как самый компактный член ее новой архитектурной семьи. Она разработана для улучшения возможностей, ускорения выхода, увеличения пропускной способности и прокладки пути для более крупных моделей.
По данным DeepSeek и внутренних/внешних тестирований, DeepSeek V4.1 Flash гораздо превосходит предыдущую V4 Pro по производительности, стоимости, скорости и общей задержке/времени выполнения задач.
В результате DeepSeek выводит V4 Pro из эксплуатации. Начиная с 04:00 UTC 14 сентября 2026 года, каждый запрос, отправленный на deepseek-v4-pro, автоматически перенаправляется на DeepSeek V4.1 Flash и выставляется по тарифам Flash.
Это соглашение продолжается до будущего запуска V4.1 Pro. Более старые V4-Flash и V4-Flash-Vision-Exp конечные точки уже были сняты с эксплуатации, с временными совместимыми псевдонимами, перенаправляющими на новую модель.
Ключевые выносы
- DeepSeek V4.1 Flash — это модель Mixture-of-Experts с 552B параметрами, из которых только 8B активных параметров на входе и 16B на выходе, обеспечивающая более сильные результаты, чем V4 Pro, по гораздо более низкой стоимости и задержке.
- Нативная мультимодальность, значительно меньший KV кэш (1/4 HBM, 1/8 SSD предыдущего поколения), открытые веса с лицензией MIT и максимальные тарифы $0.30/$1.20 за 1M токенов делают ее очень привлекательной для агентных и высокообъемных рабочих нагрузок.
- С 04:00 UTC 14 сентября 2026 года все запросы deepseek-v4-pro перенаправляются на DeepSeek V4.1 Flash по тарифам Flash до запуска V4.1 Pro; разработчикам следует проактивно мигрировать и тестировать изменения в подсказках/поведении.
Почему Внезапный Переключатель Вызвал Дебаты

Источник: X/Deepseek
Cui Tianyi из команды Harness DeepSeek подчеркнул на X, что V4.1 Flash полностью превосходит V4 Pro по ключевым метрикам, что делает продолжение обслуживания старой, более дорогой и медленной модели неэффективным.
С точки зрения DeepSeek изменение очевидно: пользователи получают более сильную, быструю и дешевую модель, в то время как компания освобождает вычислительные ресурсы.
Многие разработчики не согласились с выполнением. Переключение было объявлено с примерно одном днём уведомления и без параллельного окна миграции.
Системы производства, которые тщательно настраивали подсказки, форматы выходных данных, последовательности вызовов инструментов и проверки качества для V4 Pro, рисковали неожиданными изменениями в следовании инструкциям, длине ответов, поведении отказа или структуре.
Исследовательские команды, использующие DeepSeek-V4-Pro-0813 для текущих экспериментов, также высказали опасения о воспроизводимости.
Комментаторы подчеркивали стандартные практики программной инженерии, различные идентификаторы моделей, много недельные переходные периоды и варианты отката, особенно когда модели становятся зависимостями внутри агентных потоков и бизнес-логики.
Читайте также: Инсайдеры Раскрывают, Что DeepSeek V4 Превосходит Конкурентов AI Coding
Особенности и Архитектура DeepSeek V4.1

Источник: datacamp
DeepSeek V4.1 Flash — это разреженная модель Mixture-of-Experts с 552 миллиардами параметров. Только около 8 миллиардов параметров активируются во время предварительного заполнения (вход) и 16 миллиардов во время декодирования.
Она использует архитектуру Causal Encoder-Decoder (CED): трансформер с 40 слоями, разделенный на 20-слойный причинный кодировщик и 20-слойный декодер.
Глобальный KV кэш декодера проецируется из окончательных скрытых состояний кодировщика, а не восстанавливается слой за слоем.
В сочетании с Compressed Sparse Attention 2 (CSA2), FP4 KV кешированием и SWA Bounded Replay, глобальный KV кэш уменьшается до примерно 890 байтов на токен, что примерно в четверть меньше HBM и в восьми раз меньше хранилища SSD предыдущего поколения Flash.
Дополнительные компоненты включают условную память Engram (196B параметров, доступных разреженно через поиск токенов),
однопроходное смешивание mHC остатка и спекулятивное декодирование DSpark. Каждый слой MoE имеет 1 общего эксперта и 384 маршрутизируемых экспертов, активируя 6 маршрутизируемых экспертов на токен.
Модель была обучена с нуля на мультимодальном корпусе из 45 триллионов токенов, с контекстом, увеличенным до 1 миллиона токенов. Она нативно принимает изображения и текст через визуальный кодировщик (DeepSeek-ViT) и проектор, который обучался совместно с начала предобучения.
После обучения следует привычный путь SFT → RL → дистилляция на основе политики, с сильным акцентом на автоматизированный синтез задач агентов и окружающей среды в большом масштабе.
Усилия в рассуждениях можно непрерывно контролировать от 1 до 100, позволяя пользователям торговать стоимостью против точности по каждому запросу.
Эти особенности DeepSeek V4.1 воплощаются в конкретных преимуществах для агентных рабочих нагрузок: более дешевые повторные чтения долгих контекстов, большая конкурентоспособность и меньшее давление на память на серверном оборудовании.
Читайте также: DeepSeek и Alibaba's Qwen обошли OpenAI ChatGPT в конкурсе по криптотрейдингу
Производительность Benchmark
DeepSeek сообщает о сильных результатах по агентным и кодировочным бенчмаркам при максимальных усилиях в рассуждениях. Выбранные сравнений:
Производительность сильнее на коротких, высокообъемных циклах агентов и слабее на самых требовательных длинных горизонтах или специализированных оценках безопасности.
Шаблон предпочитает маршрутизацию массового трафика агентов к DeepSeek V4.1 Flash, оставляя тяжелые фронтовые модели для самых сложных остаточных задач.
Цены и доступность

Источник: X/Deepseek
Обновленные цены для DeepSeek V4.1 Flash вступили в силу в 04:00 UTC 10 сентября 2026 года:
Цены в непиковое время вдвое ниже пиковых. Пиковые окна обычно с 01:00 до 04:00 и с 06:00 до 10:00 UTC по будням.
Цены на попадание в кэш делают повторные системные подсказки или документы крайне дешевыми, что является важным преимуществом для агентов, которые повторно читают большие стабильные контексты.
Модель доступна через официальный DeepSeek API (совместимый с OpenAI) под идентификатором deepseek-flash. Веса с лицензией MIT опубликованы для собственных нужд, коммерческого использования, дообучения и перераспределения.
Как использовать DeepSeek V4.1
API (рекомендуется для большинства пользователей):
Измените базовый URL и имя модели в любом клиенте, совместимом с OpenAI:

Поддерживается ввод изображений в том же запросе. Официальные партнеры, включая WorkBuddy/CodeBuddy и OpenCode, уже открывают модель.
DeepSeek Harness (обновлен до 0.1.5) глубоко интегрируется с V4.1 Flash, добавляя поддержку стандартного, программного вызова инструментов и минималистичных режимов, а также улучшенные точки расширения интерфейса пользователя и обработки файлов.
Самостоятельное хостинг: загрузите веса MIT и используйте с соответствующей GPU памятью.
DeepSeek планирует сотрудничество с сообществом с открытым исходным кодом по поддержке вывода и большим конфигурациям развертывания.
Примечание по миграции: если вы все еще используете deepseek-v4-pro, подготовьтесь к переходу на deepseek-flash до или сразу после 14 сентября 2026 года. Повторно протестируйте подсказки, схемы вывода, последовательности инструментов и контроль качества, так как средняя способность выше, но поведенческие детали могут отличаться.
Широкий контекст: инженерный масштаб и будущие планы

Источник: datacamp
За два дня до объявления маршрутизации DeepSeek разместил примерно 150 вакансий для старших инженеров по бекенду и серверам.
Почти ни одна из них не сосредоточена на обучении модели; акцент делается на операционных системах, виртуализации, сетях, хранении, планировании, контейнерах, управляющих плоскостях и эластичных вычислениях агента (DSec).
DSec — это песочница DeepSeek для масштабирования развертываний агентов, поддерживающая предварительно нагретые контейнеры, совместимые с Docker среды, микро-VM Firecracker и полные QEMU VMs, поддерживаемые распределенной файловой системой 3FS и глобальными упорядоченными логами трассировки для надежного восстановления после перерывов.
Поток найма сигнализирует о том, что DeepSeek активно инвестирует в системы под своими моделями, чтобы поддержать растущие объемы данных, одновременно работающие окружения агентов и нагрузку запросов.
DeepSeek также привлек CITIC Securities как одного из андеррайтеров, готовящихся к возможному IPO на Шанхайском STAR Market, с запуском процесса, запланированным на конец 2026 года.
Ранее финансирование оценивалось выше 50 миллиардов долларов, а в последующих отчетах обсуждались потенциальные оценки около 75 миллиардов долларов.
Капитал ожидается для поддержки вычислительной инфраструктуры, разработки модели и удержания талантов.
Читайте также: DeepSeek AI шокирует трейдеров: этот альткоин может стать следующим Dogecoin
Заключение
DeepSeek V4.1 Flash демонстрирует, что агрессивные архитектурные инновации, дизайн Причинного Кодировщика-Декодировщика, экстремальное сжатие KV-кэша, разреженная активация и нативная мультимодальность могут предоставить результаты, близкие к фронтиру, по цене, значительно ниже закрытых конкурентов.
Модель особенно привлекательна для агентов по кодированию с высоким объемом, пакетного вывода, тяжелых документов и любой рабочей нагрузки, которая выигрывает от дешевого повторного использования длинного контекста.
Главные недостатки — это слабые результаты на самых длинных горизонтах наборов агентов и операционное трение из-за пикового/непикового расписания или требований к аппаратному обеспечению для самостоятельного хостинга.
Споры вокруг резкой переадресации V4 Pro подчеркивают более широкую точку зрения: когда модели становятся зависимостями в производстве, изоляция версий, предварительное уведомление и переходные окна имеют такое же значение, как и чистая мощность.
Готовность DeepSeek нанять 150 инженеров для базовых систем показывает, что он понимает инженерные требования в больших масштабах; применение того же ригоризма к контракту для разработчиков моделей версий еще больше укрепит доверие.
Независимо от того, получаете ли вы доступ к DeepSeek V4.1 Flash через API или размещаете открытые веса самостоятельно, сочетание производительности, цены, открытости и нативной поддержки мультимодальности делает его одним из самых интересных релизов, ориентированных на эффективность, конца 2026 года.
Протестируйте его на своих нагрузках, измерьте фактическую задержку и качество дельты, и решите, оправдывает ли экономика переключение основной части вашего трафика агентов.
Оставайтесь в курсе последних событий в технологиях, рынках и новых тенденциях. Для постоянного освещения крипторынка и связанных с ним аналитических материалов продолжайте читать последние статьи на блоге Bitrue.
Часто задаваемые вопросы
1. Что такое DeepSeek V4.1 Flash?
Это новейшая эффективная мультимодальная модель Mixture-of-Experts от DeepSeek (всего 552B параметров, 8B/16B активные), выпущенная в сентябре 2026 года. Она имеет архитектуру Causal Encoder-Decoder, нативное понимание изображений, окно контекста на 1M токенов и открытые веса с лицензией MIT.
2. Как DeepSeek V4.1 Flash сравнивается с V4 Pro?
DeepSeek утверждает, что после внутренних и внешних тестирований V4.1 Flash всесторонне превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения задач. Следовательно, трафик V4 Pro перенаправляется на Flash.
3. Какова стоимость DeepSeek V4.1 Flash?
Пиковые ставки составляют $0.30 за ввод / $1.20 за вывод на 1M токенов; непиковые ставки вдвое ниже. Ввод с кэш-попаданием составляет всего $0.006 (пиковый) / $0.003 (непиковый). Цены вступили в силу 10 сентября 2026 года.
4. Как я могу использовать DeepSeek V4.1 / DeepSeek V4.1 Flash?
Используйте совместимый с OpenAI API с model="deepseek-flash" и base_url="https://api.deepseek.com", или загрузите веса MIT для самостоятельного размещения. Партнеры, такие как CodeBuddy и OpenCode, уже поддерживают это; DeepSeek Harness предоставляет дополнительную scaffolding для агентов.
5. Когда V4 Pro перестанет работать и что будет дальше?
С 04:00 UTC 14 сентября 2026 года все запросы deepseek-v4-pro перенаправляются на DeepSeek V4.1 Flash по ценам Flash до выпуска V4.1 Pro. Пользователи должны быстро мигрировать и повторно проверять свои каналы.
Отказ от ответственности: Мнения, высказанные в данной статье, принадлежат исключительно автору и не отражают мнения этой платформы. Эта платформа и ее дочерние компании отказываются от какой-либо ответственности за точность или соответствие предоставленной информации. Она предназначена исключительно для информационных целей и не является финансовым или инвестиционным советом.
Disclaimer: De inhoud van dit artikel vormt geen financieel of investeringsadvies.




