DeepSeek V4.1-Flash выпущен: функции, бенчмарки и как получить доступ к нему

2026-09-11
DeepSeek V4.1-Flash выпущен: функции, бенчмарки и как получить доступ к нему

DeepSeek выпустила свой последний эффективный флагман, DeepSeek V4.1 Flash, позиционируя новую модель DeepSeek как решающий шаг вперед в возможностях, скорости, стоимости и масштабируемости. 

Выпущенная около 10 сентября 2026 года, модель описана компанией как самый компактный член ее новой архитектурной семьи. Она разработана для улучшения возможностей, ускорения выхода, увеличения пропускной способности и прокладки пути для более крупных моделей.

По данным DeepSeek и внутренних/внешних тестирований, DeepSeek V4.1 Flash гораздо превосходит предыдущую V4 Pro по производительности, стоимости, скорости и общей задержке/времени выполнения задач. 

В результате DeepSeek выводит V4 Pro из эксплуатации. Начиная с 04:00 UTC 14 сентября 2026 года, каждый запрос, отправленный на deepseek-v4-pro, автоматически перенаправляется на DeepSeek V4.1 Flash и выставляется по тарифам Flash. 

Это соглашение продолжается до будущего запуска V4.1 Pro. Более старые V4-Flash и V4-Flash-Vision-Exp конечные точки уже были сняты с эксплуатации, с временными совместимыми псевдонимами, перенаправляющими на новую модель.

join bitrue to get 938 usdt

Ключевые выносы

  • DeepSeek V4.1 Flash — это модель Mixture-of-Experts с 552B параметрами, из которых только 8B активных параметров на входе и 16B на выходе, обеспечивающая более сильные результаты, чем V4 Pro, по гораздо более низкой стоимости и задержке.
  • Нативная мультимодальность, значительно меньший KV кэш (1/4 HBM, 1/8 SSD предыдущего поколения), открытые веса с лицензией MIT и максимальные тарифы $0.30/$1.20 за 1M токенов делают ее очень привлекательной для агентных и высокообъемных рабочих нагрузок.
  • С 04:00 UTC 14 сентября 2026 года все запросы deepseek-v4-pro перенаправляются на DeepSeek V4.1 Flash по тарифам Flash до запуска V4.1 Pro; разработчикам следует проактивно мигрировать и тестировать изменения в подсказках/поведении.

Почему Внезапный Переключатель Вызвал Дебаты

DeepSeek V4.1-Flash Released - Bitrue.png

Источник: X/Deepseek

Cui Tianyi из команды Harness DeepSeek подчеркнул на X, что V4.1 Flash полностью превосходит V4 Pro по ключевым метрикам, что делает продолжение обслуживания старой, более дорогой и медленной модели неэффективным. 

С точки зрения DeepSeek изменение очевидно: пользователи получают более сильную, быструю и дешевую модель, в то время как компания освобождает вычислительные ресурсы.

Многие разработчики не согласились с выполнением. Переключение было объявлено с примерно одном днём уведомления и без параллельного окна миграции.

Системы производства, которые тщательно настраивали подсказки, форматы выходных данных, последовательности вызовов инструментов и проверки качества для V4 Pro, рисковали неожиданными изменениями в следовании инструкциям, длине ответов, поведении отказа или структуре. 

Исследовательские команды, использующие DeepSeek-V4-Pro-0813 для текущих экспериментов, также высказали опасения о воспроизводимости. 

Комментаторы подчеркивали стандартные практики программной инженерии, различные идентификаторы моделей, много недельные переходные периоды и варианты отката, особенно когда модели становятся зависимостями внутри агентных потоков и бизнес-логики.

Читайте также: Инсайдеры Раскрывают, Что DeepSeek V4 Превосходит Конкурентов AI Coding

Особенности и Архитектура DeepSeek V4.1

DeepSeek V4.1-Flash Released - Bitrue.png

Источник: datacamp

DeepSeek V4.1 Flash — это разреженная модель Mixture-of-Experts с 552 миллиардами параметров. Только около 8 миллиардов параметров активируются во время предварительного заполнения (вход) и 16 миллиардов во время декодирования. 

Она использует архитектуру Causal Encoder-Decoder (CED): трансформер с 40 слоями, разделенный на 20-слойный причинный кодировщик и 20-слойный декодер. 

Глобальный KV кэш декодера проецируется из окончательных скрытых состояний кодировщика, а не восстанавливается слой за слоем. 

В сочетании с Compressed Sparse Attention 2 (CSA2), FP4 KV кешированием и SWA Bounded Replay, глобальный KV кэш уменьшается до примерно 890 байтов на токен, что примерно в четверть меньше HBM и в восьми раз меньше хранилища SSD предыдущего поколения Flash.

Дополнительные компоненты включают условную память Engram (196B параметров, доступных разреженно через поиск токенов), 

однопроходное смешивание mHC остатка и спекулятивное декодирование DSpark. Каждый слой MoE имеет 1 общего эксперта и 384 маршрутизируемых экспертов, активируя 6 маршрутизируемых экспертов на токен.

Модель была обучена с нуля на мультимодальном корпусе из 45 триллионов токенов, с контекстом, увеличенным до 1 миллиона токенов. Она нативно принимает изображения и текст через визуальный кодировщик (DeepSeek-ViT) и проектор, который обучался совместно с начала предобучения. 

После обучения следует привычный путь SFT → RL → дистилляция на основе политики, с сильным акцентом на автоматизированный синтез задач агентов и окружающей среды в большом масштабе. 

Усилия в рассуждениях можно непрерывно контролировать от 1 до 100, позволяя пользователям торговать стоимостью против точности по каждому запросу.

Эти особенности DeepSeek V4.1 воплощаются в конкретных преимуществах для агентных рабочих нагрузок: более дешевые повторные чтения долгих контекстов, большая конкурентоспособность и меньшее давление на память на серверном оборудовании.

Читайте также: DeepSeek и Alibaba's Qwen обошли OpenAI ChatGPT в конкурсе по криптотрейдингу

Производительность Benchmark

DeepSeek сообщает о сильных результатах по агентным и кодировочным бенчмаркам при максимальных усилиях в рассуждениях. Выбранные сравнений:

Бенчмарк

DeepSeek V4.1 Flash

Заметки / Предыдущая или Граница Ссылки

Terminal-Bench 2.1

90.6

Предыдущий V4-Flash-0731 ~82.7

DeepSWE v1.1

74.2

Конкурирует или опережает недавние модельные границы по этой задаче

AutomationBench

54.8

Сильное относительное представление

Последний экзамен агента

31.8

Опередил нескольких коллег

CyberGym

88.1

Сильный балл по задачам кибербезопасности

GPQA Diamond

90.9

Солидный уровень науки для выпускников

Рейтинг Codeforces

3471

Улучшено по сравнению с V4 Pro

MathArena Apex

65.6

Соответствует самым высокооплачиваемым коллегам

Последний экзамен человечества (только текст)

36.8 / 39.1†

Самые сложные экспертные настройки Trails

Terminal-Bench 3.0 / 4.0

30.0 / 31.2

Заметное снижение на более длительных горизонтах наборов

Производительность сильнее на коротких, высокообъемных циклах агентов и слабее на самых требовательных длинных горизонтах или специализированных оценках безопасности. 

Шаблон предпочитает маршрутизацию массового трафика агентов к DeepSeek V4.1 Flash, оставляя тяжелые фронтовые модели для самых сложных остаточных задач.

Цены и доступность

DeepSeek V4.1-Flash Released - Bitrue.png

Источник: X/Deepseek

Обновленные цены для DeepSeek V4.1 Flash вступили в силу в 04:00 UTC 10 сентября 2026 года:

Ставка

Пик

Непиковое время

Входные данные (промах кэша) на 1M токенов

$0.30

$0.15

Входные данные (попадание в кэш) на 1M токенов

$0.006

$0.003

Выходные данные на 1M токенов

$1.20

$0.60

Цены в непиковое время вдвое ниже пиковых. Пиковые окна обычно с 01:00 до 04:00 и с 06:00 до 10:00 UTC по будням. 

Цены на попадание в кэш делают повторные системные подсказки или документы крайне дешевыми, что является важным преимуществом для агентов, которые повторно читают большие стабильные контексты. 

Модель доступна через официальный DeepSeek API (совместимый с OpenAI) под идентификатором deepseek-flash. Веса с лицензией MIT опубликованы для собственных нужд, коммерческого использования, дообучения и перераспределения.

Как использовать DeepSeek V4.1

API (рекомендуется для большинства пользователей):

Измените базовый URL и имя модели в любом клиенте, совместимом с OpenAI:

DeepSeek V4.1-Flash Released - Bitrue.png

Поддерживается ввод изображений в том же запросе. Официальные партнеры, включая WorkBuddy/CodeBuddy и OpenCode, уже открывают модель. 

DeepSeek Harness (обновлен до 0.1.5) глубоко интегрируется с V4.1 Flash, добавляя поддержку стандартного, программного вызова инструментов и минималистичных режимов, а также улучшенные точки расширения интерфейса пользователя и обработки файлов.

Самостоятельное хостинг: загрузите веса MIT и используйте с соответствующей GPU памятью. 

DeepSeek планирует сотрудничество с сообществом с открытым исходным кодом по поддержке вывода и большим конфигурациям развертывания.

Примечание по миграции: если вы все еще используете deepseek-v4-pro, подготовьтесь к переходу на deepseek-flash до или сразу после 14 сентября 2026 года. Повторно протестируйте подсказки, схемы вывода, последовательности инструментов и контроль качества, так как средняя способность выше, но поведенческие детали могут отличаться.

Широкий контекст: инженерный масштаб и будущие планы

DeepSeek V4.1-Flash Released - Bitrue.png

Источник: datacamp

За два дня до объявления маршрутизации DeepSeek разместил примерно 150 вакансий для старших инженеров по бекенду и серверам. 

Почти ни одна из них не сосредоточена на обучении модели; акцент делается на операционных системах, виртуализации, сетях, хранении, планировании, контейнерах, управляющих плоскостях и эластичных вычислениях агента (DSec). 

DSec — это песочница DeepSeek для масштабирования развертываний агентов, поддерживающая предварительно нагретые контейнеры, совместимые с Docker среды, микро-VM Firecracker и полные QEMU VMs, поддерживаемые распределенной файловой системой 3FS и глобальными упорядоченными логами трассировки для надежного восстановления после перерывов. 

Поток найма сигнализирует о том, что DeepSeek активно инвестирует в системы под своими моделями, чтобы поддержать растущие объемы данных, одновременно работающие окружения агентов и нагрузку запросов.

DeepSeek также привлек CITIC Securities как одного из андеррайтеров, готовящихся к возможному IPO на Шанхайском STAR Market, с запуском процесса, запланированным на конец 2026 года. 

Ранее финансирование оценивалось выше 50 миллиардов долларов, а в последующих отчетах обсуждались потенциальные оценки около 75 миллиардов долларов. 

Капитал ожидается для поддержки вычислительной инфраструктуры, разработки модели и удержания талантов.

Читайте также: DeepSeek AI шокирует трейдеров: этот альткоин может стать следующим Dogecoin

Заключение

DeepSeek V4.1 Flash демонстрирует, что агрессивные архитектурные инновации, дизайн Причинного Кодировщика-Декодировщика, экстремальное сжатие KV-кэша, разреженная активация и нативная мультимодальность могут предоставить результаты, близкие к фронтиру, по цене, значительно ниже закрытых конкурентов. 

Модель особенно привлекательна для агентов по кодированию с высоким объемом, пакетного вывода, тяжелых документов и любой рабочей нагрузки, которая выигрывает от дешевого повторного использования длинного контекста. 

Главные недостатки — это слабые результаты на самых длинных горизонтах наборов агентов и операционное трение из-за пикового/непикового расписания или требований к аппаратному обеспечению для самостоятельного хостинга.

Споры вокруг резкой переадресации V4 Pro подчеркивают более широкую точку зрения: когда модели становятся зависимостями в производстве, изоляция версий, предварительное уведомление и переходные окна имеют такое же значение, как и чистая мощность.

Готовность DeepSeek нанять 150 инженеров для базовых систем показывает, что он понимает инженерные требования в больших масштабах; применение того же ригоризма к контракту для разработчиков моделей версий еще больше укрепит доверие.

Независимо от того, получаете ли вы доступ к DeepSeek V4.1 Flash через API или размещаете открытые веса самостоятельно, сочетание производительности, цены, открытости и нативной поддержки мультимодальности делает его одним из самых интересных релизов, ориентированных на эффективность, конца 2026 года.

Протестируйте его на своих нагрузках, измерьте фактическую задержку и качество дельты, и решите, оправдывает ли экономика переключение основной части вашего трафика агентов.

Оставайтесь в курсе последних событий в технологиях, рынках и новых тенденциях. Для постоянного освещения крипторынка и связанных с ним аналитических материалов продолжайте читать последние статьи на блоге Bitrue.

Часто задаваемые вопросы

1. Что такое DeepSeek V4.1 Flash?

Это новейшая эффективная мультимодальная модель Mixture-of-Experts от DeepSeek (всего 552B параметров, 8B/16B активные), выпущенная в сентябре 2026 года. Она имеет архитектуру Causal Encoder-Decoder, нативное понимание изображений, окно контекста на 1M токенов и открытые веса с лицензией MIT.

2. Как DeepSeek V4.1 Flash сравнивается с V4 Pro?

DeepSeek утверждает, что после внутренних и внешних тестирований V4.1 Flash всесторонне превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения задач. Следовательно, трафик V4 Pro перенаправляется на Flash.

3. Какова стоимость DeepSeek V4.1 Flash?

Пиковые ставки составляют $0.30 за ввод / $1.20 за вывод на 1M токенов; непиковые ставки вдвое ниже. Ввод с кэш-попаданием составляет всего $0.006 (пиковый) / $0.003 (непиковый). Цены вступили в силу 10 сентября 2026 года.

4. Как я могу использовать DeepSeek V4.1 / DeepSeek V4.1 Flash?

Используйте совместимый с OpenAI API с model="deepseek-flash" и base_url="https://api.deepseek.com", или загрузите веса MIT для самостоятельного размещения. Партнеры, такие как CodeBuddy и OpenCode, уже поддерживают это; DeepSeek Harness предоставляет дополнительную scaffolding для агентов.

5. Когда V4 Pro перестанет работать и что будет дальше?

С 04:00 UTC 14 сентября 2026 года все запросы deepseek-v4-pro перенаправляются на DeepSeek V4.1 Flash по ценам Flash до выпуска V4.1 Pro. Пользователи должны быстро мигрировать и повторно проверять свои каналы.

 

Отказ от ответственности: Мнения, высказанные в данной статье, принадлежат исключительно автору и не отражают мнения этой платформы. Эта платформа и ее дочерние компании отказываются от какой-либо ответственности за точность или соответствие предоставленной информации. Она предназначена исключительно для информационных целей и не является финансовым или инвестиционным советом.

Disclaimer: De inhoud van dit artikel vormt geen financieel of investeringsadvies.

Зарегистрируйтесь сейчас, чтобы получить пакет подарков для новичков на сумму 6752 USDT

Присоединяйтесь к Bitrue, чтобы получить эксклюзивные награды

Зарегистрироваться сейчас
register

Рекомендуемое

Как работает блокчейн Arc? Начало работы с Arc
Как работает блокчейн Arc? Начало работы с Arc

Узнайте, как работает блокчейн Arc: нативный L1 для стейблкоина Circle с газом USDC, финализация за доли секунды и встроенный FX-движок для реальных финансов.

2026-09-11Читать