DeepSeek V4.1-Flash 發佈:特點、基準測試以及如何訪問它

2026-09-11
DeepSeek V4.1-Flash 發佈:特點、基準測試以及如何訪問它

DeepSeek 發布了其最新的高效旗艦,DeepSeek V4.1 Flash,將DeepSeek的新型號定位為在能力、速度、成本和可擴展性上的決定性進步。

在2026年9月10日左右發布,該型號被公司描述為其新架構家族中最緊湊的成員。它旨在增強能力,加快輸出,增加吞吐量,並為更大型號鋪平道路。

根據DeepSeek及內部/外部測試,DeepSeek V4.1 Flash在性能、成本、速度和總延遲/任務完成時間上全面超越了之前的V4 Pro。

因此,DeepSeek正在逐步淘汰V4 Pro。自2026年9月14日04:00 UTC起,發送到deepseek-v4-pro的每個請求將自動路由到DeepSeek V4.1 Flash,並按Flash層級費率計費。

這一安排將持續到未來推出的V4.1 Pro。舊的V4-Flash和V4-Flash-Vision-Exp端點已經退役,並通過臨時兼容別名重定向到新型號。

join bitrue to get 938 usdt

主要重點

  • DeepSeek V4.1 Flash是一個552B參數的專家混合模型,在輸入上僅有8B活動參數,輸出上有16B,提供比V4 Pro更強的結果,成本和延遲則低得多。
  • 原生的多模態性,大幅縮小的KV緩存(與前一代相比,1/4的HBM,1/8的SSD),MIT授權的開放權重,以及每百萬個令牌的峰值定價為$0.30/$1.20,對於自主和高容量的工作負載非常有吸引力。
  • 自2026年9月14日04:00 UTC起,所有deepseek-v4-pro請求將以Flash費率路由到DeepSeek V4.1 Flash,直到V4.1 Pro推出;開發者應主動遷移並測試提示/行為的變化。

為什麼突如其來的轉變引發了爭議

DeepSeek V4.1-Flash Released - Bitrue.png

來源:X/Deepseek

DeepSeek的Harness團隊的Cui Tianyi在X上指出,V4.1 Flash在關鍵指標上完全超越了V4 Pro,使得繼續維護舊有的、更昂貴和更慢的模型變得低效。

從DeepSeek的角度來看,這個變化是簡單明了的:用戶獲得了一個更強、更快、更便宜的模型,同時公司釋放了計算資源。

許多開發者不同意這種執行方式。轉換是在大約一天的通知下宣布的,並沒有平行的遷移窗口。

對於已經仔細調整了提示、輸出格式、工具調用順序和質量控制檢查的V4 Pro生產系統來說,面臨著指令遵循、答案長度、拒絕行為或結構的意外變化風險。

使用DeepSeek-V4-Pro-0813進行持續實驗的研究團隊也對可重複性提出了擔憂。

評論者強調了標準軟件工程實踐、不同的模型ID、多周的過渡期和回滾選項,尤其是當模型成為代理管道和業務邏輯中的依賴時。

另外閱讀:內部人士透露DeepSeek V4在AI編碼競爭中超越了競爭對手

DeepSeek V4.1的特點和架構

DeepSeek V4.1-Flash Released - Bitrue.png

來源:datacamp

DeepSeek V4.1 Flash是一個稀疏的專家混合模型,擁有5520億總參數。在預填充(輸入)期間僅有約80億參數啟用,而在解碼期間則有160億。

它使用了一種因果編碼器-解碼器(CED)架構:一個40層的Transformer分為20層因果編碼器和20層解碼器。

解碼器的全局KV緩存是根據編碼器的最終隱藏狀態投影,而不是層層重建。

結合了壓縮稀疏注意力2(CSA2)、FP4 KV緩存和SWA有界重播,全局KV緩存縮小至每個令牌約890字節,約為前一代Flash存儲的四分之一的HBM和八分之一的SSD。

額外組件包括以令牌查找稀疏訪問的Engram條件記憶(196B參數),

單通道mHC殘差混合,以及DSpark推測性解碼。每個MoE層有1個共享專家和384個路由專家,每個令牌啟用6個路由專家。

該模型在一個45萬億令牌的多模態語料庫上從零開始訓練,其上下文延伸到100萬個令牌。它原生接受通過視覺編碼器(DeepSeek-ViT)和從預訓練開始共同訓練的投影儀的圖像和文本。

後訓練遵循熟悉的SFT → RL → 在政策蒸餾路徑上,重點強調大規模自動合成代理任務和環境。

推理努力從1到100持續可控,允許用戶在每個請求中在成本和準確性之間進行權衡。

這些DeepSeek V4.1的特點轉化為自主工作負載的具體優勢:更便宜的長上下文重讀、更高的並發性和對服務硬體的較低內存壓力。

另外閱讀:DeepSeek和阿里巴巴的Qwen在加密交易比賽中超越OpenAI ChatGPT

基準性能

DeepSeek報告強勁的結果 在自主和編碼基準的最大推理努力下。選擇的比較:

基準

DeepSeek V4.1 Flash

註釋 / 先前或前沿參考

Terminal-Bench 2.1

90.6

先前的V4-Flash-0731 ~82.7

DeepSWE v1.1

74.2

在這項任務上與最近的前沿模型競爭或領先

AutomationBench

54.8

相對表現強勁

代理的最後考試

31.8

領先於幾個同行

CyberGym

88.1

強大的網絡安全任務得分

GPQA 鑽石

90.9

堅實的研究生級科學

Codeforces 評分

3471

在 V4 Pro 上有所改善

數學競技場巔峰

65.6

匹配頂尖報告同行

人類的最後考試(僅限文本)

36.8 / 39.1†

艱難的專家設定的試驗

終端基準 3.0 / 4.0

30.0 / 31.2

在長期綜合套件上明顯下降

在較短時間範圍、高容量的代理迴圈上性能最強,對最具挑戰性的長期或專業安全評估則較弱。

該模式傾向於將大宗代理流量路由到 DeepSeek V4.1 Flash,同時將更重的前沿模型保留給最艱難的殘餘任務。

定價及可用性

DeepSeek V4.1-Flash Released - Bitrue.png

來源:X/Deepseek

DeepSeek V4.1 Flash 的更新定價於 2026 年 9 月 10 日 04:00 UTC 生效:

費率

峰值

非峰值

每 1M 代幣的輸入(快取未命中)

$0.30

$0.15

每 1M 代幣的輸入(快取命中)

$0.006

$0.003

每 1M 代幣的輸出

$1.20

$0.60

非峰值費率是峰值的一半。峰值窗口通常為工作日的 01:00–04:00 及 06:00–10:00 UTC。

快取命中定價使重複的系統提示或文檔極其便宜,這對於重讀大型穩定上下文的代理來說是一個重要優勢。

該模型可通過官方的 DeepSeek API(OpenAI 兼容)在 deepseek-flash 標識下使用。MIT 授權的權重已發布,可供自我托管、商業使用、微調和再分發。

如何使用 DeepSeek V4.1

API(推薦給大多數用戶):

在任何兼容 OpenAI 的客戶端中更改基礎 URL 和模型名稱:

DeepSeek V4.1-Flash Released - Bitrue.png

原生影像輸入在同一請求中受到支持。包括 WorkBuddy/CodeBuddy 和 OpenCode 在內的官方夥伴已經公開模型。

DeepSeek Harness(更新至 0.1.5)與 V4.1 Flash 深度整合,增加對標準、程序化工具調用和極簡模式的支持,以及改善的 UI 擴展點和文件處理。

自我托管:下載 MIT 權重並使用適當的 GPU 內存提供服務。

DeepSeek 計劃與開源社區合作在推理支持和更大部署配置上。

遷移注意:如果您仍在調用 deepseek-v4-pro,請準備在 2026 年 9 月 14 日之前或剛好之後切換到 deepseek-flash。重新測試提示、輸出模式、工具序列和質量門檻,因為平均能力較高,但行為細節可能有所不同。

更廣泛的背景:工程規模及未來計劃

DeepSeek V4.1-Flash Released - Bitrue.png

來源:datacamp

在路由公告前兩天,DeepSeek 發佈了大約 150 個高級後端和伺服器工程職缺。

幾乎沒有專注於模型訓練;重點在於操作系統、虛擬化、網絡、存儲、調度、容器、控制平面和代理彈性計算(DSec)。

DSec 是 DeepSeek 的沙盒基礎設施,用於大型代理的推出,支持預熱容器、Docker 兼容環境、Firecracker 微虛擬機和完整的 QEMU 虛擬機,並由 3FS 分佈式文件系統和全球有序追蹤日誌支持,以便在中斷後可靠恢復。

招聘潮預示著 DeepSeek 正在大力投資於其模型背後的系統,以支持日益增長的數據量、並發代理環境和請求負載。

DeepSeek 還聘請了中信證券作為可能在上海科創板 IPO 的承銷商之一,目標在 2026 年底啟動進程。

早期的融資使公司估值超過 500 億美元,後來的報告提到潛在估值約 750 億美元。

資金預計將支持計算基礎設施、模型開發和人才保留。

另請參閱:DeepSeek AI 震驚交易者:這個山寨幣可能是下一个狗狗幣

結論

DeepSeek V4.1 Flash 展示了激進的架構創新、因果編碼器-解碼器設計、極端的 KV-快取壓縮、稀疏激活和原生的多模態性,可以以封閉競爭對手的一小部分成本提供邊緣相關的代理性能。

該模型對於高容量編碼代理、批量推理、文檔重的管道以及任何從廉價長上下文重用中受益的工作負載尤其吸引人。

其主要警告是對於最長時間範圍的代理套件結果較弱,以及在峰值/非峰值計劃或自我托管硬件要求上的操作摩擦。

對於 V4 Pro 突然重定向的爭議突顯出一個更廣泛的要點:當模型成為生產依賴時,版本隔離、提前通知和過渡時間與原始能力同樣重要。

DeepSeek 願意為基礎系統招聘 150 名工程師顯示其理解大規模所需的工程;如果將相同的嚴謹性應用於開發者對應模型版本的合約,將進一步增強信任。

無論你是通過 API 訪問 DeepSeek V4.1 Flash 還是自託管開放權重,性能、價格、開放性和原生多模態支持的結合使其成為 2026 年晚些時候最有趣的高效釋放之一。

在你的工作負載上進行測試,衡量實際延遲和質量差異,並決定經濟因素是否合理地 justify 轉換你的代理流量。

隨時了解技術、市場和新興趨勢的最新發展。想了解有關加密市場及相關洞見的持續報導,請持續閱讀 Bitrue 博客.

常見問題

1. DeepSeek V4.1 Flash 是什麼?

它是 DeepSeek 最新的高效多模態專家混合模型(總參數 552B,活躍參數 8B/16B),於 2026 年 9 月發布。它具備因果編碼-解碼架構、原生圖像理解、1M 代幣的上下文窗口和 MIT 許可的開放權重。

2. DeepSeek V4.1 Flash 與 V4 Pro 有何比較?

DeepSeek 表示,在內部和外部測試後,V4.1 Flash 在性能、成本、速度和總任務完成時間上全面超越 V4 Pro。因此,V4 Pro 的流量正被重定向到 Flash。

3. DeepSeek V4.1 Flash 的價格是多少?

高峰費率為每 100 萬個代幣 $0.30 輸入 / $1.20 輸出;非高峰費率為一半。緩存命中輸入最低可達 $0.006(高峰)/ $0.003(非高峰)。定價於 2026 年 9 月 10 日生效。

4. 如何使用 DeepSeek V4.1 / DeepSeek V4.1 Flash?

使用兼容 OpenAI 的 API,設置 model="deepseek-flash" 和 base_url="https://api.deepseek.com",或下載 MIT 權重以自託管。代碼夥伴如 CodeBuddy 和 OpenCode 已經支持它;DeepSeek Harness 提供額外的代理框架。

5. V4 Pro 何時停止工作,下一步會發生什麼?

自 2026 年 9 月 14 日 UTC 04:00 起,所有 deepseek-v4-pro 請求都將過渡到 DeepSeek V4.1 Flash 並按照 Flash 價格計費,直到 V4.1 Pro 發布。用戶應及時遷移並重新驗證其管道。

 

免責聲明:所表達的觀點僅屬於作者,並不反映此平台的觀點。這個平台及其附屬機構對所提供信息的準確性或適用性不承擔任何責任。僅供參考,不構成財務或投資建議。

免責聲明:本文內容不構成財務或投資建議。

立即註冊以領取 6752 USDT 的新手禮包

加入 Bitrue 獲取獨家獎勵

立即註冊
register

推薦

JUGGERNAUT 代幣今天上漲超過 300%—發生了什麼事?
JUGGERNAUT 代幣今天上漲超過 300%—發生了什麼事?

JUGGERNAUT 在 Robinhood 的資產頁上獲得曝光後,價格猛漲。以下是觸發這一波動的原因、這次飆升的規模以及交易者應保持謹慎的原因。

2026-09-11閱讀