DeepSeek V4.1-Flash Dirilis: Fitur, Benchmark, dan Cara Mengaksesnya

2026-09-11
DeepSeek V4.1-Flash Dirilis: Fitur, Benchmark, dan Cara Mengaksesnya

DeepSeek telah merilis flagship efisien terbarunya, DeepSeek V4.1 Flash, memposisikan model baru DeepSeek sebagai langkah maju yang menentukan dalam kemampuan, kecepatan, biaya, dan skalabilitas. 

Dirilis sekitar 10 September 2026, model ini dijelaskan oleh perusahaan sebagai anggota paling kompak dari keluarga arsitektur barunya. Ini dirancang untuk meningkatkan kemampuan, mempercepat keluaran, meningkatkan throughput, dan membuka jalan bagi model yang lebih besar.

Menurut DeepSeek dan pengujian internal/eksternal, DeepSeek V4.1 Flash secara komprehensif mengungguli V4 Pro sebelumnya di seluruh kinerja, biaya, kecepatan, dan total latensi/waktu penyelesaian tugas. 

Akibatnya, DeepSeek menghentikan V4 Pro. Mulai pukul 04:00 UTC pada 14 September 2026, setiap permintaan yang dikirim ke deepseek-v4-pro secara otomatis dirutekan ke DeepSeek V4.1 Flash dan ditagih pada tarif tingkat Flash. 

Pengaturan ini berlanjut hingga peluncuran V4.1 Pro di masa depan. Titik akhir V4-Flash lama dan V4-Flash-Vision-Exp telah ditutup, dengan alias kompatibilitas sementara yang mengalihkan ke model baru.

join bitrue to get 938 usdt

Inti Pengambilan

  • DeepSeek V4.1 Flash adalah model Mixture-of-Experts dengan 552B parameter dengan hanya 8B parameter aktif pada input dan 16B pada output, memberikan hasil yang lebih kuat daripada V4 Pro dengan biaya dan latensi yang jauh lebih rendah.
  • Multimodalitas asli, cache KV yang jauh lebih kecil (1/4 HBM, 1/8 SSD dari generasi sebelumnya), berat terbuka berlisensi MIT, dan harga puncak sebesar $0.30/$1.20 per 1M token menjadikannya sangat menarik untuk beban kerja agentic dan volume tinggi.
  • Mulai pukul 04:00 UTC pada 14 September 2026, semua permintaan deepseek-v4-pro akan dirutekan ke DeepSeek V4.1 Flash pada tarif Flash sampai V4.1 Pro diluncurkan; pengembang harus migrasi secara proaktif dan menguji perubahan prompt/perilaku.

Mengapa Perpindahan Mendadak Memicu Perdebatan

DeepSeek V4.1-Flash Released - Bitrue.png

Sumber: X/Deepseek

Cui Tianyi dari tim Harness DeepSeek menekankan di X bahwa V4.1 Flash sepenuhnya melampaui V4 Pro di metrik kunci, menjadikan pemeliharaan model lama yang lebih mahal dan lebih lambat menjadi tidak efisien. 

Dari sudut pandang DeepSeek, perubahan ini jelas: pengguna menerima model yang lebih kuat, lebih cepat, dan lebih murah sementara perusahaan membebaskan sumber daya komputasi.

Banyak pengembang tidak setuju dengan pelaksanaannya. Perpindahan diumumkan dengan pemberitahuan sekitar satu hari dan tanpa jendela migrasi paralel.

Sistem produksi yang telah menyesuaikan prompt, format output, urutan pemanggilan alat, dan pemeriksaan kontrol kualitas untuk V4 Pro berisiko mengalami perubahan yang tidak terduga dalam mengikuti instruksi, panjang jawaban, perilaku penolakan, atau struktur. 

Tim penelitian yang menggunakan DeepSeek-V4-Pro-0813 untuk eksperimen yang sedang berlangsung juga mengangkat kekhawatiran tentang reprodusibilitas. 

Komentator menekankan praktik rekayasa perangkat lunak standar, ID model yang berbeda, periode transisi multi-minggu, dan opsi rollback, terutama setelah model menjadi ketergantungan di dalam saluran agen dan logika bisnis.

Baca Juga: Orang Dalam Mengungkapkan DeepSeek V4 Mengungguli Pesaing Pengkodean AI

Fitur dan Arsitektur DeepSeek V4.1

DeepSeek V4.1-Flash Released - Bitrue.png

Sumber: datacamp

DeepSeek V4.1 Flash adalah model Mixture-of-Experts yang jarang dengan total 552 miliar parameter. Hanya sekitar 8 miliar parameter yang aktif selama prefill (input) dan 16 miliar selama decoding. 

Ini menggunakan arsitektur Encoder-Decoder Kausal (CED): transformer 40-lapis yang dibagi menjadi encoder kausal 20-lapis dan decoder 20-lapis. 

Cache KV global decoder diproyeksikan dari status tersembunyi akhir encoder daripada dibangun kembali lapis demi lapis. 

Dikombinasikan dengan Attention Jarang Terkompresi 2 (CSA2), caching KV FP4, dan Replay Terbatas SWA, cache KV global menyusut menjadi sekitar 890 byte per token, sekitar seperempat dari HBM dan sepertiga dari penyimpanan SSD generasi Flash sebelumnya.

Komponen tambahan termasuk memori kondisional Engram (196B parameter diakses jarang melalui pencarian token), 

Pencampuran residual mHC Single-Pass, dan decoding spekulatif DSpark. Setiap lapisan MoE memiliki 1 ahli bersama dan 384 ahli yang diarahkan, mengaktifkan 6 ahli yang diarahkan per token.

Model ini dilatih dari awal pada korpus multimodal 45 triliun token, dengan konteks diperpanjang hingga 1 juta token. Ini secara native menerima gambar dan teks melalui encoder visi (DeepSeek-ViT) dan proyektor yang dilatih bersama sejak awal pelatihan awal. 

Pelatihan pasca mengikuti jalur distilasi on-policy SFT → RL →, dengan penekanan berat pada sintesis otomatis berskala besar dari tugas dan lingkungan agen. 

Upaya penalaran dapat terus dikendalikan dari 1 hingga 100, memungkinkan pengguna untuk menukar biaya dengan akurasi pada setiap permintaan.

Fitur DeepSeek V4.1 ini diterjemahkan menjadi keuntungan konkret untuk beban kerja agentic: pembacaan ulang konteks panjang yang lebih murah, konkuren yang lebih tinggi, dan tekanan memori yang lebih rendah pada perangkat keras yang melayani.

Baca Juga: DeepSeek dan Qwen milik Alibaba Mengalahkan OpenAI ChatGPT dalam Kontes Perdagangan Kripto

Performa Tolok Ukur

DeepSeek melaporkan hasil yang kuat pada tolok ukur agentic dan pengkodean dengan upaya penalaran maksimum. Perbandingan yang dipilih:

Tolok Ukur

DeepSeek V4.1 Flash

Catatan / Referensi Sebelumnya atau Perbatasan

Terminal-Bench 2.1

90.6

V4-Flash-0731 Sebelumnya ~82.7

DeepSWE v1.1

74.2

Kompetitif dengan atau lebih unggul dari model perbatasan terbaru dalam tugas ini

AutomationBench

54.8

Menunjukkan performa relatif yang kuat

Ujian Terakhir Agen

31.8

Lebih unggul dari beberapa rekan

CyberGym

88.1

Skor tugas keamanan siber yang kuat

GPQA Diamond

90.9

Ilmu sains tingkat pascasarjana yang solid

Peringkat Codeforces

3471

Meningkat dibandingkan V4 Pro

MathArena Apex

65.6

Cocok dengan rekan teratas yang dilaporkan

Ujian Terakhir Kemanusiaan (teks saja)

36.8 / 39.1†

Rute pengaturan ahli yang paling sulit

Terminal-Bench 3.0 / 4.0

30.0 / 31.2

Penurunan yang nyata pada suite jangka panjang

Kinerja paling kuat pada loop agen jangka pendek dan volume tinggi, dan lebih lemah pada evaluasi keamanan jangka panjang atau khusus yang paling menuntut. 

Polanya lebih memilih rute lalu lintas agen besar ke DeepSeek V4.1 Flash sambil menyimpan model frontier yang lebih berat untuk tugas residual yang paling sulit.

Pricing dan Ketersediaan

DeepSeek V4.1-Flash Released - Bitrue.png

Sumber: X/Deepseek

Harga yang diperbarui untuk DeepSeek V4.1 Flash mulai berlaku pada 04:00 UTC pada 10 September 2026:

Tarif

Puncak

Di luar puncak

Input (cache miss) per 1M token

$0.30

$0.15

Input (cache hit) per 1M token

$0.006

$0.003

Output per 1M token

$1.20

$0.60

Tarif di luar puncak setengah dari puncak. Jendela puncak biasanya 01:00–04:00 dan 06:00–10:00 UTC pada hari kerja. 

Harga cache-hit membuat pengulangan permintaan sistem atau dokumen sangat murah, keuntungan penting bagi agen yang membaca kembali konteks yang stabil dan besar. 

Model tersedia melalui DeepSeek API (kompatibel dengan OpenAI) di bawah identifier deepseek-flash. Bobot berlisensi MIT diterbitkan untuk self-hosting, penggunaan komersial, fine-tuning, dan redistribusi.

Cara Menggunakan DeepSeek V4.1

API (direkomendasikan untuk sebagian besar pengguna):

Ubah URL dasar dan nama model di klien yang kompatibel dengan OpenAI mana pun:

DeepSeek V4.1-Flash Released - Bitrue.png

Input gambar asli didukung dalam permintaan yang sama. Mitra resmi termasuk WorkBuddy/CodeBuddy dan OpenCode sudah mengekspos model tersebut. 

DeepSeek Harness (diperbarui ke 0.1.5) terintegrasi dengan dalam V4.1 Flash, menambahkan dukungan untuk pemanggilan alat programatik standar dan mode minimalis, ditambah titik ekstensi UI yang ditingkatkan dan penanganan file.

Self-hosting: Unduh bobot MIT dan sajikan dengan memori GPU yang sesuai. 

DeepSeek merencanakan kolaborasi dengan komunitas open-source pada dukungan inferensi dan konfigurasi penyebaran yang lebih besar.

Catatan migrasi: Jika Anda masih menggunakan deepseek-v4-pro, bersiaplah untuk beralih ke deepseek-flash sebelum atau segera setelah 14 September 2026. Uji kembali permintaan, skema output, urutan alat, dan gerbang kualitas, karena kemampuan rata-rata lebih tinggi tetapi detail perilaku dapat berbeda.

Konteks yang lebih luas: Skala Rekayasa dan Rencana Masa Depan

DeepSeek V4.1-Flash Released - Bitrue.png

Sumber: datacamp

Dua hari sebelum pengumuman routing, DeepSeek memposting sekitar 150 lowongan senior backend dan rekayasa server. 

Hampir tidak ada yang fokus pada pelatihan model; penekanan adalah pada sistem operasi, virtualisasi, jaringan, penyimpanan, penjadwalan, kontainer, pesawat kontrol, dan komputasi elastis Agen (DSec). 

DSec adalah infrastruktur sandbox DeepSeek untuk rollout agen skala besar, mendukung kontainer yang dipanaskan sebelumnya, lingkungan yang kompatibel dengan Docker, micro-VM Firecracker, dan VM QEMU penuh, didukung oleh sistem file terdistribusi 3FS dan log jejak terurut global untuk pemulihan yang andal setelah gangguan. 

Gelombang perekrutan menandakan bahwa DeepSeek berinvestasi besar-besaran dalam sistem di bawah modelnya untuk mendukung volume data yang berkembang, lingkungan agen yang bersamaan, dan beban permintaan.

DeepSeek juga telah melibatkan CITIC Securities sebagai salah satu penjamin emisi yang bersiap untuk kemungkinan IPO di Pasar STAR Shanghai, dengan target inisiasi proses pada akhir 2026. 

Pendanaan sebelumnya menilai perusahaan di atas $50 miliar, dengan laporan selanjutnya membahas potensi valuasi sekitar $75 miliar. 

Modal diharapkan untuk mendukung infrastruktur komputasi, pengembangan model, dan retensi bakat.

Baca Juga: DeepSeek AI Mengguncang Pedagang: Altcoin Ini Bisa Menjadi Dogecoin Berikutnya

Kesimpulan

DeepSeek V4.1 Flash menunjukkan bahwa inovasi arsitektural yang agresif, desain Causal Encoder-Decoder, kompresi KV-cache yang ekstrem, aktivasi jarang, dan multimodalitas asli, dapat memberikan kinerja agen yang hampir di perbatasan dengan biaya yang jauh lebih rendah dibandingkan pesaing tertutup. 

Model ini sangat menarik bagi agen pengkodean volume tinggi, penalaran batch, jalur banyak dokumen, dan beban kerja apa pun yang mendapatkan keuntungan dari penggunaan ulang konteks panjang yang murah. 

Kekurangan utamanya adalah hasil yang lebih lemah pada suite agen jangka panjang dan gesekan operasional dari penjadwalan puncak/di luar puncak atau persyaratan perangkat keras self-hosting.

Kontroversi seputar pengalihan mendadak V4 Pro menegaskan poin yang lebih luas: ketika model menjadi ketergantungan produksi, isolasi versi, pemberitahuan sebelumnya, dan jendela transisi sama pentingnya dengan kemampuan mentah. 

Kesediaan DeepSeek untuk merekrut 150 insinyur untuk sistem yang mendasarinya menunjukkan bahwa mereka memahami rekayasa yang diperlukan pada skala; menerapkan ketelitian yang sama pada kontrak versi model yang menghadap pengembang akan semakin memperkuat kepercayaan.

Apakah Anda mengakses DeepSeek V4.1 Flash melalui API atau menghosting sendiri bobot terbuka, kombinasi kinerja, harga, keterbukaan, dan dukungan multimodal asli menjadikannya salah satu rilis yang paling menarik dengan fokus efisiensi akhir 2026. 

Ujilah pada beban kerja Anda, ukur latensi aktual dan delta kualitas, dan putuskan apakah ekonomi membenarkan pengalihan sebagian besar lalu lintas agen Anda.

Tetap terinformasi tentang perkembangan terbaru dalam teknologi, pasar, dan tren yang muncul. Untuk liputan berkelanjutan tentang pasar crypto dan wawasan terkait, teruslah membaca artikel terbaru di blog Bitrue.

FAQ

1. Apa itu DeepSeek V4.1 Flash?

Ini adalah model Mixture-of-Experts multimodal efisien terbaru dari DeepSeek (552B total parameter, 8B/16B aktif), dirilis pada September 2026. Ini memiliki arsitektur Encoder-Decoder Kausal, pemahaman gambar asli, jendela konteks 1M-token, dan bobot terbuka berlisensi MIT.

2. Bagaimana DeepSeek V4.1 Flash dibandingkan dengan V4 Pro?

DeepSeek menyatakan bahwa setelah pengujian internal dan eksternal, V4.1 Flash secara komprehensif melampaui V4 Pro dalam kinerja, biaya, kecepatan, dan total waktu penyelesaian tugas. Akibatnya, lalu lintas V4 Pro dialihkan ke Flash.

3. Apa harga untuk DeepSeek V4.1 Flash?

Tarif puncak adalah $0.30 input / $1.20 output per 1M token; tarif di luar puncak adalah setengahnya. Input cache-hit serendah $0.006 (puncak) / $0.003 (di luar puncak). Penetapan harga mulai berlaku pada 10 September 2026.

4. Bagaimana cara menggunakan DeepSeek V4.1 / DeepSeek V4.1 Flash?

Gunakan API yang kompatibel dengan OpenAI dengan model="deepseek-flash" dan base_url="https://api.deepseek.com", atau unduh bobot MIT untuk penghosting sendiri. Mitra seperti CodeBuddy dan OpenCode sudah mendukungnya; DeepSeek Harness menyediakan scaffolding agen tambahan.

5. Kapan V4 Pro berhenti berfungsi dan apa yang terjadi selanjutnya?

Mulai pukul 04:00 UTC pada 14 September 2026, semua permintaan deepseek-v4-pro akan dialihkan ke DeepSeek V4.1 Flash dengan harga Flash hingga V4.1 Pro dirilis. Pengguna harus segera melakukan migrasi dan memvalidasi kembali saluran mereka.

 

Penafian: Pandangan yang diungkapkan hanya milik penulis dan tidak mencerminkan pandangan platform ini. Platform ini dan afiliasinya menyatakan tidak bertanggung jawab atas akurasi atau kesesuaian informasi yang diberikan. Ini hanya untuk tujuan informasi dan tidak dimaksudkan sebagai nasihat keuangan atau investasi.

Penafian: Konten artikel ini tidak memberikan nasihat keuangan atau investasi.

Daftar sekarang untuk mengklaim paket hadiah pendatang baru 6752 USDT

Bergabunglah dengan Bitrue untuk mendapatkan hadiah eksklusif

Daftar Sekarang
register

Disarankan

Bagaimana Cara Kerja Blockchain Arc? Memulai dengan Arc
Bagaimana Cara Kerja Blockchain Arc? Memulai dengan Arc

Temukan bagaimana blockchain Arc bekerja: L1 yang berbasis stablecoin Circle dengan gas USDC, finalitas sub-detik, dan mesin FX bawaan untuk keuangan dunia nyata.

2026-09-11Baca