Nilai Sebenarnya DeepSeek V4 Tidak Terletak pada Parameternya

marsbitDipublikasikan tanggal 2026-04-25Terakhir diperbarui pada 2026-04-25

Abstrak

DeepSeek V4 telah melampaui sekadar perdebatan parameter teknis, dan menunjukkan nilai strategisnya dalam adaptasi komputasi lokal Tiongkok. Model ini berhasil dijalankan secara efisien pada chip domestik seperti Huawei Ascend 910B dan Cambricon, mengatasi tantangan ekosistem perangkat lunak yang masih berkembang. Dengan arsitektur MoE dan mekanisme perhatian hybrid CSA+HCA, V4 mengoptimalkan penggunaan memori dan komputasi, mengurangi beban inferensi pada hardware lokal. Hal ini memungkinkan konteks panjang 1M token diproses dengan biaya lebih rendah, bahkan menawarkan harga yang kompetitif dibandingkan model sejenis. Keberhasilan adaptasi ini membuka jalan bagi perusahaan Tiongkok untuk mengurangi ketergantungan pada NVIDIA, terutama dalam inferensi skala besar—langkah kritis menuju otonomi AI yang berkelanjutan di tengah ketidakpastian pasokan global.

Oleh | Pabrik Model Dunia

DeepSeek V4 sekali lagi mengguncang seluruh China.

Skala parameter, panjang konteks, skor benchmark... indikator teknis ini telah dibandingkan berulang kali dalam berbagai laporan.

Tetapi jika hanya berhenti pada data permukaan, kita melewatkan inti strategis terpenting dari peluncuran ini.

Tiga tahun terakhir, model besar China selalu terperangkap dalam realitas yang canggung: pelatihan bergantung pada Nvidia, inferensi juga bergantung pada Nvidia, chip domestik hanya menjadi opsi cadangan.

Begitu Nvidia menghentikan pasokan, seluruh lingkaran model China akan cemas.

Tetapi hari ini, DeepSeek V4 membuktikan dengan kemampuan:

Sebuah model besar tingkat parameter triliunan yang mutakhir, juga dapat berjalan dengan stabil dan efisien pada komputasi domestik.

Makna hal ini telah melampaui indikator teknis model itu sendiri.

Terobosan Lokalisasi

Untuk benar-benar memahami kesulitan adaptasi lokalisasi ini, pertama-tama harus memahami kerajaan chip Nvidia.

Nvidia tidak hanya memiliki chip, tetapi juga ekosistem lengkap yang sangat tertutup:

Di sisi perangkat keras, ada keluarga chip GPU, ditambah NVLink, NVSwitch yang mewujudkan jaringan kecepatan tinggi interkoneksi antar chip;

Di sisi perangkat lunak, CUDA adalah sistem operasi AI yang dibangun dengan hati-hati oleh Nvidia selama belasan tahun.

Ini seperti pabrik yang sangat dioptimalkan, dari operator paling dasar (unit dasar perhitungan model), hingga komputasi paralel, manajemen memori, komunikasi terdistribusi, seluruh rantai disesuaikan khusus untuk GPU Nvidia.

Dengan kata lain, Nvidia tidak hanya menjual mesin, tetapi juga membangun jalan, pompa bensin, bengkel, sistem navigasi.

Hampir semua model besar global tumbuh di ekosistem ini.

Beralih ke komputasi domestik, yang dihadapi adalah situasi yang sama sekali berbeda.

Arsitektur perangkat keras berbeda, cara interkoneksi berbeda, kematangan tumpukan perangkat lunak berbeda, ekosistem alat masih terus mengejar.

DeepSeek ingin beradaptasi dengan chip domestik, sama sekali bukan sekadar mengganti mesin, tetapi seperti mengalihkan mobil balap yang sudah melaju kencang di jalan tol, ke jalan pegunungan yang masih dalam pengerasan.

Sedikit saja ceroboh, akan terjadi guncangan, kehilangan kecepatan, bahkan kendaraan tidak dapat melanjutkan.

Kali ini, DeepSeek V4 tidak memilih untuk hanya mengoptimalkan sepanjang jalur CUDA, tetapi mulai masuk bersamaan ke dalam rantai adaptasi tumpukan perangkat lunak komputasi domestik.

Dari informasi yang terbuka, V4 telah mencapai terobosan berdasarkan chip inferensi domestik, beradaptasi mendalam dengan chip Huawei Ascend 950, Cambricon juga dapat berjalan stabil pada hari peluncuran model, benar-benar mencapai adaptasi Day 0.

Ini berarti, model mutakhir mulai memiliki kemungkinan untuk diimplementasikan dalam sistem chip domestik.

Bagaimana DeepSeek V4 melakukannya?

Langkah pertama, terjadi di lapisan arsitektur model.

V4 tidak memilih untuk memaksakan chip domestik menanggung konteks 1M, tetapi pertama-tama membuat model itu sendiri lebih hemat.

Desain paling kunci dalam laporan teknis resmi, adalah mekanisme perhatian campuran CSA + HCA, serta optimasi konteks panjang seperti kompresi KV Cache.

Sederhananya, inferensi konteks panjang tradisional, adalah membiarkan model setiap kali menjawab pertanyaan, membuka seluruh perpustakaan untuk dibolak-balik, memori, bandwidth dan komputasi akan cepat penuh.

Cara V4, adalah pertama-tama mengindeks ulang, mengompres dan menyaring materi di perpustakaan, hanya memasukkan informasi paling kunci ke dalam rantai komputasi.

Dengan demikian, konteks 1M tidak lagi sepenuhnya bergantung pada kekerasan perangkat keras, tetapi pertama-tama melalui algoritma mengurangi beban komputasi dan memori.

Ini sangat kunci untuk chip domestik.

Jika model sangat bergantung pada bandwidth memori dan pustaka CUDA matang, chip domestik bahkan jika bisa berjalan, sulit untuk berjalan murah, berjalan stabil.

V4 pertama-tama mengurangi beban inferensi, pada dasarnya adalah meringankan tekanan pada komputasi domestik.

Langkah kedua, terjadi di lapisan arsitektur MoE dan parameter aktivasi.

V4-Pro meskipun total parameter mencapai 1,6 triliun, tetapi setiap inferensi hanya mengaktifkan sekitar 49 miliar parameter; V4-Flash total parameter 284 miliar, setiap aktivasi sekitar 13 miliar parameter.

Ini berarti tidak setiap panggilan menarik semua parameter untuk dihitung, tetapi seperti tim ahli besar, tugas datang hanya memanggil ahli terkait yang turun.

Untuk chip domestik, ini juga penting.

Ini mengurangi tekanan komputasi yang harus ditanggung setiap inferensi, juga membuat konteks panjang dan skenario Agent lebih mudah diterima oleh kartu inferensi.

Langkah ketiga, adalah adaptasi di lapisan operator dan Kernel.

Tempat terkuat ekosistem CUDA, adalah banyak komputasi dasar telah dipoles matang oleh Nvidia, banyak komputasi kinerja tinggi dapat langsung dipanggil.

Makna V4 terletak pada, sebagian komputasi kunci ditarik keluar dari kotak hitam Nvidia, menjadi jalur komputasi khusus yang lebih dapat bermigrasi, dapat diadaptasi.

Sedikit lebih通俗, V4 seperti membongkar part paling kunci dalam mesin, memungkinkan Huawei Ascend, Cambricon dan produsen lain menyesuaikan ulang sesuai struktur chip mereka sendiri.

Langkah keempat, adalah kerangka inferensi dan lapisan layanan.

Adaptasi chip domestik jika hanya berhenti pada "menjalankan Demo", tidak banyak makna industri. Yang benar-benar layak diperhatikan, adalah apakah dapat masuk ke sistem layanan yang dapat dipanggil, dapat ditagih.

Menurut pengujian internal, pada Ascend 950PR, kecepatan inferensi V4 meningkat signifikan dibandingkan versi awal, konsumsi energi juga turun jelas, kinerja single-chip dalam skenario presisi rendah tertentu mencapai lebih dari 2 kali lipat khusus H20 Nvidia.

DeepSeek resmi menyebutkan, saat ini V4-Pro terbatas pada komputasi high-end, throughput layanan terbatas, diperkirakan setelah super node Ascend 950 diluncurkan massal paruh kedua tahun ini, harga akan turun besar.

Ini menunjukkan, seiring dengan produksi massal perangkat keras domestik seperti Ascend, throughput dan rasio kinerja-harga V4 di masa depan akan lebih dioptimalkan.

Tetapi perlu dicatat, V4 tidak sepenuhnya menggantikan GPU dan CUDA Nvidia. Pelatihan model mungkin masih tidak dapat lepas dari Nvidia, tetapi inferensi sudah dapat dilokalkan secara bertahap.

Ini sebenarnya adalah jalur komersial yang sangat realistis.

Pelatihan adalah investasi bertahap, latih sekali, sesuaikan sekali, iterasi sekali. Inferensi adalah biaya berkelanjutan, setiap hari jutaan, miliaran panggilan pengguna, setiap kali harus menghabiskan komputasi.

Kepala pembakaran uang sesungguhnya perusahaan model, dalam jangka panjang akan semakin condong ke inferensi. Siapa yang dapat menanggung kebutuhan inferensi lebih murah, lebih stabil, akan mendapatkan keunggulan nyata dalam aplikasi industri.

DeepSeek V4 pertama kali membuat deployment inferensi model mutakhir China, muncul sebuah rute yang tidak mengambil CUDA Nvidia sebagai prasyarat default.

Langkah ini sudah cukup berbobot.

Dampak V4 pada Aplikasi Industri

Jika adaptasi chip domestik menjawab apakah bisa berjalan, maka harga menjawab pertanyaan lebih realistis lain:

Apakah perusahaan mampu menggunakannya?

Kehebatan DeepSeek sebelumnya, justru kemampuannya menekan kemampuan mendekati model mutakhir, ke harga sangat rendah.

Era V3, R1 begitu, V4 tetap begitu.

Perbedaannya, kali ini bukan perang harga dalam jendela konteks biasa, tetapi terus menekan harga dengan prasyarat konteks 1M + kemampuan Agent.

Menurut harga resmi DeepSeek:

Input V4-Flash cache hit 0,2 yuan / juta tokens, input cache miss 1 yuan / juta tokens, output 2 yuan / juta tokens;

Input V4-Pro cache hit 1 yuan / juta tokens, input cache miss 12 yuan / juta tokens, output 24 yuan / juta tokens.

Memasukkannya ke dalam model domestik sejenis:

Dibandingkan dengan Ali Qwen3.6-Plus di tingkat 256K-1M, harga output V4-Pro sekitar setengahnya, V4-Flash lebih rendah.

Dibandingkan dengan Xiaomi MiMo Pro Series di tingkat 256K-1M, V4-Flash dan V4-Pro jelas lebih murah.

Konteks Kimi K2.6 adalah 256K, dibandingkan, konteks V4-Pro lebih panjang, harga lebih rendah; V4-Flash langsung menekan biaya panggilan frekuensi tinggi ke tingkat lain.

Ini sangat berarti untuk aplikasi perusahaan.

Karena konteks 1M, berarti model dapat sekaligus membaca seluruh gudang kode, paket kontrak tebal, prospektus ratusan halaman, notulen rapat jangka panjang, atau status historis yang terakumulasi saat Agent menjalankan tugas terus menerus.

Banyak aplikasi perusahaan sebelumnya mentok di sini, kemampuan model cukup, tetapi konteks tidak cukup; konteks cukup, harga terlalu mahal; harga dapat diterima, kemampuan model tidak cukup stabil.

Misalnya, sebuah perusahaan membuat Agent penelitian investasi, ingin model membaca sekaligus laporan tahunan perusahaan, konferensi telepon laporan keuangan, laporan industri, berita pesaing dan notulen internal.

Ketika konteks hanya 128K atau 256K, sistem sering harus terus mengiris, mengambil, meringkas, informasi hilang dalam kompresi berulang.

Konteks 1M memungkinkan model mempertahankan lebih banyak bahan mentah, mengurangi kelalaian dan putus.

Misalnya lagi Agent kode.

Ini bukan menulis beberapa baris kode sekaligus, tetapi membaca gudang, memahami ketergantungan, memodifikasi file, menjalankan tes, memperbaiki berdasarkan error. Proses ini akan反复 menghabiskan tokens.

Jika setiap langkah sangat mahal, Agent hanya dapat menjadi demo, tetapi jika tokens cukup murah, baru mungkin masuk proses pengembangan nyata.

Ini juga nilai industri V4.

Ini belum tentu model terkuat, tetapi mungkin menjadi model frekuensi tertinggi perusahaan.

DeepSeek sekali lagi membuat AI dari mainan eksklusif pabrik besar少数, menjadi alat produktivitas yang dapat disebarkan secara skala besar oleh ribuan industri.

Nilai Sebenarnya V4

Ketika konteks 1M dengan harga sangat rendah menuju lini depan industri, nilai sebenarnya DeepSeek V4 baru terungkap.

Semua ini, dibangun di atas dasar komputasi domestik yang belum matang.

Menghadapi kesenjangan sistemik ekosistem chip domestik, tim DeepSeek tidak memilih menunggu ekosistem matang baru上线.

Mereka berulang kali menunda jendela peluncuran, menginvestasikan waktu berbulan-bulan, melakukan调试 bersama mendalam dengan mitra seperti Huawei, kesulitan rekayasa seperti ini, jauh melampaui bayangan luar.

Karena itu, V4 mencapai kemampuan inferensi dan Agent mendekati model tertutip顶级 pada komputasi domestik,显得格外不易.

V4 membuktikan dengan自身, bahkan menghadapi kesenjangan bertahap ekosistem perangkat keras, tim China masih dapat melalui investasi rekayasa极致 dan inovasi kolaboratif perangkat lunak-keras, menghasilkan kinerja kompetitif.

Tentu, jarak menuju kematangan penuh masih ada.

Kelengkapan toolchain platform Ascend, stabilitas cluster skala sangat besar, serta optimasi mendalam lebih banyak skenario vertikal, memerlukan usaha bersama各方 industri.

Tetapi kesuksesan V4, telah membentangkan jalur yang dapat ditiru untuk model后续.

Ini menyuntikkan penenang hati untuk otonomi dan kendali seluruh rantai pasokan AI.

Dalam lingkungan eksternal penuh ketidakpastian saat ini, ketahanan yang masih dapat突破 dalam batasan ini, lebih layak dihormati daripada indikator parameter belaka.

"Tidak tergoda oleh pujian, tidak takut pada fitnah, bertindak sesuai jalan, teguh meluruskan diri".

Tulisan dari resmi DeepSeek ini,正是 catatan terbaiknya.

Pertanyaan Terkait

QApa nilai strategis utama dari DeepSeek V4 menurut artikel ini?

ANilai strategis utamanya adalah kemampuan DeepSeek V4 untuk berjalan secara stabil dan efisien pada komputasi buatan dalam negeri, membuktikan bahwa model AI canggih skala triliun parameter tidak harus bergantung pada chip dan ekosistem Nvidia.

QApa saja tantangan teknis utama dalam mengadaptasi model besar ke chip buatan dalam negeri?

ATantangannya meliputi perbedaan arsitektur hardware, metode interkoneksi, kematangan software stack, dan alat-alat ekosistem yang masih dalam tahap pengembangan, mengharuskan adaptasi mendalam di tingkat arsitektur model, operator, kernel, dan framework.

QBagaimana desain arsitektur DeepSeek V4 membantu mengurangi beban komputasi pada chip domestik?

AV4 menggunakan mekanisme perhatian hybrid CSA + HCA dan kompresi KV Cache untuk mengoptimalkan konteks panjang, serta arsitektur MoE yang hanya mengaktifkan sebagian parameter selama inferensi, sehingga mengurangi tekanan pada memori dan bandwidth chip domestik.

QApa implikasi harga rendah DeepSeek V4 untuk aplikasi perusahaan?

AHarga yang rendah untuk konteks 1M token memungkinkan perusahaan menggunakan kemampuan Agent dan pemrosesan dokumen panjang secara terjangkau, membuka pintu untuk penerapan skala besar di berbagai industri seperti penelitian investasi dan pengembangan kode.

QApa arti kesuksesan adaptasi DeepSeek V4 pada komputasi domestik bagi industri AI China?

AKesuksesan ini memberikan keyakinan bagi industri bahwa melalui rekayasa intensif dan inovasi kolaboratif perangkat lunak dan keras, China dapat mencapai kinerja kompetitif bahkan dengan keterbatasan ekosistem hardware, mendorong kemandirian dan ketahanan rantai pasokan AI.

Bacaan Terkait

Fujian Jinjiang, Sebuah Unicorn Super Penyimpanan yang Tumbuh dalam Diam

Perusahaan memori super unicorn Fujian Jinhua secara diam-diam bersembunyi di Jinjiang, Fujian, yang terkenal dengan sepatu olahraganya. Dulu, Jinhua adalah salah satu dari tiga basis chip memori domestik bersama Yangtze Memory dan ChangXin Memory Technologies (CXMT), bahkan pernah menjadi yang paling menjanjikan. Namun, Jinhua menghadapi rintangan besar. Pada 2018, ia dimasukkan dalam daftar entitas oleh Departemen Perdagangan AS dan menghadapi tuduhan pidana, yang menghentikan produksinya selama hampir lima tahun. Baru pada Februari 2024, pengadilan federal AS membebaskannya dari semua tuduhan. Jinhua didirikan pada 2016 dengan misi nasional untuk mematahkan monopoli Samsung, SK Hynix, dan Micron di pasar DRAM. Perusahaan ini bekerja sama dengan United Microelectronics Corporation (UMC) dari Taiwan. Chen Zhengkun, mantan eksekutif Micron, memimpin proyek ini sebagai CEO, didorong oleh mimpi mengembangkan teknologi DRAM secara mandiri. Meskipun pembangunan pabrik berjalan cepat, Micron menuduh UMC dan Jinhua mencuri rahasia dagangnya, memicu sengketa hukum panjang. Setelah dimasukkan dalam daftar entitas, Jinhua harus membangun kembali lini produksinya hampir dari nol dengan mengurangi ketergantungan pada teknologi AS, dipimpin oleh Chen yang dijuluki "penyihir hasil". Saat ini, Jinhua fokus pada pasar DRAM ceruk (niche) untuk perangkat seperti TV pintar dan router. Kapasitas produksinya mencapai sekitar 40.000 wafer 12 inci per bulan, dengan target 60.000 wafer pada 2026. Perusahaan memiliki lebih dari 1.000 paten. Meski bebas secara hukum, Jinhua masih berada dalam daftar entitas AS. Dukungan kuat dari pemerintah kota Jinjiang dan provinsi Fujian sangat penting bagi kelangsungan hidup Jinhua selama masa sulit. Kota yang secara tradisional mengandalkan tekstil dan makanan ini sekarang berinvestasi besar dalam industri sirkuit terpadu, dengan Jinhua sebagai pionir. Industri IC Jinjiang diperkirakan akan mencapai nilai output lebih dari 14 miliar yuan pada 2025. Dalam siklus super memori yang didorong oleh AI, meskipun skala Jinhua masih kecil dibandingkan raksasa global, kebangkitannya dari keterpurukan melambangkan ketahanan dan tekad dalam mengembangkan industri memori China.

marsbit11m yang lalu

Fujian Jinjiang, Sebuah Unicorn Super Penyimpanan yang Tumbuh dalam Diam

marsbit11m yang lalu

"Gergaji Musim Panas" Berlanjut: Breakout $67.000 Akan Menjadi Awal Kenaikan Bitcoin

Harga Bitcoin terus terkonsolidasi dalam kisaran $58.000–$67.000 sejak awal Juni, dengan harga terkini di sekitar $62.217 pada 1 Agustus. Para analis pasar mempertimbangkan beberapa skenario kunci. Secara teknis, pergerakan di atas $66.000 dianggap penting untuk mengubah momentum. Beberapa trader seperti Crypto Candy memprediksi kemungkinan penurunan menuju $60.000 jika level $66.000 tidak tertembus. Trader lain, Jelle, menggambarkan situasi ini sebagai "gergaji musim panas" yang berkepanjangan dan mempertahankan strategi rata-rata biaya dengan pembelian berkala. Di sisi lain, skenario breakout ke atas tetap ada. Daan Crypto Trades menekankan bahwa keberhasilan menembus $67.000 sangat penting untuk menghindari fase konsolidasi yang berlarut-larut. Roman bahkan memperkirakan bahwa breakout dengan volume yang kuat dapat mendorong harga dengan cepat ke zona $70.000–$80.000. Dari perspektif jangka panjang, analis Gert van Lagen melihat fase ini sebagai periode akumulasi, dengan Bitcoin menguji pola grafik besar "cangkir dengan pegangan". Dia mencatat bahwa pemegang jangka panjang masih enggan menjual, yang ditunjukkan oleh metrik NUPL mereka yang masih jauh dari zona kapitulasi. Kesimpulannya, pasar Bitcoin saat ini berada dalam fase akumulasi yang menentukan. Level $60.000 dan $67.000 menjadi kunci, dan breakout dari level mana pun kemungkinan akan menentukan arah tren berikutnya. Skenario AI dalam artikel juga mempertanyakan apakah konsolidasi saat ini dapat membentuk fondasi yang lebih kuat, atau apakah setiap ujian di level $67.000 akan terus menghadapi hambatan psikologis yang sama dari pemegang aset jangka pendek.

cryptonews.ru1j yang lalu

"Gergaji Musim Panas" Berlanjut: Breakout $67.000 Akan Menjadi Awal Kenaikan Bitcoin

cryptonews.ru1j yang lalu

Perhatian Wajib Pekan Depan|Undang-Undang CLARITY Diperkirakan Akan Masuk ke Pemungutan Suara Senat; SpaceX dan Circle Umumkan Laporan Keuangan (3-9 Agustus)

**Ringkasan Acara Penting Pekan Depan (3-9 Agustus)** Pekan depan diwarnai sejumlah pengumuman keuangan penting dan perkembangan regulasi kripto di AS. **Laporan Keuangan & Acara Perusahaan:** * **SpaceX** akan merilis laporan keuangan Q2 2026 pada 4 Agustus, diikuti gelombang pencairan saham internal pertama (hingga 12%) pada 6 Agustus. * **Circle** (penerbit USDC) dan **Hut 8** (penambang Bitcoin) masing-masing akan mengumumkan laporan kuartalan pada 5 Agustus dan 4 Agustus. * **American Bitcoin (ABTC)**, perusahaan tambang kripto yang dikaitkan dengan keluarga Trump, merilis laporan Q2 pada 3 Agustus. * Perusahaan robotika **宇树科技 (Unitree Robotics)** akan melakukan penawaran saham perdana (IPO) di pasar STAR China, dengan hari penentuan harga awal pada 5 Agustus. **Regulasi Kripto AS:** * **CLARITY Act**, undang-undang kerangka kerja federal untuk aset kripto, berpeluang dilakukan pemungutan suara penuh di Senat AS minggu ini. Para negosiator harus merampungkan aturan tentang konflik kepentingan sebelum masa reses 7 Agustus. RUU ini memerlukan 60 suara untuk disetujui. **Pengumuman Data & Teknologi:** * **Laporan Non-Farm AS** untuk Juli akan dirilis pada 7 Agustus, menjadi fokus pasar. * **Grok AI** versi 4.6 (dengan 1,5 triliun parameter) diperkirakan diluncurkan sekitar 7 Agustus, diikuti versi 4.7 yang lebih kuat beberapa minggu setelahnya. * **XRP Ledger** versi 3.3.0 dengan lima fitur baru, termasuk transaksi batch, dijadwalkan rilis minggu depan. **Penutupan & Perubahan Layanan:** * Beberapa layanan kripto akan berhenti beroperasi: **Zapper** (pelacak portofolio DeFi) dan **Ctrl Wallet** pada 3 Agustus, serta **LayerZero** akan menghentikan relayernya untuk v1 pada tanggal yang sama. Bursa Korea **Upbit** akan menghapus perdagangan pasangan **AQT** dan **AERGO** pada 3 Agustus. **Acara Lainnya:** * **BIP-110**, sebuah proposal peningkatan jaringan Bitcoin, akan memulai fase pengiriman sinyal wajib sekitar 8 Agustus.

marsbit2j yang lalu

Perhatian Wajib Pekan Depan|Undang-Undang CLARITY Diperkirakan Akan Masuk ke Pemungutan Suara Senat; SpaceX dan Circle Umumkan Laporan Keuangan (3-9 Agustus)

marsbit2j yang lalu

Trading

Spot
活动图片