TSMlBUA7TprpTUG5BSGlTfA7GA==

DeepSeek V4.1-Flash Resmi Dirilis, Bawa Teknologi Hemat Memori untuk Agen AI

DeepSeek V4.1-Flash Resmi Dirilis, Bawa Teknologi Hemat Memori untuk Agen AI


Jogjaterkini.id - Perusahaan kecerdasan buatan (AI) asal China, DeepSeek, resmi meluncurkan model AI terbarunya, DeepSeek V4.1-Flash.

Model ini menjadi penerus DeepSeek V4-Flash yang sebelumnya diperbarui melalui pembaruan 0731 pada akhir Juli 2026. DeepSeek V4.1-Flash membawa sejumlah peningkatan, terutama dalam mengurangi kebutuhan memori saat memproses konteks panjang, khususnya ketika digunakan untuk menjalankan agen AI.

Penghematan memori tersebut dilakukan dengan memangkas ukuran KV cache, yakni buffer yang menyimpan informasi dari konteks yang telah diproses model.

DeepSeek V4.1-Flash memiliki 552 miliar parameter dan mampu menangani konteks hingga 1 juta token. Menurut laporan internal DeepSeek, bagian KV cache yang disimpan di memori GPU kini hanya membutuhkan sekitar seperempat kapasitas yang digunakan DeepSeek V4-Flash.

Sementara itu, cache yang dipindahkan ke SSD atau memori host menyusut menjadi sekitar seperdelapan dari pendahulunya. Jika dibandingkan dengan DeepSeek V1, ukuran global KV cache per token disebut berkurang hingga 437 kali lipat.

Cara DeepSeek V4.1-Flash Menghemat Memori

DeepSeek menggunakan dua pendekatan untuk menghemat memori dan komputasi.

Pertama, proses model dibagi menjadi dua bagian. Bagian pertama memproses data yang masuk, sedangkan bagian kedua menggunakan hasil tersebut untuk menghasilkan teks tanpa menghitung ulang seluruh informasi.

Saat membaca input, V4.1-Flash hanya mengaktifkan sekitar 8 miliar parameter per token. Ketika menghasilkan teks, jumlah parameter yang diaktifkan meningkat menjadi 16 miliar per token.

DeepSeek mengeklaim pendekatan tersebut dapat memangkas hampir separuh kebutuhan komputasi ketika memproses input. Teknik ini terutama ditujukan untuk agen AI yang terus menerima input baru.

Cara kedua dilakukan dengan menyimpan KV cache dalam format FP4, bukan FP8. Menurut DeepSeek, perubahan tersebut dapat mengurangi hampir setengah penggunaan memori pada cache.

Sejak awal, DeepSeek V4.1-Flash dilatih menggunakan dataset yang terdiri dari 45 triliun token, mencakup data teks dan gambar.

Pada tahap pascapelatihan, DeepSeek menyebut tidak mengandalkan metode baru. Peningkatan performa lebih banyak diperoleh melalui penggunaan data, tugas, serta lingkungan pelatihan yang lebih besar dan dikontrol dengan lebih baik.

Performa DeepSeek V4.1-Flash

DeepSeek menyebut V4.1-Flash mampu menghasilkan performa yang mendekati sejumlah model AI terkemuka.

Dalam beberapa benchmark agen AI, model tersebut bahkan diklaim mampu menyamai model AI tertutup kelas atas. Pada pengujian DeepSWE v1.1, DeepSeek V4.1-Flash mencatat skor 74,2 persen.

Skor tersebut sedikit lebih tinggi dibandingkan model Anthropic Opus 5 dan OpenAI GPT-5.6 Sol.

Namun, performa DeepSeek V4.1-Flash belum merata pada semua jenis tugas. Dalam pengujian ProgramBench, model tersebut disebut masih tertinggal jauh.

Kesenjangan juga terlihat pada tugas agen AI yang membutuhkan pengetahuan ilmiah tingkat ahli. DeepSeek turut mengakui bahwa V4.1-Flash masih tertinggal dalam memahami gambar yang kompleks.

Harga dan Ketersediaan DeepSeek V4.1-Flash

DeepSeek menyediakan V4.1-Flash melalui API dengan tarif yang berbeda berdasarkan waktu penggunaan, yakni peak-hours dan off-peak.

Pada periode off-peak, biaya input dengan cache hit dipatok 0,003 dollar AS atau sekitar Rp528. Input dengan cache miss dikenakan biaya 0,15 dollar AS atau sekitar Rp2.642.

Sementara itu, biaya output pada periode off-peak ditetapkan sebesar 0,6 dollar AS atau sekitar Rp10.569.

Pada periode peak-hours, tarif tersebut menjadi dua kali lipat. Input dengan cache hit dikenakan 0,006 dollar AS, cache miss 0,3 dollar AS, sedangkan output sebesar 1,2 dollar AS.

DeepSeek menetapkan peak-hours pada pukul 08.00-11.00 WIB dan 13.00-17.00 WIB setiap hari kerja. Di luar waktu tersebut, termasuk akhir pekan dan hari libur, tarif yang berlaku adalah off-peak.

Tarif tersebut mulai berlaku pada 10 September 2026 pukul 11.00 WIB.

DeepSeek V4.1-Flash tersedia melalui API dan Hugging Face dengan lisensi MI.

Sumber : Kompas

Ketik kata kunci lalu Enter

close