DeepSeek V4 Flash Vision Exp resmi dirilis pada 21 Agustus sebagai model kecerdasan buatan pertama perusahaan yang mampu memproses input gambar berupa grafik, tangkapan layar, maupun dokumen foto. Model ini hadir di gateway API seperti OpenRouter pada 27 Agustus dengan tarif $0.22 per juta token input dan $0.66 per juta token output, yang mana harganya berlipat ganda pada jam sibuk hari kerja.
Sebagai perbandingan langsung, Google merilis Gemini 3.7 Flash pada 13 Agustus yang dibanderol dengan harga $0.75 untuk input dan $3.75 per juta token output di platform OpenRouter. Kedua model tersebut diuji melalui tiga skenario kerja kantoran yang mencakup analisis grafik keuangan, audit faktur bermasalah, hingga interpretasi log produksi sistem yang mengalami gangguan.
Dalam pengujian pembacaan grafik dengan sumbu ganda, baik DeepSeek V4 Flash Vision Exp maupun Gemini 3.7 Flash sama-sama berhasil mengidentifikasi kuartal di mana biaya operasional melampaui pendapatan serta memperkirakan total pendapatan tahunan sebesar 36,1 juta dolar AS tanpa terjebak jebakan uji.
Related Stories
Suka dengan Artikel Ini?
Dapatkan lebih banyak cerita menarik dengan berlangganan newsletter kami. Gratis!
SubscribeUji coba audit faktur yang berisi sejumlah kesalahan penulisan dan tanggal jatuh tempo fiktif juga berhasil diselesaikan dengan sempurna oleh kedua model AI tersebut. Kendati demikian, pengujian ini mencatat anomali durasi di mana DeepSeek membutuhkan waktu 30,5 detik dengan 3.467 token completion, sementara Gemini menyelesaikannya dalam 7,9 detik dengan 944 token completion.
Pertimbangan Antara Biaya dan Kecepatan
Uji coba ketiga menggunakan log produksi dari sebuah insiden gangguan sistem menunjukkan bahwa kedua model mampu mengidentifikasi akar masalah dengan tepat pada detik 14:05:12. DeepSeek menyelesaikan tugas tersebut dalam waktu 11,9 detik dengan biaya 0,00088 dolar AS, sedangkan Gemini merespons dalam waktu 7,6 detik dengan biaya 0,00351 dolar AS.
Secara keseluruhan, kedua model menunjukkan tingkat akurasi yang setara dalam merespons seluruh pertanyaan pengujian tanpa satupun kesalahan. Perbedaan utama di antara keduanya terletak pada efisiensi biaya dan kecepatan pemrosesan data, di mana Gemini mencatat rata-rata waktu tanggap 7,2 detik atau lebih dua kali lebih cepat dibandingkan rata-rata 16,8 detik milik DeepSeek.
Dari sisi biaya operasional keseluruhan, total tagihan penggunaan DeepSeek tercatat sebesar 0,0039 dolar AS atau sekitar sepertiga dari biaya penggunaan Gemini yang mencapai 0,0122 dolar AS. Perbedaan harga dan kecepatan ini menjadi faktor penentu bagi pengguna dalam memilih model yang sesuai dengan skala kebutuhan operasional harian mereka.
Bagi pengguna skala besar yang menjalankan pemrosesan batch secara masif seperti audit faktur semalam, penggunaan DeepSeek menawarkan keunggulan efisiensi biaya yang signifikan. Sebaliknya, pemrosesan tugas berskala besar yang menuntut respons instan bagi pengguna secara langsung lebih disarankan menggunakan Gemini.