DeepSeek Menjadikan Pemotongan Harga AI 75% sebagai Harga Permanen. Harga Dasar Baru Telah Ditetapkan

Garis harga AI yang terus menurun hingga level dasar baru, mencerminkan penurunan biaya AI enterprise

Turn this article into takeaways for your work.

Each assistant summarizes the article only for you and suggests best practices for your work.

Ini bukan diskon sementara. Ini adalah standar baru.

Sekitar 23 Mei 2026, DeepSeek dari China mengubah pemotongan harga promosi menjadi harga tetap untuk model unggulannya. Pengurangan 75% itu seharusnya berakhir. Ternyata tidak. Hal ini penting bagi Anda sebagai CEO, bahkan jika Anda tidak pernah menjalankan satu pun beban kerja di DeepSeek.

Menurut InfoWorld, pemotongan permanen pada model V4-Pro dari DeepSeek menurunkan biaya output token menjadi sekitar $0,87 per juta token, turun dari $3,48. Ini bukan sekadar selisih kecil. Ini adalah penetapan ulang harga yang diterima pasar sebagai angka wajar pada tagihan vendor kecerdasan buatan (AI).

Apa yang Sebenarnya Berubah

Pemotongan ini diberlakukan secara permanen di seluruh API (antarmuka pemrograman aplikasi) V4-Pro. Token output: dari $3,48 turun menjadi $0,87 per juta. Input tanpa cache: dari $1,74 turun menjadi $0,435. Input dengan cache turun dari sekitar $0,0145 menjadi $0,0036. Semua pemotongan berada pada kisaran 75%.

Yang menjadikan ini peristiwa strategis, bukan sekadar pembaruan produk, adalah waktu dan sinyalnya. DeepSeek menetapkan tanggal berakhir untuk tarif promosi, lalu menghapusnya. Itu adalah tindakan penetapan acuan pasar yang disengaja. Mereka memberi tahu setiap pembeli AI enterprise tentang berapa seharusnya biaya tingkat komoditas pada skala besar.

Dan strateginya berhasil. Menurut InfoWorld, para analis memperkirakan vendor Barat terkemuka, termasuk OpenAI, Anthropic, dan Google, akan merespons bukan dengan menyamakan pemotongan tersebut, melainkan dengan memperluas diskon cache, penetapan harga API (antarmuka pemrograman aplikasi) batch, dan konsesi tingkat enterprise. Pola respons itulah yang Anda inginkan saat memasuki negosiasi perpanjangan kontrak.

Fakta Utama

  • Berdasarkan satu perbandingan yang dikutip InfoWorld, untuk sekitar 100 juta output token per bulan, DeepSeek V4-Pro berada di sekitar $348 dibandingkan sekitar $2.500 untuk Anthropic dan sekitar $3.000 untuk tingkat setara OpenAI.
  • DeepSeek didukung oleh putaran pendanaan besar yang didukung negara melalui "Big Fund" China, dengan valuasi target yang dilaporkan antara $10 miliar hingga $45 miliar.
  • Vendor Barat tidak diperkirakan akan langsung menyamakan tarif DeepSeek. Para analis memperkirakan respons akan datang melalui diskon cache, penetapan harga batch, dan pengurangan tarif berbasis komitmen.

Mengapa Harga yang Tidak Anda Bayar Tetap Mengubah Nilai Kontrak Anda

Perbandingan biaya AI bulanan yang menunjukkan GPT-5.5 $3.000, Claude $2.500, dan DeepSeek $348

Anda tidak perlu menggunakan DeepSeek agar pemotongan permanen ini memengaruhi biaya Anda. Harga dasar yang baru menggeser kekuatan negosiasi di seluruh pasar.

Bayangkan apa yang terjadi ketika Anda memasuki negosiasi perpanjangan kontrak SaaS dengan mengetahui ada alternatif yang setara dengan harga 7 kali lebih rendah. Anda tidak perlu beralih. Anda hanya perlu menyebutnya. Vendor lama Anda tahu berapa harga dasarnya. Mereka akan bergerak pada diskon cache atau tarif batch sebelum kehilangan kontrak multi-tahun.

Itulah dampak nyatanya. Harga dasar baru memberi setiap pembeli AI enterprise acuan yang kredibel saat perpanjangan kontrak. Sebelum pemotongan ini, "tarif pasar" berarti apa pun yang dikenakan GPT-4o atau Claude Opus. Kini tarif pasar memiliki batas bawah yang bersifat publik, permanen, dan terdokumentasi. Manfaatkan itu.

Komplikasinya adalah tidak semua pengeluaran AI dapat dipertukarkan. Kerangka evaluasi vendor AI Anda seharusnya sudah memperhitungkan perbedaan ini, tetapi situasi DeepSeek membuatnya semakin mendesak. Baca artikel tentang biaya token pada bagaimana tagihan AI enterprise terus naik meski harga token turun: penurunan harga per unit tidak otomatis berarti tagihan lebih rendah jika beban kerja Anda terus bertambah.

Kendala: Kedaulatan Data dan Integrasi

Inilah bagian yang sering terlewat dalam angka judul berita.

DeepSeek adalah perusahaan China yang beroperasi di bawah yurisdiksi China. Ketika sistem Anda mengirim prompt, dokumen, embedding, dan log ke API yang di-hosting di China, Anda melewati rezim hukum dengan aturan yang sangat berbeda mengenai penanganan data, akses pemerintah, dan kekayaan intelektual. Untuk sebagian besar industri yang diatur, termasuk keuangan, layanan kesehatan, dan jasa hukum, ini bukan keputusan vendor. Ini adalah keputusan kepatuhan, dan jawabannya biasanya tidak.

Ada jalan keluar dari hal ini. Model dasar V4-Pro dari DeepSeek bersifat open-weight, artinya seorang CIO (kepala informasi) dengan infrastruktur yang tepat dapat meng-hosting-nya sendiri di dalam perimeter perusahaan mereka dan sepenuhnya mewujudkan keunggulan biaya tanpa data melewati batas negara mana pun. Namun, meng-hosting sendiri model kelas frontier yang mumpuni memerlukan investasi infrastruktur yang signifikan dan pekerjaan rekayasa yang berkelanjutan. Ini bukan opsi tanpa biaya.

Gambaran praktis bagi sebagian besar perusahaan saat ini adalah sebagai berikut: kemungkinan besar Anda tidak akan menjalankan DeepSeek pada beban kerja yang sensitif. Tetapi Anda sangat bisa menggunakan harganya sebagai daya tawar. Dan untuk beban kerja yang benar-benar tidak sensitif, model open-weight yang berjalan secara lokal semakin layak dipertimbangkan. Baca tentang mengapa open-weight semakin murah dan bagaimana hal itu mengubah pertimbangan beli-atau-bangun.

Uji Daya Tawar Harga Dasar

Ini adalah kerangka tiga pertanyaan untuk mengubah harga dasar baru menjadi tindakan nyata sebelum perpanjangan kontrak berikutnya.

Pertanyaan 1: Berapa biaya campuran per juta token Anda saat ini, dan seberapa jauh di atas harga dasar?

Tarik tagihan AI Anda selama 90 hari terakhir. Hitung tarif campuran di semua vendor dan model. Bandingkan dengan harga dasar DeepSeek yang baru. Jika Anda berjalan pada $3 hingga $5 per juta token untuk tugas komoditas, selisihnya sangat besar dan dapat dinegosiasikan. Jika Anda berada di $15 hingga $20 karena menjalankan model penalaran berat untuk tugas kompleks, harga dasar ini kurang relevan untuk beban kerja tersebut.

Pertanyaan 2: Beban kerja mana yang benar-benar sensitif versus mana yang komoditas?

Tidak semua hal memerlukan Claude Opus atau GPT-5.5. Peringkasan internal, ekstraksi data dari dokumen terstruktur, pembuatan draf untuk komunikasi internal, dan augmentasi pencarian pada basis pengetahuan internal semuanya bisa menjadi kandidat inferensi berbiaya komoditas. Beban kerja yang memerlukan model premium biasanya adalah yang menyentuh data pelanggan, output yang diatur, atau keputusan berisiko tinggi. Tentukan batas itu secara eksplisit sebelum perpanjangan kontrak berikutnya.

Pertanyaan 3: Konsesi apa yang akan Anda minta, dan kapan?

Jangan masuk ke negosiasi perpanjangan tanpa target yang jelas. Persentase diskon cache, penetapan harga API batch untuk beban kerja latar belakang, dan tarif berbasis komitmen sebagai imbalan jangka kontrak yang lebih panjang semuanya sedang tersedia saat ini. Vendor tahu harga dasarnya ada. Mereka siap menawarkan konsesi untuk menghindari kehilangan akun. Namun mereka akan menunggu Anda memintanya.

Pemotongan DeepSeek mempercepat perang harga yang memang sudah berlangsung. Pola pengadaan AI stack Big Four dari Mei 2026 menunjukkan bagaimana perusahaan terdepan mulai memisahkan tingkat premium dan komoditas secara sengaja. Polanya kini semakin menyebar.

Yang Perlu Dilakukan Sebelum Perpanjangan Kontrak Berikutnya

Mulailah dengan audit beban kerja. Dapatkan daftar lengkap setiap proses bertenaga AI di organisasi Anda, siapa yang memilikinya, model apa yang dijalankan, dan kira-kira berapa biayanya per bulan. Sebagian besar CEO tidak memiliki daftar ini. Itulah celah pertama yang harus ditutup.

Kemudian identifikasi mana yang memerlukan jaminan vendor premium dan mana yang memenuhi syarat komoditas. Untuk beban kerja yang memenuhi syarat komoditas, hitung berapa penghematan tahunan jika beralih atau menegosiasikan ulang. Angka tersebut menjadi daya tawar Anda.

Bawa ke dalam negosiasi perpanjangan. Gunakan harga dasar sebagai acuan. Sebutkan selisih antara tarif Anda saat ini dan apa yang kini diterima pasar sebagai tolok ukur komoditas. Minta diskon cache, penetapan harga batch, atau keduanya. Dapatkan sesuatu secara tertulis sebelum jangka 12 bulan berikutnya terkunci.

Terakhir, pantau pengumuman OpenAI dan Anthropic di Q3. Berdasarkan laporan InfoWorld, tingkat penetapan harga batch dan cache yang diperluas akan segera hadir. Jika Anda mendekati perpanjangan dalam 90 hari ke depan, mungkin ada baiknya meminta perpanjangan jangka pendek untuk melihat seperti apa tingkat tersebut nantinya. Kalkulasi vendor seputar posisi Anthropic sedang berubah secara real time.

Pertanyaan model premium juga layak dibaca tersendiri: kerangka keputusan model Anthropic Opus 4 membahas kapan model seharga $15 per juta token benar-benar dibenarkan versus kapan itu hanya kebiasaan bawaan.

Harga dasar sudah turun. Itulah peluang Anda. Manfaatkan.

Pertanyaan yang Sering Diajukan

Apakah pemotongan harga DeepSeek berarti saya harus beralih seluruh AI stack enterprise ke DeepSeek?

Kemungkinan besar tidak sepenuhnya, dan mungkin tidak sama sekali. Keputusan pengadaan bergantung pada persyaratan kedaulatan data, kewajiban kepatuhan, kedalaman integrasi dengan stack saat ini, dan sensitivitas beban kerja. Bagi sebagian besar perusahaan yang diatur, risiko data dari penggunaan API yang di-hosting di China biasanya mendiskualifikasinya untuk beban kerja sensitif. Nilai yang lebih langsung adalah menggunakan harga dasar sebagai daya tawar negosiasi dengan vendor yang ada.

Bisakah perusahaan saya meng-hosting sendiri DeepSeek untuk mendapatkan keunggulan biaya tanpa risiko data?

Ya, secara prinsip. DeepSeek V4-Pro berjalan pada open-weight, artinya tim teknis dapat men-deploy-nya di dalam infrastruktur Anda sendiri. Persyaratan praktisnya mencakup sumber daya komputasi yang signifikan (GPU kelas A100 atau H100 dalam skala besar), kapasitas rekayasa untuk memelihara penerapan tersebut, dan pekerjaan integrasi dengan sistem yang ada. Bagi perusahaan besar dengan infrastruktur AI yang matang, ini layak dilakukan. Bagi sebagian besar organisasi kelas menengah, ini memerlukan proyek khusus dan alokasi anggaran sebelum penghematan dapat terwujud.

Jika saya tidak menggunakan DeepSeek, bagaimana cara memanfaatkan pemotongan harga ini dalam negosiasi vendor?

Sebutkan harga dasarnya secara langsung. Dalam percakapan perpanjangan Anda, catat bahwa inferensi AI komoditas kini tersedia secara publik pada sekitar $0,87 per juta output token secara permanen. Tanyakan kepada vendor Anda apa yang siap mereka tawarkan pada diskon cache, pemrosesan batch, atau penetapan harga berbasis komitmen untuk menutup selisih pada beban kerja yang tidak memerlukan kemampuan premium mereka. Sebagian besar vendor memiliki tingkat diskon yang belum dipublikasikan yang akan mereka ungkapkan ketika diminta.

Pelajari Lebih Lanjut

About the author

Victor Hoang

Victor Hoang

Co-Founder, Rework.com

Victor Hoang is Co-Founder and CMO of Rework. He spent 12+ years scaling B2B SaaS growth, building a lead engine that generated over 1 million leads and $10M+ in annual recurring revenue. Today he builds AI agents and MCP servers into Rework's products to empower customers across growth and operations. He writes about what actually works.