DeepSeek Kekalkan Potongan Harga AI 75% Secara Kekal. Paras Terendah Kini Ditetapkan

Garisan harga AI yang menurun ke paras baru terendah menggambarkan kejatuhan kos AI perusahaan

Turn this article into takeaways for your work.

Each assistant summarizes the article only for you and suggests best practices for your work.

Ini bukan jualan promosi. Ini adalah standard baharu.

Sekitar 23 Mei 2026, DeepSeek dari China mengubah potongan harga promosi menjadi penetapan harga tetap bagi model tercanggihnya. Pengurangan 75% itu sepatutnya tamat tempoh. Namun ia tidak tamat. Dan perkara itu penting bagi anda sebagai CEO, walaupun anda tidak akan menjalankan sebarang beban kerja pada DeepSeek.

Menurut InfoWorld, potongan kekal pada model V4-Pro DeepSeek menurunkan kos token output kepada kira-kira $0.87 bagi setiap juta token, turun daripada $3.48. Ini bukan kesilapan pembundaran. Ini adalah penetapan semula terhadap apa yang pasaran akan terima sebagai angka yang munasabah dalam invois vendor kecerdasan buatan (AI).

Apa yang Sebenarnya Berubah

Potongan tersebut dikekalkan secara kekal merentas API V4-Pro. Token output: $3.48 turun kepada $0.87 bagi setiap juta. Input cache-miss: $1.74 turun kepada $0.435. Input yang dicache bergerak daripada kira-kira $0.0145 kepada $0.0036. Semua potongan dikekalkan pada kira-kira 75%.

Yang menjadikan ini satu peristiwa strategik dan bukan sekadar kemaskini produk ialah masa dan isyaratnya. DeepSeek telah menetapkan tarikh tamat tempoh pada kadar promosi, kemudian membuangnya. Itu adalah tindakan penjangkaran pasaran yang disengajakan. Mereka menyampaikan kepada setiap pembeli AI perusahaan apakah yang patut dikenakan bagi tahap komersial pada skala besar.

Dan ia berkesan. Menurut InfoWorld, penganalisis menjangka pembekal Barat terkemuka, termasuk OpenAI, Anthropic, dan Google, akan bertindak balas bukan dengan potongan yang setanding, sebaliknya melalui diskaun cache yang diperluaskan, penetapan harga API batch, dan konsesi untuk tahap perusahaan. Corak tindak balas itulah yang anda mahukan semasa memasuki rundingan pembaharuan kontrak.

Fakta Utama

  • Menurut satu perbandingan yang dipetik oleh InfoWorld, bagi kira-kira 100 juta token output sebulan, DeepSeek V4-Pro berada berhampiran $348 berbanding kira-kira $2,500 untuk Anthropic dan kira-kira $3,000 untuk tahap yang setanding daripada OpenAI.
  • DeepSeek disokong oleh pusingan pembiayaan besar yang disokong kerajaan China melalui "Big Fund" China, dengan penilaian sasaran yang dilaporkan antara $10 bilion dan $45 bilion.
  • Pembekal Barat tidak dijangka memadankan kadar DeepSeek secara langsung. Penganalisis menjangka tindak balas akan datang melalui diskaun cache, penetapan harga batch, dan pengurangan kadar bagi penggunaan yang dikomitkan.

Mengapa Harga yang Tidak Anda Bayar Tetap Menetapkan Semula Kontrak Anda

Bar perbandingan kos AI bulanan menunjukkan $3,000 GPT-5.5, $2,500 Claude, $348 DeepSeek

Anda tidak perlu menggunakan DeepSeek agar potongan kekal itu mempengaruhi kos anda. Paras harga terendah mengalihkan kuasa rundingan merentasi seluruh pasaran.

Bayangkan apa yang berlaku apabila anda memasuki pembaharuan SaaS sambil mengetahui terdapat alternatif setanding yang berharga 7x lebih rendah. Anda tidak perlu bertukar. Anda hanya perlu merujuknya. Vendor sedia ada anda tahu apakah paras terendah itu. Mereka akan bergerak pada diskaun cache atau kadar batch sebelum kehilangan kontrak berbilang tahun.

Itulah impak sebenar di sini. Paras terendah baharu memberikan setiap pembeli AI perusahaan satu anchor yang boleh dipercayai semasa pembaharuan. Sebelum potongan ini, "kadar pasaran" bermakna apa sahaja yang dikenakan oleh GPT-4o atau Claude Opus. Kini kadar pasaran mempunyai had bawah yang awam, kekal, dan terdokumen. Gunakanlah.

Komplikasinya ialah tidak semua perbelanjaan AI adalah boleh ditukar ganti. Rangka kerja penilaian vendor AI anda seharusnya sudah mengambil kira perbezaan ini, tetapi situasi DeepSeek menjadikannya mendesak. Baca bahagian penggunaan token tentang cara bil AI perusahaan terus meningkat walaupun harga token jatuh: harga unit yang jatuh tidak secara automatik bermakna invois yang lebih rendah jika beban kerja anda semakin meningkat.

Kelemahan: Kedaulatan dan Integrasi

Inilah bahagian yang sering terlepas pandang dalam nombor tajuk berita.

DeepSeek adalah syarikat China yang beroperasi di bawah bidang kuasa China. Apabila sistem anda menghantar prompt, dokumen, embeddings, dan log ke API yang dihoskan di China, anda sedang merentasi rejim undang-undang yang mempunyai peraturan sangat berbeza tentang pengendalian data, akses kerajaan, dan harta intelek. Bagi kebanyakan industri terkawal, termasuk kewangan, penjagaan kesihatan, dan perkhidmatan undang-undang, itu bukan keputusan vendor. Ia adalah keputusan pematuhan, dan jawapannya biasanya tidak.

Terdapat jalan keluarnya. Model asas V4-Pro DeepSeek adalah open-weight, bermakna seorang ketua pegawai maklumat (CIO) dengan infrastruktur yang betul boleh menghoskan sendiri model tersebut dalam perimeter mereka dan merealisasikan sepenuhnya kelebihan kos tanpa data melintasi sebarang sempadan. Namun menghoskan sendiri model peringkat frontier yang berkebolehan memerlukan pelaburan infrastruktur yang besar dan kerja kejuruteraan yang berterusan. Ia bukan pilihan tanpa kos.

Gambaran praktikal bagi kebanyakan perusahaan pada masa ini adalah seperti berikut: anda mungkin tidak akan menjalankan DeepSeek pada beban kerja yang sensitif. Tetapi anda boleh menggunakan penetapan harganya sebagai leverage. Dan bagi beban kerja yang benar-benar tidak sensitif, model open-weight yang dijalankan secara setempat semakin boleh dilaksanakan. Baca tentang sebab open-weights semakin murah dan bagaimana ia mengubah pengiraan beli-atau-bina sendiri.

Ujian Leverage Paras Terendah Harga

Ini adalah rangka kerja tiga soalan untuk menukarkan paras terendah baharu kepada tindakan sebelum pembaharuan seterusnya.

Soalan 1: Apakah kos campuran semasa anda bagi setiap juta token, dan berapa jauhnya di atas paras terendah?

Tarik 90 hari terakhir invois AI anda. Kira kadar campuran merentasi semua vendor dan model. Bandingkan dengan paras terendah DeepSeek yang baharu. Jika anda beroperasi pada $3 hingga $5 bagi setiap juta token untuk tugasan komersial, jurangnya adalah besar dan boleh dirundingkan. Jika anda berada pada $15 hingga $20 kerana anda menjalankan model penaakulan berat pada tugasan kompleks, paras terendah itu kurang relevan bagi beban kerja tersebut.

Soalan 2: Beban kerja mana yang benar-benar sensitif berbanding komersial?

Tidak semua perkara memerlukan Claude Opus atau GPT-5.5. Ringkasan dalaman, pengekstrakan data daripada dokumen berstruktur, penjanaan draf untuk komunikasi dalaman, dan penambahan carian merentasi pangkalan pengetahuan dalaman semuanya mungkin menjadi calon untuk inferens berharga komersial. Beban kerja yang memerlukan model premium biasanya adalah yang menyentuh data pelanggan, output terkawal, atau keputusan berisiko tinggi. Lukiskan garis itu secara eksplisit sebelum pembaharuan seterusnya.

Soalan 3: Konsesi khusus apa yang akan anda minta, dan bilakah masanya?

Jangan masuk ke pembaharuan tanpa sasaran yang dinamakan. Peratusan diskaun cache, penetapan harga API batch untuk beban kerja latar belakang, dan kadar penggunaan yang dikomitkan sebagai pertukaran bagi terma kontrak yang lebih panjang semuanya berada di atas meja pada masa ini. Vendor tahu paras terendah itu wujud. Mereka bersedia untuk menawarkan konsesi bagi mengelak kehilangan akaun. Tetapi mereka akan menunggu anda untuk bertanya.

Potongan DeepSeek mempercepatkan perang harga yang sudah pun sedang berlangsung. Corak perolehan tindanan AI Big Four dari Mei 2026 menunjukkan bagaimana perusahaan terkemuka mula memisahkan tahap premium dan komersial secara sengaja. Corak itu semakin meluas.

Apa yang Perlu Dilakukan Sebelum Pembaharuan Seterusnya

Mulakan dengan audit beban kerja. Dapatkan senarai jelas setiap proses berkuasa AI dalam organisasi anda, siapa yang memilikinya, model apa yang dijalankan, dan anggaran kosnya sebulan. Kebanyakan CEO tidak mempunyai senarai ini. Itulah jurang pertama yang perlu ditutup.

Kemudian kenal pasti item mana dalam senarai itu yang memerlukan jaminan vendor premium dan mana yang layak untuk komersial. Bagi beban kerja yang layak komersial, kira berapa penjimatan tahunan jika bertukar atau merundingkan semula. Nombor itu menjadi angka leverage anda.

Bawa masuk ke pembaharuan. Gunakan paras terendah sebagai anchor. Rujuk jurang antara kadar semasa anda dan apa yang kini diterima pasaran sebagai penanda aras komersial. Minta diskaun cache, penetapan harga batch, atau kedua-duanya. Dapatkan sesuatu secara bertulis sebelum tempoh 12 bulan seterusnya dikunci.

Akhir sekali, perhatikan apa yang diumumkan OpenAI dan Anthropic pada S3. Berdasarkan laporan InfoWorld, tahap penetapan harga batch dan cache yang diperluaskan akan datang. Jika anda menghampiri pembaharuan dalam 90 hari ke hadapan, mungkin berbaloi untuk meminta lanjutan jangka pendek bagi melihat rupa tahap tersebut. Pengiraan vendor berkaitan kedudukan Anthropic sedang berubah dalam masa nyata.

Soalan model premium juga wajar dibaca secara berasingan: rangka kerja keputusan model Anthropic Opus 4 membincangkan bila model berharga $15 bagi setiap juta token benar-benar wajar berbanding bila ia sekadar tabiat lalai.

Paras terendah telah jatuh. Itu adalah peluang anda. Manfaatkanlah.

Soalan Lazim

Adakah potongan harga DeepSeek bermakna saya perlu menukar tindanan AI perusahaan saya kepada DeepSeek?

Mungkin tidak sepenuhnya, dan mungkin tidak sama sekali. Keputusan perolehan bergantung kepada keperluan kedaulatan data, kewajipan pematuhan, kedalaman integrasi dengan tindanan semasa, dan sensitiviti beban kerja. Bagi kebanyakan perusahaan terkawal, risiko data menggunakan API yang dihoskan di China adalah tidak memenuhi syarat bagi beban kerja yang sensitif. Nilai yang lebih segera ialah menggunakan paras terendah sebagai leverage rundingan dengan vendor sedia ada.

Bolehkan syarikat saya menghoskan sendiri DeepSeek untuk mendapat kelebihan kos tanpa risiko data?

Ya, pada dasarnya. DeepSeek V4-Pro berjalan pada open weights, bermakna pasukan teknikal boleh melaksanakannya dalam infrastruktur anda sendiri. Keperluan praktikal termasuk sumber pengiraan yang besar (GPU kelas A100 atau H100 pada skala), kapasiti kejuruteraan untuk menyelenggara pelaksanaan, dan kerja integrasi dengan sistem sedia ada. Bagi perusahaan besar dengan infrastruktur AI yang matang, ini adalah boleh dilaksanakan. Bagi kebanyakan organisasi pasaran menengah, ia memerlukan projek khusus dan peruntukan belanjawan sebelum penjimatan terealisasi.

Jika saya tidak menggunakan DeepSeek, bagaimana saya sebenarnya menggunakan potongan harga ini dalam rundingan vendor?

Rujuk paras terendah secara langsung. Dalam perbualan pembaharuan anda, nyatakan bahawa inferens AI komersial kini tersedia secara awam pada kira-kira $0.87 bagi setiap juta token output secara kekal. Tanya vendor anda apa yang mereka bersedia tawarkan pada diskaun cache, pemprosesan batch, atau penetapan harga penggunaan yang dikomitkan untuk menutup jurang bagi beban kerja yang tidak memerlukan keupayaan premium mereka. Kebanyakan vendor mempunyai tahap diskaun yang tidak diterbitkan yang akan mereka kemukakan apabila diminta.

Ketahui Lebih Lanjut

About the author

Victor Hoang

Victor Hoang

Co-Founder, Rework.com

Victor Hoang is Co-Founder and CMO of Rework. He spent 12+ years scaling B2B SaaS growth, building a lead engine that generated over 1 million leads and $10M+ in annual recurring revenue. Today he builds AI agents and MCP servers into Rework's products to empower customers across growth and operations. He writes about what actually works.