More in
Notícias de AI no Trabalho
A OpenAI Abriu a Publicidade no ChatGPT para Pequenas Empresas com Qualquer Orçamento
jun 6, 2026
AI Está em Todo Lugar no Trabalho. Apenas 1 em 10 Diz que Transformou o Emprego
jun 6, 2026
O Momento de US$ 10,5B do Vibe Coding: AI Agora Inicia a Maioria dos Novos Projetos de Software
jun 6, 2026
Agentes de AI Agora Têm Mais Acesso ao Sistema do que Seus Funcionários. Poucos Estão Protegidos
jun 5, 2026
Você Deve Construir Sua AI ou Comprá-la? Observe o que os Gigantes Compraram.
jun 5, 2026
A Uber Limitou os Gastos de AI por Funcionário a US$ 1.500 por Assento Após um Estouro de Orçamento
jun 5, 2026
O Decreto Executivo de AI de Trump é Desregulamentador. Seu Risco de Conformidade Não Mudou
jun 4, 2026
A AI Empurrou 220 Unicórnios Abaixo de US$ 1B. Empresas Pré-ChatGPT Enfrentam um Acerto de Contas
jun 4, 2026
Os Preços de Token Caíram 67% Este Ano. Sua Conta de AI Está Aumentando de Qualquer Forma
jun 3, 2026
Pequenas Empresas que Usam AI Relatam Maior Receita e Jornadas de Trabalho Mais Curtas
jun 3, 2026
A DeepSeek Tornou Definitivo o Corte de 75% no Preço de AI. O Piso Acabou de Cair

Turn this article into takeaways for your work.
Each assistant summarizes the article only for you and suggests best practices for your work.
Isso não é uma promoção. É um novo padrão.
Por volta de 23 de maio de 2026, a empresa chinesa DeepSeek transformou um corte promocional de preços em precificação permanente para seu modelo principal. A redução de 75% deveria expirar. Não expirou. E isso importa para você como CEO, mesmo que você nunca execute uma única carga de trabalho na DeepSeek.
De acordo com a InfoWorld, o corte permanente no modelo V4-Pro da DeepSeek reduz o custo de tokens de saída para cerca de US$ 0,87 por milhão de tokens, caindo de US$ 3,48. Não é um erro de arredondamento. É uma redefinição do que o mercado aceita como valor razoável em uma fatura de fornecedor de inteligência artificial (AI).
O Que Mudou de Fato
O corte se tornou permanente em toda a interface de programação de aplicativos (API) do V4-Pro. Tokens de saída: US$ 3,48 caíram para US$ 0,87 por milhão. Entrada sem cache: US$ 1,74 caiu para US$ 0,435. Entrada com cache passou de aproximadamente US$ 0,0145 para US$ 0,0036. Todos os cortes se mantiveram em torno de 75%.
O que torna isso um evento estratégico, e não apenas uma atualização de produto, é o momento e o sinal. A DeepSeek definiu uma data de validade para a taxa promocional e depois a removeu. Trata-se de um ato deliberado de ancoragem de mercado. Eles estão dizendo a todo comprador de AI empresarial o que uma camada de commodity deve custar em escala.
E está funcionando. Segundo a InfoWorld, analistas esperam que os principais fornecedores ocidentais, incluindo OpenAI, Anthropic e Google, respondam não com cortes equivalentes, mas com descontos ampliados de cache, precificação por API em lote e concessões para clientes enterprise. Esse padrão de resposta é exatamente o que você quer ao entrar em negociações de renovação.
Fatos-chave
- Em uma comparação citada pela InfoWorld, para aproximadamente 100 milhões de tokens de saída por mês, o DeepSeek V4-Pro fica em torno de US$ 348 contra cerca de US$ 2.500 da Anthropic e US$ 3.000 da camada comparável da OpenAI.
- A DeepSeek conta com um grande aporte financiado pelo estado por meio do "Big Fund" chinês, com uma valuation-alvo reportada entre US$ 10 bilhões e US$ 45 bilhões.
- Os fornecedores ocidentais não devem igualar as tarifas da DeepSeek diretamente. Analistas esperam que a resposta venha por meio de descontos de cache, precificação em lote e reduções de tarifa por uso comprometido.
Por Que um Preço Que Você Não Vai Pagar Ainda Reprecia Seus Contratos

Você não precisa usar a DeepSeek para que o corte permanente afete seus custos. Pisos de preço deslocam o poder de negociação em todo o mercado.
Pense no que acontece quando você entra em uma renovação de SaaS sabendo que existe uma alternativa comparável com preço 7 vezes menor. Você não precisa migrar. Você precisa citá-la. Seu fornecedor atual sabe qual é o piso. Ele vai ceder em descontos de cache ou tarifas em lote antes de perder um contrato plurianual.
Esse é o impacto real. O novo piso dá a todo comprador de AI empresarial uma âncora confiável na renovação. Antes desse corte, "a tarifa de mercado" significava o que o GPT-4o ou o Claude Opus cobrava. Agora a tarifa de mercado tem um limite inferior público, permanente e documentado. Use-o.
A complicação é que nem todo gasto com AI é intercambiável. Seu framework de avaliação de fornecedores de AI já deve considerar essa distinção, mas a situação da DeepSeek torna isso urgente. Leia o artigo sobre custos de tokens: as faturas de AI empresarial continuam subindo mesmo com a queda dos preços por token. Preços unitários em queda não significam automaticamente faturas menores se suas cargas de trabalho estão escalando.
A Ressalva: Soberania e Integração
Aqui está a parte que se perde no número da manchete.
A DeepSeek é uma empresa chinesa operando sob jurisdição chinesa. Quando seus sistemas enviam prompts, documentos, embeddings e logs para uma API hospedada na China, você está cruzando regimes jurídicos com regras muito diferentes sobre tratamento de dados, acesso governamental e propriedade intelectual. Para a maioria dos setores regulados, incluindo finanças, saúde e serviços jurídicos, isso não é uma decisão de fornecedor. É uma decisão de conformidade, e a resposta costuma ser não.
Há um caminho alternativo. O modelo subjacente do V4-Pro da DeepSeek é de pesos abertos (open-weight), o que significa que um diretor de TI (CIO) com a infraestrutura adequada pode hospedá-lo internamente, dentro do próprio perímetro, e realizar plenamente a vantagem de custo sem que os dados cruzem qualquer fronteira. Mas hospedar modelos de fronteira capazes internamente exige investimento significativo em infraestrutura e trabalho de engenharia contínuo. Não é uma opção de custo zero.
O cenário prático para a maioria das empresas hoje é este: você provavelmente não vai rodar a DeepSeek em cargas de trabalho sensíveis. Mas pode absolutamente usar sua precificação como alavanca. E para cargas de trabalho genuinamente de baixa sensibilidade, modelos de pesos abertos rodando localmente são cada vez mais viáveis. Leia sobre por que os modelos open-weight estão ficando mais baratos e como isso altera o cálculo de build versus compra.
O Teste de Alavancagem pelo Piso de Preço
Este é um framework de três perguntas para transformar o novo piso em ação antes da sua próxima renovação.
Pergunta 1: Qual é o seu custo combinado atual por milhão de tokens, e quão acima do piso ele está?
Puxe as faturas de AI dos últimos 90 dias. Calcule uma tarifa combinada entre todos os fornecedores e modelos. Compare com o novo piso da DeepSeek. Se você está pagando de US$ 3 a US$ 5 por milhão de tokens em tarefas de commodity, a diferença é substancial e negociável. Se está em US$ 15 a US$ 20 por conta de modelos de raciocínio pesado em tarefas complexas, o piso importa menos para essas cargas de trabalho.
Pergunta 2: Quais cargas de trabalho são genuinamente sensíveis versus commodity?
Nem tudo precisa do Claude Opus ou do GPT-5.5. Sumarização interna, extração de dados de documentos estruturados, geração de rascunhos para comunicações internas e busca com aumento sobre bases de conhecimento internas podem ser candidatas à inferência com preço de commodity. As cargas de trabalho que exigem modelos premium são geralmente as que lidam com dados de clientes, saídas reguladas ou decisões de alto risco. Trace essa linha explicitamente antes da próxima renovação.
Pergunta 3: Qual concessão específica você vai pedir, e quando?
Não entre em uma renovação sem uma meta definida. Percentuais de desconto de cache, precificação por API em lote para cargas de trabalho em segundo plano e tarifas de uso comprometido em troca de contratos mais longos estão todos na mesa agora. Os fornecedores sabem que o piso existe. Estão preparados para oferecer concessões para não perder contas. Mas vão esperar você pedir.
O corte da DeepSeek acelera uma guerra de preços que já estava em andamento. O padrão de procurement do Big Four AI Stack de maio de 2026 mostra como as empresas líderes estão começando a separar deliberadamente as camadas premium e commodity. O padrão está se espalhando.
O Que Fazer Antes da Próxima Renovação
Comece com uma auditoria de cargas de trabalho. Obtenha uma lista clara de cada processo com AI na sua organização, quem é o responsável, qual modelo ele usa e aproximadamente quanto custa por mês. A maioria dos CEOs não tem essa lista. Essa é a primeira lacuna a preencher.
Depois, identifique quais itens dessa lista exigem garantias de fornecedor premium e quais são elegíveis para commodity. Para as cargas de trabalho elegíveis para commodity, calcule quanto a migração ou a renegociação economizaria anualmente. Esse número se torna sua alavancagem.
Leve-o para a renovação. Use o piso como âncora. Cite a diferença entre sua tarifa atual e o que o mercado agora aceita como referência de commodity. Peça descontos de cache, precificação em lote, ou ambos. Consiga algo por escrito antes de o próximo prazo de 12 meses ser fechado.
Por fim, fique de olho no que OpenAI e Anthropic anunciam no terceiro trimestre. Com base no relatório da InfoWorld, novas camadas de precificação em lote e cache estão a caminho. Se sua renovação está nos próximos 90 dias, pode valer solicitar uma extensão de curto prazo para ver como essas camadas ficam. O cálculo de fornecedor em torno do posicionamento da Anthropic está mudando em tempo real.
A questão do modelo premium também merece uma leitura separada: o framework de decisão do modelo Anthropic Opus 4 explica quando um modelo de US$ 15 por milhão de tokens é genuinamente justificado versus quando é apenas um hábito padrão.
O piso caiu. Essa é a sua abertura. Use-a.
Perguntas Frequentes
O corte de preço da DeepSeek significa que devo migrar todo o meu stack de AI empresarial para ela?
Provavelmente não inteiramente, e talvez nem em parte. A decisão de procurement depende dos requisitos de soberania de dados, das obrigações de conformidade, da profundidade de integração com seu stack atual e da sensibilidade das cargas de trabalho. Para a maioria das empresas em setores regulados, o risco de dados ao usar uma API hospedada na China é inviabilizador para cargas de trabalho sensíveis. O valor mais imediato está em usar o piso como alavancagem de negociação com seus fornecedores atuais.
Minha empresa pode hospedar a DeepSeek internamente para obter a vantagem de custo sem o risco de dados?
Sim, em princípio. O DeepSeek V4-Pro roda em pesos abertos, o que significa que uma equipe técnica pode implantá-lo dentro da própria infraestrutura. Os requisitos práticos incluem recursos computacionais significativos (GPUs classe A100 ou H100 em escala), capacidade de engenharia para manter a implantação e trabalho de integração com os sistemas existentes. Para grandes empresas com infraestrutura de AI madura, isso é viável. Para a maioria das organizações de médio porte, requer um projeto dedicado e alocação de orçamento antes que as economias se materializem.
Se não estou usando a DeepSeek, como uso esse corte de preço em uma negociação com fornecedores?
Referencie o piso diretamente. Na conversa de renovação, mencione que a inferência de AI em nível commodity está agora disponível publicamente a cerca de US$ 0,87 por milhão de tokens de saída, em caráter permanente. Pergunte ao seu fornecedor o que ele está disposto a oferecer em descontos de cache, precificação em lote ou tarifas de uso comprometido para fechar a diferença nas cargas de trabalho que não exigem suas capacidades premium. A maioria dos fornecedores tem camadas de desconto não publicadas que apresenta quando solicitada.
