Versão curta: o aplicativo de chat DeepSeek não custa nada, a API é paga mas barata, e os pesos do modelo são abertos, então você pode executá-los por conta própria sem pagar um centavo à DeepSeek. A resposta mais longa depende de qual superfície você quer dizer, e é isso que este guia detalha. Se você quer um guia completo de cada caminho de acesso, nosso guia sobre como usar DeepSeek V4 abrange chat web, API e auto-hospedagem em profundidade.
Aqui, vamos nos ater à questão do dinheiro: o que é gratuito, o que não é, e quanto cada opção custa em agosto de 2026, com números reais da página de preços da DeepSeek. E se você acabar usando a API, uma ferramenta como o Apidog ajuda a testar e simular os endpoints da DeepSeek para que você pague apenas pelas chamadas que importam.
O DeepSeek é gratuito? A resposta curta
Sim e não, dependendo da superfície:
- Chat (aplicativo web e móvel): gratuito. Sem assinatura, sem plano Plus, sem paywall. Você se cadastra e conversa.
- API: paga, mas entre as APIs de ponta mais baratas. Os tokens de saída no modelo econômico custam US$ 0,66 por milhão fora do horário de pico. Não há crédito gratuito para novas contas, então você precisa recarregar antes da sua primeira chamada.
- Pesos do modelo: gratuitos para baixar e executar. A família V4 é distribuída sob licença MIT no Hugging Face. Seu único custo é hardware e eletricidade.
Então, "o DeepSeek é gratuito" tem três respostas honestas: gratuito para conversar, barato para construir e gratuito no sentido de código aberto para auto-hospedagem. O restante deste artigo apresenta números e limites para cada opção.
O aplicativo de chat gratuito e seus limites
O assistente DeepSeek em chat.deepseek.com e os aplicativos iOS/Android não custam nada. Isso inclui o modo de raciocínio, upload de arquivos e pesquisa na web. Ao contrário do ChatGPT ou Claude, não há um plano de consumo pago para te convencer a comprar; gratuito é o único plano.
Os limites são operacionais, não comerciais. A DeepSeek não publica uma cota de mensagens por dia, mas durante picos de tráfego, você pode receber respostas de "Servidor ocupado" e gerações mais lentas. Também não há acesso à API, espaço de trabalho em equipe ou garantia de tempo de atividade. No entanto, para pesquisa pessoal, rascunhos e questões de codificação, o aplicativo gratuito abrange muito.
Mais uma ressalva: o aplicativo de consumo é um serviço hospedado na China, e seus prompts são processados nos servidores da DeepSeek sob a política de privacidade da DeepSeek. Se isso for um problema para o seu trabalho, pule para a opção local.
Preços da API DeepSeek em números claros
A API não é gratuita e, a partir de 16 de agosto de 2026, a DeepSeek cobra com uma divisão entre horário de pico e fora de pico. Os horários de pico são das 01:00-04:00 e 06:00-10:00 UTC nos dias de semana; todas as outras horas são fora de pico com metade da taxa de pico. Aqui está a tabela atual, por 1M de tokens:
| Modelo | Entrada com cache (cache hit input) | Entrada sem cache (cache miss input) | Saída |
|---|---|---|---|
| deepseek-v4-flash | $0.007 (fora de pico) / $0.014 (pico) | $0.22 / $0.44 | $0.66 / $1.32 |
| deepseek-v4-pro | $0.022 / $0.044 | $0.66 / $1.32 | $1.98 / $3.96 |
| deepseek-v4-flash-vision-exp | $0.007 / $0.014 | $0.22 / $0.44 | $0.66 / $1.32 |
Três detalhes importam mais do que as taxas principais. Primeiro, o cache de contexto é automático: prefixos de prompt repetidos (um prompt de sistema fixo, exemplos few-shot) são cobrados na taxa de cache-hit, que é aproximadamente 31 vezes mais barata do que um cache-miss no Flash. Segundo, programar seus trabalhos em lote para horários fora de pico reduz a conta pela metade com zero mudanças de código. Terceiro, mesmo no pico, a saída do V4 Flash custa US$ 1,32 por milhão de tokens; chamadas comparáveis a modelos carro-chefe da classe GPT custam várias vezes mais.
Para ter uma ideia concreta de escala: um chatbot que processa 10M de tokens de entrada (principalmente em cache) e 2M de tokens de saída por mês no Flash, rodando fora de pico, custa cerca de US$ 1,50. Não é gratuito, mas é próximo o suficiente para que projetos de hobby raramente sintam. Se você está decidindo entre os dois modelos, nosso guia da API V4 Pro-0813 aborda quando o carro-chefe compensa seu prêmio de 3x.
Rotas de API gratuitas e quase gratuitas
A própria plataforma da DeepSeek não oferece crédito de teste para novas contas, então uma chave de API verdadeiramente gratuita precisa vir de outro lugar. Suas opções realistas:
- Pool de modelos gratuitos do OpenRouter. O OpenRouter oferece mais de 20 modelos a US$ 0 sem cartão de crédito. O problema: as variantes gratuitas da DeepSeek foram retiradas do pool em meados de 2026, então hoje as listagens DeepSeek do OpenRouter são pagas, começando em torno de US$ 0,035 por milhão de tokens de entrada para o V4 Flash. Isso ainda é mais barato do que muitas taxas de primeira parte, e as 50 solicitações gratuitas por dia em outros modelos permitem prototipar a infraestrutura antes de gastar qualquer coisa.
- Créditos de plataforma em nuvem. Créditos de inscrição de propósito geral de provedores de nuvem e hosts de inferência (o tipo que você obtém ao criar uma conta) podem ser gastos em modelos DeepSeek hospedados. Os modelos não são gratuitos; seus créditos os tornam gratuitos para você por um tempo.
- Uma recarga mínima na plataforma da DeepSeek. Como as taxas são tão baixas, um saldo de US$ 2 já dura muito. É quase gratuito, não gratuito, mas é a rota mais simples para a API real de primeira parte.
Mantemos um resumo atualizado regularmente dessas rotas em como obter uma chave de API DeepSeek gratuita, incluindo quais agregadores atualmente listam variantes sem custo.
Executando DeepSeek localmente de graça
Este é o caminho onde "gratuito" é literal. A DeepSeek publica seus pesos de modelo no Hugging Face sob uma licença MIT, que permite uso comercial, ajuste fino e redistribuição. A geração V4 é distribuída em dois tamanhos: V4 Flash (284B parâmetros totais, 13B ativos) e V4 Pro, cujos pesos completos saíram da pré-visualização em agosto de 2026 com cerca de 1.7T parâmetros.
A contrapartida é o hardware. O V4 Flash precisa de aproximadamente 33 GB de VRAM fortemente quantizada, ou uma única H100 de 80 GB em FP8; os pesos completos do V4 Pro chegam a 900 GB e são uma proposta para data center. Em um desktop regular, a rota prática é um modelo destilado menor ou de geração anterior. Nosso guia sobre como executar DeepSeek R1 localmente com Ollama faz um modelo de raciocínio responder em hardware de consumo em cerca de dez minutos, sem necessidade de chave API.
Local significa sem cobranças por token, sem limites de taxa e sem dados saindo da sua máquina. Também significa que você é o responsável pela operação: escolhas de quantização, stack de serviço (vLLM ou SGLang para algo sério) e custos de GPU que podem exceder os gastos com API, a menos que seu volume seja alto.
Chat vs API vs local: a decisão em uma única passagem
- Escolha o aplicativo de chat se você estiver fazendo perguntas, elaborando rascunhos ou avaliando a qualidade do modelo. Custo: R$ 0. Esforço: nenhum.
- Escolha a API se você estiver construindo um produto ou automação. Custo: centavos a alguns dólares por mês em escala de hobby. Esforço: baixo; a API é compatível com OpenAI, então a maioria dos SDKs funciona alterando a URL base.
- Escolha pesos locais se você precisar de privacidade de dados, uso offline ou se já possui GPUs. Custo: R$ 0 em taxas, dinheiro real em hardware. Esforço: mais alto.
A maioria dos desenvolvedores acaba na API, o que levanta uma questão prática: como construir algo usando-a sem queimar tokens em cada execução de teste?
Teste uma chamada, simule o resto com Apidog
A API da DeepSeek segue o formato OpenAI, então o Apidog a importa em segundos: adicione a especificação compatível com OpenAI, aponte a URL base para `https://api.deepseek.com`, coloque sua chave em uma variável de ambiente e envie uma solicitação. Você obtém a resposta analisada, tempo e tokens transmitidos em uma única visualização, o que é melhor do que analisar a saída do curl.
O economizador de custos é a simulação (mocking) do Apidog. Depois de capturar uma resposta real da DeepSeek, inicie um servidor de simulação que reproduz completações realistas para cada teste de frontend e integração depois disso. Sua CI, seus estados de UI, seu tratamento de erros: tudo exercitado contra a simulação a R$ 0, enquanto a API real vê apenas o punhado de chamadas que validam o comportamento real do modelo. Durante sessões de desenvolvimento em horário de pico, quando as taxas da DeepSeek dobram, essa disciplina é a diferença entre uma conta que você percebe e uma que você não percebe.
FAQ
O chat DeepSeek é ilimitado? O DeepSeek não publica um limite de mensagens para o aplicativo de chat, então na prática você é limitado pela capacidade do servidor, não por uma cota. Espere respostas ocasionais de "Servidor ocupado" em horários de alto tráfego. Se você continuar recebendo essas respostas, várias soluções alternativas são abordadas em como usar DeepSeek V4 gratuitamente.
A API DeepSeek tem um teste gratuito? Não. Novas contas na plataforma começam com saldo zero e sem crédito promocional, então você precisa recarregar antes de sua primeira solicitação. As alternativas quase gratuitas são plataformas agregadoras e créditos de inscrição em nuvem.
O DeepSeek é de código aberto? Os pesos são abertos sob uma licença MIT, que é o que a maioria das pessoas quer dizer. Dados de treinamento e o pipeline completo não são publicados, então os puristas chamam de "peso aberto" em vez de código aberto. De qualquer forma, a auto-hospedagem é gratuita e comercialmente permitida.
Posso usar DeepSeek para codificação sem pagar? Sim, de duas maneiras: o aplicativo de chat gratuito lida com perguntas de codificação ad hoc, e o DeepSeek Harness, o CLI agente da empresa, pode ser executado contra um modelo local sem custo de API. Veja o que é DeepSeek Harness para configuração.
A linha final
DeepSeek é gratuito onde importa para avaliação (chat), quase gratuito onde importa para construção (a API, por frações de centavo por solicitação fora do pico), e genuinamente gratuito para auto-hospedagem se você tiver o hardware. Comece com o aplicativo de chat para julgar a qualidade, passe para a API quando for construir e mantenha sua conta de tokens controlada simulando tudo o que puder. Baixe Apidog para importar a API DeepSeek, verificar uma chamada real e simular o resto gratuitamente.
