Versión corta: la aplicación de chat de DeepSeek no cuesta nada, la API es de pago pero barata, y los pesos del modelo son abiertos, por lo que puedes ejecutarlos tú mismo sin pagar un céntimo a DeepSeek. La respuesta más larga depende de a qué superficie te refieras, y eso es lo que desglosa esta guía. Si deseas un recorrido completo por cada ruta de acceso, nuestra guía sobre cómo usar DeepSeek V4 cubre el chat web, la API y el autoalojamiento en profundidad.
Aquí nos centraremos en la cuestión del dinero: qué es gratis, qué no lo es y cuánto cuesta cada opción en agosto de 2026, con cifras reales de la página de precios de DeepSeek. Y si terminas usando la ruta de la API, una herramienta como Apidog te ayuda a probar y simular los endpoints de DeepSeek para que solo pagues por las llamadas que importan.
¿Es DeepSeek gratis? La respuesta corta
Sí y no, dependiendo de la superficie:
- Chat (aplicación web y móvil): gratis. Sin suscripción, sin plan Plus, sin muro de pago. Te registras y chateas.
- API: de pago, pero entre las API de clase frontera más baratas. Los tokens de salida en el modelo económico cuestan $0.66 por millón fuera de horas pico. No hay crédito gratuito para cuentas nuevas, por lo que debes recargar antes de tu primera llamada.
- Pesos del modelo: gratis para descargar y ejecutar. La familia V4 se distribuye bajo una licencia MIT en Hugging Face. Tu único costo es el hardware y la electricidad.
Así que “¿es DeepSeek gratis?” tiene tres respuestas honestas: gratis para chatear, barato para construir y gratis en el sentido de código abierto para autoalojarse. El resto de este artículo pone números y límites a cada una.
La aplicación de chat gratuita y sus límites
El asistente de DeepSeek en chat.deepseek.com y las aplicaciones para iOS/Android no cuestan nada. Esto incluye el modo de razonamiento, la carga de archivos y la búsqueda web. A diferencia de ChatGPT o Claude, no hay un plan de consumo de pago para ofrecerte; gratuito es el único plan.
Los límites son operativos, no comerciales. DeepSeek no publica una cuota de mensajes por día, pero durante los picos de tráfico puedes encontrar respuestas de “Servidor ocupado” y generaciones más lentas. Tampoco hay acceso a la API, ni espacio de trabajo en equipo, ni garantía de tiempo de actividad. Sin embargo, para investigación personal, redacción y preguntas de codificación, la aplicación gratuita cubre mucho.
Una advertencia más: la aplicación para el consumidor es un servicio alojado en China, y tus prompts se procesan en los servidores de DeepSeek bajo la política de privacidad de DeepSeek. Si eso es un impedimento para tu trabajo, pasa a la opción local.
Precios de la API de DeepSeek en números claros
La API no es gratuita, y a partir del 16 de agosto de 2026, DeepSeek factura con una división entre horas pico y horas no pico. Las horas pico son de 01:00-04:00 y de 06:00-10:00 UTC los días de semana; cada otra hora es fuera de horas pico a la mitad de la tarifa pico. Aquí está la tabla actual, por cada 1M de tokens:
| Modelo | Entrada con acierto de caché | Entrada con fallo de caché | Salida |
|---|---|---|---|
| deepseek-v4-flash | $0.007 (fuera de pico) / $0.014 (pico) | $0.22 / $0.44 | $0.66 / $1.32 |
| deepseek-v4-pro | $0.022 / $0.044 | $0.66 / $1.32 | $1.98 / $3.96 |
| deepseek-v4-flash-vision-exp | $0.007 / $0.014 | $0.22 / $0.44 | $0.66 / $1.32 |
Tres detalles importan más que las tarifas principales. Primero, el almacenamiento en caché de contexto es automático: los prefijos de prompt repetidos (un prompt de sistema fijo, ejemplos few-shot) se facturan a la tarifa de acierto de caché, que es aproximadamente 31 veces más barata que un fallo de caché en Flash. Segundo, programar tus trabajos por lotes para las horas no pico reduce la factura a la mitad sin cambios en el código. Tercero, incluso en horas pico, la salida de V4 Flash cuesta $1.32 por millón de tokens; llamadas comparables a modelos insignia de clase GPT cuestan varias veces eso.
Para una idea concreta de la escala: un chatbot que procesa 10 millones de tokens de entrada (en su mayoría en caché) y 2 millones de tokens de salida al mes en Flash, funcionando fuera de horas pico, cuesta alrededor de $1.50. Eso no es gratis, pero está lo suficientemente cerca como para que los proyectos de hobby rara vez lo noten. Si estás decidiendo entre los dos modelos, nuestra guía de la API V4 Pro-0813 cubre cuándo el modelo insignia justifica su prima de 3x.
Rutas de API gratuitas y casi gratuitas
La propia plataforma de DeepSeek no otorga crédito de prueba a las cuentas nuevas, por lo que una clave de API verdaderamente gratuita debe provenir de otro lugar. Tus opciones realistas son:
- Pool de modelos gratuitos de OpenRouter. OpenRouter ofrece más de 20 modelos a $0 sin tarjeta de crédito. El inconveniente: las variantes gratuitas de DeepSeek fueron retiradas del pool a mediados de 2026, por lo que hoy las listas de DeepSeek de OpenRouter son de pago, comenzando alrededor de $0.035 por millón de tokens de entrada para V4 Flash. Eso sigue siendo más barato que muchas tarifas de primera parte, y las 50 solicitudes gratuitas por día en otros modelos te permiten prototipar la configuración antes de gastar nada.
- Créditos de plataformas en la nube. Los créditos de registro de uso general de proveedores de la nube y hosts de inferencia (los que obtienes al crear una cuenta) se pueden usar en modelos DeepSeek alojados. Los modelos no son gratuitos; tus créditos los hacen gratuitos para ti por un tiempo.
- Una recarga mínima en la plataforma de DeepSeek. Debido a que las tarifas son tan bajas, un saldo de $2 rinde mucho. Es casi gratis, no gratis, pero es la ruta más simple a la API real de primera parte.
Mantenemos un resumen actualizado regularmente de estas rutas en cómo obtener una clave de API gratuita de DeepSeek, incluyendo qué agregadores listan actualmente variantes sin costo.
Ejecutar DeepSeek localmente sin costo
Este es el camino donde “gratis” es literal. DeepSeek publica los pesos de sus modelos en Hugging Face bajo una licencia MIT, que permite el uso comercial, el ajuste fino y la redistribución. La generación V4 se distribuye en dos tamaños: V4 Flash (284B parámetros totales, 13B activos) y V4 Pro, cuyos pesos completos salieron de la vista previa en agosto de 2026 con alrededor de 1.7T parámetros.
La compensación es el hardware. V4 Flash necesita aproximadamente 33 GB de VRAM fuertemente cuantificada, o una sola H100 de 80 GB en FP8; los pesos completos de V4 Pro se acercan a los 900 GB y son una propuesta para centros de datos. En un escritorio regular, la ruta práctica es un modelo destilado más pequeño o de generación anterior. Nuestro tutorial sobre ejecutar DeepSeek R1 localmente con Ollama consigue que un modelo de razonamiento responda en hardware de consumo en unos diez minutos, sin necesidad de clave API.
Local significa sin cargos por token, sin límites de tasa y sin que los datos salgan de tu máquina. También significa que tú gestionas las operaciones: opciones de cuantificación, pila de servicio (vLLM o SGLang para algo serio) y costos de GPU que pueden superar el gasto de la API a menos que tu volumen sea alto.
Chat vs API vs local: la decisión en un solo paso
- Elige la aplicación de chat si estás haciendo preguntas, redactando o evaluando la calidad del modelo. Costo: $0. Esfuerzo: ninguno.
- Elige la API si estás construyendo un producto o automatización. Costo: centavos a unos pocos dólares por mes a escala de hobby. Esfuerzo: bajo; la API es compatible con OpenAI, por lo que la mayoría de los SDKs funcionan cambiando la URL base.
- Elige los pesos locales si necesitas privacidad de datos, uso sin conexión o si ya posees GPUs. Costo: $0 en tarifas, dinero real en hardware. Esfuerzo: el más alto.
La mayoría de los desarrolladores terminan usando la API, lo que plantea una pregunta práctica: ¿cómo construir sobre ella sin gastar tokens en cada ejecución de prueba?
Prueba una llamada, simula el resto con Apidog
La API de DeepSeek sigue el formato de OpenAI, por lo que Apidog la importa en segundos: añade la especificación compatible con OpenAI, apunta la URL base a https://api.deepseek.com, introduce tu clave en una variable de entorno y envía una solicitud. Obtendrás la respuesta parseada, el tiempo y los tokens transmitidos en una sola vista, lo que es mejor que entrecerrar los ojos ante la salida de curl.
El ahorro de costos reside en la simulación de Apidog. Una vez que hayas capturado una respuesta real de DeepSeek, inicia un servidor de simulación que reproduzca respuestas realistas para cada prueba de frontend e integración posterior. Tu CI, tus estados de UI, tu manejo de errores: todo se ejercita contra la simulación a $0, mientras que la API real solo ve el puñado de llamadas que validan el comportamiento real del modelo. Durante las sesiones de desarrollo en horas pico, cuando las tarifas de DeepSeek se duplican, esa disciplina es la diferencia entre una factura que notas y una que no.
Preguntas Frecuentes
¿El chat de DeepSeek es ilimitado? DeepSeek no publica un límite de mensajes para la aplicación de chat, por lo que en la práctica estás limitado por la capacidad del servidor, no por una cuota. Espera respuestas ocasionales de “Servidor ocupado” en momentos de alto tráfico. Si sigues encontrándolas, varias soluciones alternativas se cubren en cómo usar DeepSeek V4 gratis.
¿La API de DeepSeek tiene una prueba gratuita? No. Las cuentas nuevas de la plataforma comienzan con un saldo cero y sin crédito promocional, por lo que debes recargar antes de tu primera solicitud. Las alternativas casi gratuitas son las plataformas agregadoras y los créditos de registro en la nube.
¿DeepSeek es de código abierto? Los pesos son abiertos bajo una licencia MIT, que es lo que la mayoría de la gente entiende. Los datos de entrenamiento y el pipeline completo no se publican, por lo que los puristas lo llaman “peso abierto” en lugar de código abierto. De cualquier manera, el autoalojamiento es gratuito y comercialmente permitido.
¿Puedo usar DeepSeek para programar sin pagar? Sí, de dos maneras: la aplicación de chat gratuita maneja preguntas de codificación ad-hoc, y DeepSeek Harness, la CLI agencial de la compañía, puede ejecutarse contra un modelo local sin costo de API. Consulta qué es DeepSeek Harness para la configuración.
En resumen
DeepSeek es gratuito donde importa para la evaluación (chat), casi gratuito donde importa para la construcción (la API, a fracciones de céntimo por solicitud fuera de horas pico), y verdaderamente gratuito para el autoalojamiento si aportas el hardware. Comienza con la aplicación de chat para juzgar la calidad, pasa a la API cuando construyas y mantén tu factura de tokens insignificante simulando todo lo que puedas. Descarga Apidog para importar la API de DeepSeek, verificar una llamada real y simular el resto de forma gratuita.
