Introducción a DeepSeek
Este curso está dedicado a DeepSeek: una empresa china que en los últimos años se ha convertido en uno de los principales actores en el mercado de los grandes modelos de lenguaje. Después de esta lección, comprenderás en qué se diferencian los modelos de DeepSeek entre sí, cómo puedes trabajar con ellos y por qué son interesantes para un especialista o emprendedor en comparación con los más conocidos ChatGPT, Claude o sus análogos rusos. La lección no requiere preparación técnica: establece el mapa por el que el curso avanzará.
Curso no oficial de AI University. Los textos, ejemplos y tareas fueron escritos por nuestro equipo basándose en la documentación abierta de DeepSeek al 03.10.2026; el curso no está afiliado ni aprobado por DeepSeek. Los modelos y precios cambian, consulta la documentación.
¿Quién es DeepSeek y por qué se habla de ella?
DeepSeek, una empresa de Hangzhou, ha alcanzado la atención mundial gracias a una combinación de tres cosas que rara vez se encuentran juntas. Primero, pesos abiertos: los modelos se pueden descargar de Hugging Face y ejecutarse en tus propios servidores bajo una licencia MIT, que casi no restringe el uso comercial. Segundo, precios bajos para el acceso a través de API: en comparación con modelos de nivel similar de OpenAI o Anthropic, la factura por las mismas tareas resulta ser varias veces menor. Tercero, los modelos mismos, en cuanto a calidad de razonamiento, trabajo con código y contexto largo, se encuentran consistentemente entre las mejores soluciones abiertas del mundo, y a veces se acercan a los líderes de mercado cerrados.
Para los negocios, esto significa que la IA potente deja de ser un privilegio de las empresas con grandes presupuestos para suscripciones. Puedes conectar la API en minutos y pagar por el uso real, o puedes implementar el modelo en tus propias instalaciones si la privacidad total de los datos es importante. Cómo aprovechar este descubrimiento en detalle, el curso lo abordará más adelante, pero por ahora, vale la pena entender qué ofrece DeepSeek al 03.10.2026.
Línea de modelos: V4.1-Flash y V4-Pro
Actualmente, hay dos modelos disponibles en la API: deepseek-flash y deepseek-v4-pro. No es una cuestión de gusto, sino de la tarea, y la diferencia entre ellos es notable tanto en capacidades como en precio.
deepseek-flash (versión DeepSeek-V4.1-Flash, lanzada el 10 de septiembre de 2026) es un modelo con arquitectura de mezcla de expertos (Mixture of Experts, MoE) de 552 mil millones de parámetros. Está estructurado como una enciclopedia dividida en "especializaciones" individuales: al procesar una consulta específica, no se activa toda la enciclopedia, sino solo las secciones necesarias. Por lo tanto, el modelo tiene el concepto de "parámetros activos": son los parámetros que realmente funcionan al procesar un token. Para V4.1-Flash, solo se activan 8 mil millones de parámetros para los datos de entrada y 16 mil millones para la generación de la respuesta. Gracias a esto, el modelo responde rápidamente y a bajo costo, manteniendo una calidad de razonamiento cercana a la del modelo superior. Flash puede trabajar con imágenes: es el único de los dos modelos con soporte de visión.
deepseek-v4-pro (versión DeepSeek-V4-Pro-0813) es un modelo con 1.6 billones de parámetros y 49 mil millones de activos por cada token, sin soporte de imágenes. Históricamente, fue el modelo insignia de la compañía, diseñado para las tareas más complejas: programación de agentes, matemáticas, razonamiento profundo. En pruebas individuales, el más nuevo y compacto Flash no es inferior a Pro, y en velocidad y costo lo supera, por lo que para la mayoría de las tareas prácticas en el curso, deepseek-flash será suficiente, y tiene sentido recurrir a Pro si necesitas comparar el resultado con un modelo más pesado.
Ambos modelos trabajan con un contexto de hasta 1 millón de tokens y pueden generar una respuesta de hasta 384 mil tokens, lo que en la práctica significa: puedes cargar un libro completo o una gran base de código en el diálogo y obtener una respuesta significativa. Ambos admiten el modo de reflexión, donde el modelo primero construye una cadena de razonamiento y luego da la respuesta final. Hablaremos de esto en detalle en la lección 3.
Precios al 03.10.2026 por 1 millón de tokens (en horas pico y fuera de pico, fuera de pico es el doble de barato):
| deepseek-flash | deepseek-v4-pro | |
|---|---|---|
| Entrada, caché | $0.006 / $0.003 | $0.044 / $0.022 |
| Entrada sin caché | $0.3 / $0.15 | $1.32 / $0.66 |
| Salida | $1.2 / $0.6 | $3.96 / $1.98 |
Pro es varias veces más caro que Flash, y la diferencia es más notable en la entrada con caché que en la salida, por lo que la ganancia exacta depende de la naturaleza de la tarea. Siempre debes verificar los precios actuales y las reglas de las horas pico en el sitio web, ya que la compañía se reserva el derecho de cambiarlos.
Tres formas de usar DeepSeek
DeepSeek se puede encontrar en tres formatos fundamentalmente diferentes, y es importante entender de inmediato cuál elegir para tu tarea.
El chat en chat.deepseek.com y en las aplicaciones móviles es la forma más sencilla de empezar: no necesitas configurar nada, el registro toma un par de minutos, y la interfaz ofrece los modos "Expert" (basado en V4-Pro) e "Instant" (modo rápido). Es adecuado para tareas únicas, trabajo personal con texto, experimentos sin programación. Las lecciones 2 y 3 están dedicadas a este método.
La API en platform.deepseek.com es la forma de integrar DeepSeek en tus programas, scripts o servicios. El pago se realiza por el uso real de tokens, y el saldo se recarga con anticipación. La API es compatible con el formato OpenAI (dirección base https://api.deepseek.com) y con el formato Anthropic (https://api.deepseek.com/anthropic), y también es compatible con la API de respuestas de OpenAI. Esto significa que si tu código ya utiliza uno de estos SDK, para cambiar a DeepSeek solo necesitas modificar un par de parámetros. Es adecuado para desarrolladores, emprendedores que automatizan procesos y cualquiera que necesite integración en sus propias herramientas. La mayor parte del curso, a partir de la lección 4, está dedicada a esto.
Tus propios servidores con pesos abiertos: los modelos de DeepSeek están publicados en Hugging Face bajo la licencia MIT, y puedes descargarlos y ejecutarlos en tu propio hardware. Este es el camino para organizaciones con requisitos de aislamiento total de datos o con su propia infraestructura, pero requiere GPU potentes y no es adecuado para ejecutar en una laptop o un servidor común. Hablaremos de esto en detalle en la lección 10.
En resumen: para familiarizarte y realizar tareas puntuales, el chat es suficiente; para la automatización e integraciones, necesitas la API; y para requisitos de datos específicos, la opción de implementación propia es la adecuada.
DeepSeek frente a ChatGPT, Claude, GigaChat y YandexGPT
DeepSeek no es el único jugador en el mercado, y una conversación honesta sobre él requiere una comparación con alternativas, sin inclinarse hacia ningún lado.
La principal ventaja de DeepSeek, que casi todos los que han probado la API señalan, es el precio. Las solicitudes a deepseek-flash son notablemente más baratas que las solicitudes de calidad comparable a los modelos de OpenAI o Anthropic, y al implementar los pesos abiertos, el costo de propiedad se limita solo al hardware. La segunda fortaleza es el contexto largo de 1 millón de tokens en combinación con un trabajo de calidad con código y razonamiento: según las pruebas abiertas, los modelos de DeepSeek se encuentran consistentemente entre las mejores soluciones abiertas, y a veces se acercan a los líderes de mercado cerrados. La tercera ventaja, importante para los desarrolladores, es la apertura de los pesos: ni ChatGPT, ni Claude, ni los rusos GigaChat y YandexGPT ofrecen la posibilidad de descargar el modelo e implementarlo en tus propias instalaciones bajo una licencia que permita el uso comercial de forma tan permisiva como la MIT.
También debemos mencionar directamente las debilidades. DeepSeek, una empresa china, procesa las solicitudes en servidores ubicados físicamente en China, lo que significa que los datos de los usuarios también van allí. Para algunas organizaciones, especialmente aquellas que trabajan con datos personales o secretos comerciales, esta es una limitación significativa. Además, en Rusia no hay contratos corporativos oficiales con DeepSeek ni soporte local: toda la interacción se realiza directamente con el servicio extranjero bajo las condiciones generales para particulares y empresas. En ciertos temas políticos, el modelo puede dar respuestas evasivas o limitadas: esta es una característica de cualquier modelo con censura en temas sensibles, y DeepSeek no es una excepción. Finalmente, como la mayoría de los productos de rápido desarrollo, DeepSeek experimenta interrupciones e inestabilidad en las respuestas durante períodos de alta carga, aunque para esto se prevén tarifas pico y fuera de pico.
Los modelos rusos GigaChat y YandexGPT ganan donde la localización es crítica: los datos permanecen en servidores en Rusia, hay soporte oficial y contratos para personas jurídicas, y una mejor adaptación al idioma ruso en dominios específicos. Pero en cuanto a la apertura de pesos, la flexibilidad de precios para grandes volúmenes y las posiciones en los rankings abiertos de código y razonamiento, todavía están por debajo de DeepSeek. La elección entre estas opciones no es universal: depende de los requisitos de datos, el presupuesto y la tarea, y a menudo es razonable usar diferentes modelos para diferentes partes de un mismo proyecto.
Disponibilidad desde Rusia
Al 03.10.2026, el chat en chat.deepseek.com y las aplicaciones móviles funcionan desde Rusia sin VPN: este es uno de los factores por los que DeepSeek ha ganado rápidamente popularidad entre la audiencia de habla rusa. Para trabajar con la API, necesitarás un método de pago aceptado por la plataforma platform.deepseek.com, y las opciones de pago específicas deben verificarse directamente en el sitio web al momento del registro, ya que las condiciones para usuarios internacionales pueden cambiar. No debes contar de antemano con las tarjetas rusas habituales: la plataforma opera bajo reglas de pago internacionales, y es mejor verificar la lista actual de métodos en el sitio.
Contenido del curso
El curso consta de 12 lecciones que te guiarán gradualmente desde la familiarización hasta la práctica. Comienza con esta lección introductoria y la familiarización con el chat: la lección 2 analizará los modos, el trabajo con archivos y la búsqueda en la interfaz, y la lección 3 explicará el modo de reflexión y cuándo es realmente necesario. A partir de la lección 4, el curso pasa a la API: la primera solicitud, la clave y el costo, luego el diálogo, la salida de respuesta en streaming y el almacenamiento en caché del contexto en la lección 5, las respuestas JSON estructuradas en la lección 6, las llamadas a herramientas y los fundamentos de los agentes en la lección 7, el trabajo con imágenes y archivos a través de Vision y Files API en la lección 8. La lección 9 mostrará cómo conectar DeepSeek en Claude Code y herramientas de desarrollador similares. La lección 10 está dedicada a los pesos abiertos y la implementación en tus propios servidores, la lección 11 reúne todo en un taller utilizando el ejemplo de un asistente para procesar solicitudes, y la lección 12 cierra el curso con una conversación sobre datos, seguridad y cuestiones legales del uso de DeepSeek.
Pruébalo tú mismo
Regístrate en el chat en chat.deepseek.com (a través del sitio web o la aplicación móvil). Criterio de resultado: has iniciado sesión en tu cuenta y ves el interruptor entre los modos "Expert" e "Instant".
Formula una tarea de trabajo relevante para ti: por ejemplo, redactar un plan para una carta a un cliente, explicar un término complejo de tu industria en palabras sencillas o escribir un pequeño fragmento de código. Plantéala primero en modo "Instant", luego en modo "Expert". Criterio de resultado: tienes dos respuestas a la misma consulta y puedes formular con palabras la diferencia entre ellas en cuanto a profundidad, velocidad y utilidad.
Encuentra en platform.deepseek.com la sección de precios y métodos de pago actuales para tu país. Criterio de resultado: sabes qué modelo es más barato para tu tarea y qué necesitas para empezar a trabajar con la API, incluso si aún no has creado la clave.
Conclusiones
- DeepSeek, una empresa de Hangzhou, es conocida por los pesos abiertos de sus modelos, los precios bajos de su API y la alta calidad de su razonamiento y trabajo con código.
- Al 03.10.2026, hay dos modelos disponibles en la API: deepseek-flash (DeepSeek-V4.1-Flash, económico y rápido, con soporte de imágenes) y deepseek-v4-pro (DeepSeek-V4-Pro, un modelo más pesado sin soporte de imágenes, notablemente más caro que Flash).
- La arquitectura MoE significa que de un gran número de parámetros del modelo, solo una pequeña parte trabaja realmente en cada consulta, lo que reduce el costo y acelera la respuesta sin una pérdida notable de calidad.
- Puedes usar DeepSeek de tres maneras: a través del chat para tareas sencillas, a través de la API para integraciones y automatización, y a través de pesos abiertos en tus propios servidores para un control total sobre los datos.
- Las fortalezas de DeepSeek frente a ChatGPT, Claude, GigaChat y YandexGPT son el precio, el contexto largo y la apertura de los pesos; las debilidades son el almacenamiento de datos en servidores en China, la falta de contratos corporativos en Rusia y las restricciones en algunos temas.
- El chat está disponible desde Rusia sin VPN, y para trabajar con la API se necesita un método de pago, cuyas opciones actuales deben verificarse directamente en el sitio web de la plataforma.