La gama de modelos DeepSeek ha pasado de un pequeño modelo de programación de código abierto a convertirse en una de las familias de IA con pesos abiertos más observadas del mundo. Es conocida por lograr resultados cercanos a la vanguardia por una fracción del precio de sus competidores cerrados. Esta guía enumera todos los modelos DeepSeek principales, del más nuevo al más antiguo, con un resumen conciso de sus especificaciones, funciones clave y usos previstos, además de enlaces para probar en Chat Smith los que están disponibles.

chat smith pro

DeepSeek V4 Pro & V4 Flash

Lanzados el 24 de abril de 2026 bajo la licencia MIT, DeepSeek V4 Pro (1.6T de parámetros totales / 49B activos) y DeepSeek V4 Flash (284B / 13B activos) incluyen una ventana de contexto de 1M de tokens, cuyo coste se reduce gracias a un nuevo diseño de atención híbrida. Precio: V4 Pro, $0.435/1M de entrada y $0.87/1M de salida; V4 Flash, $0.14/1M de entrada y $0.28/1M de salida. Ideal para: programación con agentes y razonamiento con contexto amplio (Pro), y tareas de gran volumen sensibles a la latencia (Flash).

DeepSeek V3.2 (and V3.2-Speciale)

Lanzado el 1 de diciembre de 2025, DeepSeek V3.2 fue el primer modelo de DeepSeek que integró el razonamiento directamente en el uso de herramientas y obtuvo un 73.1% en SWE-Bench Verified. Su variante de mayor cómputo, V3.2-Speciale, llevó el razonamiento más lejos, con resultados de nivel medalla de oro en olimpiadas matemáticas y un 96% en AIME. El endpoint DeepSeek Reasoner V3.2 ofrece este comportamiento de razonamiento mediante un modo «thinking» específico. Ideal para: preguntas generales y tareas con agentes (V3.2), matemáticas de competición y razonamiento extenso (Speciale).

DeepSeek V3.2-Exp

Lanzado el 29 de septiembre de 2025, V3.2-Exp introdujo DeepSeek Sparse Attention (DSA), redujo aproximadamente a la mitad el precio de la API frente a la generación anterior y mejoró el rendimiento en tareas de contexto amplio. Fue la versión experimental que dio forma al lanzamiento completo de V3.2 dos meses después. Ideal para: consulta histórica; fue sustituido por V3.2.

DeepSeek V3.1 (and V3.1-Terminus)

Lanzado el 21 de agosto de 2025, DeepSeek V3.1 combinó por primera vez los modos «thinking» y respuesta normal en un solo modelo, eliminando la necesidad de elegir endpoints separados para chat y razonamiento. La revisión Terminus del 22 de septiembre mejoró la salida bilingüe en inglés y chino, reforzó el uso de herramientas con agentes y redujo el coste de procesar contextos amplios. Ideal para: consulta histórica; fue sustituido por V3.2.

DeepSeek R1-0528

Lanzado el 28 de mayo de 2025, R1-0528 fue una actualización importante del modelo de razonamiento original de DeepSeek. Alcanzó 91 en AIME, 73 en LiveCodeBench y 57.6% en SWE-bench Verified. DeepSeek también publicó una versión destilada de 8B basada en Qwen3, lo bastante pequeña como para ejecutarse en un portátil. Ideal para: consulta histórica; la capacidad de razonamiento está ahora integrada en las líneas V3.2/V4.

DeepSeek V3-0324

Lanzado el 24 de marzo de 2025, V3-0324 fue una actualización discreta pero importante del modelo base V3: un modelo MoE de 685B parámetros publicado en Hugging Face bajo la licencia MIT y la base sobre la que se construyeron versiones posteriores. Ideal para: consulta histórica; fue sustituido por completo por V3.1 y versiones posteriores.

DeepSeek R1 (and R1-Zero)

Lanzado el 20 de enero de 2025, DeepSeek R1 convirtió a la empresa en un nombre conocido y eliminó cientos de miles de millones de dólares del valor de las acciones tecnológicas estadounidenses durante su primera semana. Demostró que el razonamiento impulsado únicamente por aprendizaje por refuerzo, sin un ajuste supervisado intensivo, podía producir un modelo competitivo con o1 de OpenAI. El checkpoint experimental R1-Zero probó el aprendizaje por refuerzo desde cero, mientras que R1 añadió datos de arranque en frío para mejorar la legibilidad. Seis modelos destilados más pequeños permitieron ejecutar una versión ligera de forma local. Ideal para: consulta histórica; fue sucedido por R1-0528 y la línea V3.2/V4.

DeepSeek V3

Lanzado entre el 25 y el 26 de diciembre de 2024, DeepSeek V3 amplió el diseño Mixture-of-Experts de DeepSeek hasta 671 mil millones de parámetros totales (37B activos) y se entrenó con 14.8 billones de tokens por un coste declarado muy inferior al de los laboratorios occidentales para modelos comparables. Es la arquitectura base sobre la que posteriormente se construyó R1. Ideal para: consulta e investigación; puede autoalojarse con una licencia permisiva.

DeepSeek V2.5

Lanzado el 5 de septiembre de 2024 y revisado en diciembre, V2.5 combinó el modelo de chat de uso general de DeepSeek con su línea centrada en programación, simplificando la gama antes de V3. Ideal para: consulta histórica.

DeepSeek V2 (and Coder V2)

Lanzado el 6 de mayo de 2024, DeepSeek V2 (236B totales / 21B activos, contexto de 128K) es el punto de partida arquitectónico de todos los modelos insignia posteriores de DeepSeek. Introdujo Multi-head Latent Attention (MLA) para reducir el coste de la caché KV junto con un diseño Mixture-of-Experts, lo que disminuyó el coste de entrenamiento un 42.5% y el tamaño de la caché KV un 93.3% frente a los modelos densos anteriores de DeepSeek. DeepSeek Coder V2 llegó en junio y amplió la arquitectura a 338 lenguajes de programación. Ideal para: consulta histórica; hoy importa la arquitectura, no el checkpoint.

DeepSeek Coder & DeepSeek LLM (67B)

Lanzados en noviembre de 2023, los primeros modelos de DeepSeek —DeepSeek Coder y DeepSeek LLM de 7B/67B— se entrenaron con aproximadamente 2 billones de tokens y compitieron con LLaMA-2 70B de Meta en benchmarks de programación, matemáticas y razonamiento. Situaron a DeepSeek como un laboratorio serio de código abierto mucho antes de que V3 o R1 aparecieran en titulares internacionales. Ideal para: consulta histórica.

La gama DeepSeek abarca ahora modelos generales con pesos abiertos, modelos especializados en razonamiento y una división entre versiones fast y pro en el nivel insignia. Todos se publican con licencias permisivas y cuestan aproximadamente una décima parte que sus competidores cerrados. Para equipos y personas que quieran usarlos sin autoalojarlos, Chat Smith permite acceder a los modelos DeepSeek disponibles junto con GPT, Claude, Gemini y Grok, todo desde una sola interfaz. Consulta el catálogo completo de modelos de IA en Chat Smith para encontrar el modelo adecuado para tu flujo de trabajo.

Preguntas frecuentes

La línea actual es la familia DeepSeek V4, lanzada en abril de 2026 en dos variantes: V4 Pro, el modelo grande para razonamiento complejo y programación agéntica, y V4 Flash, el hermano más liviano y barato para trabajo de alto volumen. Ambos manejan un contexto de un millón de tokens.

logo chat smith

Editorial Team

Managing Editor

El equipo editorial de Chat Smith está formado por entusiastas de la IA, investigadores y creadores de contenido apasionados por hacer que la inteligencia artificial sea más accesible y práctica. A través del blog de Chat Smith, compartimos las últimas tendencias de IA, reseñas de herramientas, análisis del sector y guías prácticas para ayudar a personas y empresas a obtener más valor de la IA. Nuestra misión es simple: ofrecer contenido claro, confiable y fácil de entender que ayude a los lectores a mantenerse informados, ser más productivos y mantenerse a la vanguardia en el dinámico mundo de la IA.

Comparte este artículo

Artículos relacionados