DeepSeek-R1 es una familia de modelos de razonamiento que conserva interés para investigación, comparación de versiones y despliegue propio. Su nombre identifica una publicación concreta; no debes usarlo como sinónimo del modelo que atiende hoy cualquier conversación de DeepSeek.
R1, R1-Zero y las variantes destiladas
Publicación
R1 y R1-Zero tienen procesos de entrenamiento distintos.
Destilación
Una variante Qwen o Llama es otro modelo entrenado; no conserva sin cambios todos los pesos de R1.
Revisión
R1-0528 tiene instrucciones propias y una variante derivada de Qwen3-8B que debe identificarse por separado.
El repositorio oficial de R1 distingue R1-Zero, una investigación con aprendizaje por refuerzo, de R1, cuyo entrenamiento incorpora etapas adicionales. También publica modelos destilados basados en familias Qwen y Llama.
Una destilación transfiere capacidades mediante entrenamiento a otro modelo. Por tanto, R1-Distill-Qwen-32B, por ejemplo, no es el modelo R1 completo comprimido sin cambios. Su arquitectura, tamaño y comportamiento deben evaluarse por separado.
Qué significa R1-0528
R1-0528 identifica una actualización de la familia. Su ficha oficial documenta cambios en las recomendaciones de uso, entre ellos la admisión de instrucciones de sistema, y presenta una variante derivada de Qwen3-8B. Consulta las instrucciones correspondientes a esa publicación, no las de R1 original por semejanza del nombre.
Las cifras de evaluación de cada ficha pertenecen al modelo, conjunto de tareas y configuración que allí se describen. No prueban automáticamente cómo responderá a tus apuntes o a documentación en español.
Cuándo puede interesarte
- Reproducir una investigación: necesitas una referencia estable a los pesos y a su configuración.
- Comparar razonamiento: quieres analizar tipos de errores sobre problemas con soluciones comprobables.
- Estudiar destilación: buscas diferencias entre un modelo de referencia y variantes más pequeñas.
Si solo necesitas utilizar el servicio alojado actual, empieza por el catálogo de modelos y la guía de la API.
Antes de descargar y ejecutar
- Selecciona el repositorio oficial y el identificador completo, incluido el sufijo de versión.
- Revisa la licencia y cualquier condición del modelo de base en el caso de una variante derivada.
- Comprueba la compatibilidad de tu motor de inferencia, la memoria disponible y el formato de los archivos.
- Conserva el tokenizer y la plantilla de conversación adecuados al modelo elegido.
No deduzcas los requisitos de memoria únicamente del número de parámetros activos. Tampoco asumas que una cuantización mantendrá todos los resultados de la publicación original.
Una evaluación útil en español
Prepara problemas con una respuesta verificable y criterios de corrección previos. Distingue una conclusión correcta de una explicación consistente: una respuesta puede acertar el número por un procedimiento incorrecto. Guarda fallos y respuestas completas, además de los aciertos. Para uso académico cotidiano, consulta los ejemplos de estudio.