DeepSeek-V3.2-Exp es una publicación experimental de la familia V3. Su interés principal está en el estudio de DeepSeek Sparse Attention, una modificación de la atención para trabajar de forma más eficiente con secuencias largas. La etiqueta Exp forma parte de la identidad del modelo.

De dónde parte el experimento

El repositorio oficial explica que V3.2-Exp se construyó sobre V3.1-Terminus e introdujo DSA. Los autores alinearon configuraciones de entrenamiento para estudiar el cambio de atención. Sus comparaciones pertenecen a ese diseño experimental.

La consecuencia práctica es que conviene leer el resultado junto con su método: qué se mantuvo constante, qué cambió y qué tareas se evaluaron. Una mejora de eficiencia publicada en un entorno concreto no predice por sí sola la velocidad de tu servidor.

Por qué importa la atención dispersa

Lectura conceptual de DSA

  1. Contexto

    El modelo recibe una secuencia que debe procesar.

  2. Selección

    La atención dispersa introduce una selección de conexiones relevantes, en lugar de tratar todas de la misma forma.

  3. Evaluación

    Para medir su efecto hacen falta el modelo, el código, las longitudes y el entorno concretos.

Es una explicación simplificada; no muestra un mapa de atención medido ni acredita una mejora de velocidad. V3.2-Exp documenta el experimento; V3.2 es otra publicación.

En esta investigación, la atención dispersa selecciona información del contexto para reducir trabajo de cálculo. Para evaluar una implementación, interesa comprobar tanto su coste como si conserva información relevante cuando la entrada crece.

Una propuesta de prueba consiste en preparar documentos con datos comprobables al principio, en el centro y al final. Formula preguntas sobre esos datos y repite el ejercicio con longitudes distintas. Mantén iguales el contenido esencial y el criterio de corrección.

Revisar el código es parte de reproducir el modelo

El repositorio registra una corrección del 17 de noviembre de 2025 en el tratamiento de RoPE dentro del módulo indexador. También enlaza demostraciones de inferencia y componentes especializados. Al reproducir un resultado, la revisión del código puede importar tanto como la revisión de los pesos.

  1. Registra el identificador exacto del modelo y la revisión descargada.
  2. Consulta las correcciones del repositorio antes de reutilizar una receta antigua.
  3. Comprueba que el motor y sus componentes admitan esta arquitectura.
  4. Guarda los parámetros y la longitud real de cada entrada.
  5. Compara las respuestas completas, incluidos errores y omisiones.

V3.2-Exp y V3.2 son páginas distintas por una razón

V3.2 añade su propio contexto de publicación y de uso de herramientas. Usa su ficha cuando necesites esa versión. Para entender el punto de partida del experimento, consulta V3.1 y Terminus.

Si lo que buscas es una API alojada que puedas integrar hoy, empieza por la guía de acceso actual. No utilices un nombre de modelo experimental como identificador de API sin comprobar que el proveedor lo admite.

Esta página es una lectura técnica de documentación primaria. No presenta un ensayo de rendimiento realizado por DEspañol.