Nuevos Desarrollos

DeepSeek Lanza Modelo V3.2 con Atención Dispersa y Mejoras en Aprendizaje por Refuerzo

DeepSeekFuente: Sebastian Raschka02/12/2025, 21:06
DeepSeek lanzó V3.2, una nueva versión de su modelo de lenguaje principal, construyendo sobre la arquitectura DeepSeek V3. El modelo V3.2 mantiene 671 mil millones de parámetros totales con 37 mil millones activos por token mientras introduce DeepSeek Sparse Attention para procesamiento de contexto largo mejorado junto con atención latente multi-cabeza existente. El lanzamiento representa el desarrollo continuo del equipo después del exitoso modelo de razonamiento DeepSeek R1 establece la empresa como un actor significativo en la competencia de modelos de peso abierto.
DeepSeek Lanza Modelo V3.2 con Atención Dispersa y Mejoras en Aprendizaje por Refuerzo — lupAI