DeepSeek ha lanzado V4.1-Flash, un nuevo modelo insignia de pesos abiertos diseñado para una eficiencia extrema de inferencia y bajo costo. El modelo utiliza una arquitectura de codificador-decodificador causal para reducir significativamente el cómputo activo y los costos de KV/cache.

  • Obtiene 40 en el Índice de Inteligencia de Artificial Analysis, superando a DeepSeek V4 Pro 0813 mientras cuesta $0.30 por cada 1M tokens de entrada.
  • La arquitectura cuenta con 763B parámetros totales, con solo 8B activos para la entrada y 16B activos para la salida.
  • Soporta una ventana de contexto de 1M tokens y acepta entradas tanto de texto como de imagen bajo una licencia MIT.
  • Las evaluaciones independientes muestran que empatan con GPT-6 Astra en AutomationBench-AA al 69% y igualan a GPT-5.6 Sol en AA-LCR v1.1 al 84%.
  • Los usuarios reportan ejecutar el modelo localmente en hardware comercial, logrando alta tasa de transferencia mediante streaming por SSD y descarga.

El lanzamiento posiciona a V4.1-Flash como una alternativa rentable frente a modelos propietarios, ofreciendo métricas de rendimiento sólidas a una fracción del precio.