DeepSeek lanzó silenciosamente V4-Flash-0731 a través de una actualización del registro de API el 31 de julio de 2026. A pesar de la falta de un anuncio formal, el lanzamiento ha generado un gran revuelo en la comunidad de desarrolladores, ya que los primeros benchmarks sugieren que este modelo ligero, con solo 13 mil millones de parámetros activos, supera al buque insignia Pro de 1,6 billones de parámetros en capacidades de agente. Esto desafía la sabiduría convencional de que los modelos más grandes son siempre superiores. El modelo también parece estar posicionado como un competidor directo del ecosistema Codex de OpenAI. Para desarrolladores y empresas, esto podría significar IA de alto rendimiento más accesible para flujos de trabajo basados en agentes, con costos de inferencia reducidos. El movimiento subraya una tendencia industrial más amplia hacia la activación dispersa y arquitecturas centradas en la eficiencia, lo que podría redefinir cómo se escalan y despliegan los modelos de IA.
DeepSeek publicó V4-Flash-0731 el 31 de julio de 2026. Este modelo ligero con 13B de parámetros activos supuestamente supera a su propio buque insignia Pro de 1,6T en tareas de agente.