Un développeur chinois a publié une évaluation pratique de DeepSeek V4 Flash 0731, la dernière itération du modèle rapide de DeepSeek. Le test couvre trois domaines clés : la génération longue soutenue (20 rounds d'écriture de roman), la nouvelle capacité d'agent Responses et quatre niveaux de réflexion configurables. Les premiers résultats suggèrent que le modèle maintient la cohérence sur des sorties étendues, un facteur critique pour l'écriture créative et l'automatisation de tâches complexes. La fonction d'agent Responses semble offrir des modèles d'interaction plus structurés, simplifiant potentiellement les flux de travail agentiques. Les quatre niveaux de réflexion offrent aux développeurs un compromis entre vitesse et profondeur de raisonnement. Bien qu'il s'agisse d'un test communautaire unique et non d'un benchmark formel, il offre un aperçu pratique du comportement réel du modèle. Pour les développeurs évaluant les API LLM, cela signale que DeepSeek itère agressivement sur les performances et les fonctionnalités destinées aux développeurs.
Un test pratique de DeepSeek V4 Flash 0731 par un développeur révèle une génération longue solide et une nouvelle fonction d'agent Responses avec quatre niveaux de réflexion.