Présentation

DeepSeek-V4-Flash est entré en bêta publique le 31 juillet 2026, après une préversion annoncée le 24 avril 2026 aux côtés de son grand frère V4-Pro (toujours non disponible publiquement à la date de rédaction). Il comprend 284 milliards de paramètres au total, dont environ 13 milliards actifs par token, et met en avant une « architecture d’attention hybride » destinée à améliorer la mémoire sur des conversations longues.

Tarification

0,14 $ par million de tokens en entrée (0,0028 $ en cas de succès du cache) et 0,28 $ en sortie — un tarif spectaculairement inférieur à celui de tous les autres modèles de ce comparatif. DeepSeek prévient elle-même, sur sa page de tarification officielle, qu’une hausse de prix est probable à l’avenir, sans en préciser l’ampleur ni la date.

Performance annoncée

Selon DeepSeek, relayé par la presse économique, V4-Flash approcherait le niveau de Claude Opus 4.8 sur des tâches complexes de code et d’automatisation. Il s’agit d’une allégation du fabricant reprise par les médias, pas d’un résultat de benchmark indépendant que nous avons pu vérifier nous-mêmes.

Avis de la rédaction

Les notes ci-dessus sont une analyse éditoriale de la rédaction, fondée sur les caractéristiques techniques et tarifaires publiées par DeepSeek — pas un test indépendant complet réalisé en interne. Le rapport qualité-prix de V4-Flash n’a, à notre connaissance, pas d’équivalent parmi les modèles propriétaires de ce comparatif ; sa principale limite documentée reste l’absence de multimodalité confirmée.