DeepSeek a publié V4.1 Flash, un petit modèle qui comprend les images et dépasse le plus gros V4 Pro dans les tests, si nettement que DeepSeek arrête le modèle Pro. Sur ChatX, V4.1 Flash s’utilise gratuitement, y compris en tant qu’invité. Les questions essentielles en version courte.
Qu’y a-t-il de neuf dans V4.1 Flash ?
DeepSeek V4.1 Flash est le premier modèle d’une nouvelle famille d’architecture. Il n’utilise qu’une petite partie de ses paramètres par requête, ce qui le rend rapide et peu coûteux. Pour les longues conversations, il lui faut une fraction de la mémoire de la génération précédente. DeepSeek a répercuté cette économie en baissant ses prix le 10 septembre. La compréhension des images intégrée est également nouvelle : un encodeur d’images dédié a été entraîné dès le départ avec le modèle de langage, alors que DeepSeek ne proposait cela qu’à titre expérimental.
Pourquoi V4 Pro disparaît-il ?
DeepSeek indique que des tests menés par plusieurs parties placent V4.1 Flash devant V4 Pro pour la qualité, le coût, la vitesse et la durée totale. Depuis le 14 septembre, toutes les requêtes vers V4 Pro sont redirigées vers V4.1 Flash et le modèle Pro est retiré. Sur ChatX, il ne reste donc qu’une seule entrée DeepSeek, V4.1 Flash. Ce qui faisait la particularité de V4 Pro, la réflexion approfondie avant la réponse, se trouve désormais sous forme d’interrupteur dans le même modèle. Il est rare qu’un fournisseur remplace son modèle le plus cher par un moins cher au lieu de proposer les deux.
Que peut-on faire avec des images ?
La documentation cite trois cas : décrire des images, lire du texte sur une image, analyser des graphiques. Concrètement sur ChatX :
- Captures d’écran : photographier un message d’erreur et demander ce qu’il signifie, ou téléverser une partie de tableau et récupérer les valeurs en texte.
- Graphiques : téléverser un graphique en barres ou en courbes et faire expliquer la tendance ou estimer les chiffres.
- Photos : traduire une carte de restaurant, un panneau ou un formulaire, ou faire décrire une photo pour obtenir un texte alternatif.
L’écriture manuscrite et les très petits caractères marquent la limite. Gemini 3.8 Flash ou Sol sont plus fiables dans ces cas.
En quoi diffère-t-il de l’autre modèle gratuit ?
ChatX propose deux modèles gratuits, GPT-5 nano et DeepSeek V4.1 Flash. La différence est nette :
- GPT-5 nano : texte uniquement, très rapide, adapté aux questions courtes, aux traductions et aux reformulations simples. Pas d’images.
- DeepSeek V4.1 Flash : comprend les images, se montre nettement meilleur en programmation et en analyse et structure mieux les réponses longues. En contrepartie, un peu plus lent.
Quand on démarre en tant qu’invité, DeepSeek convient mieux pour presque tout. Seules les questions très courtes sont bouclées plus vite par nano.
À quoi faut-il faire attention ?
- Protection des données : les réponses de DeepSeek transitent par des serveurs en Chine. Pour des contenus confidentiels, cela doit entrer dans le choix du modèle.
- La réflexion est désactivée par défaut : V4.1 Flash répond directement. Avec un abonnement ou des tokens achetés, tu peux régler « Profondeur de la pensée » sur « Haute ». Le modèle réfléchit alors avant de répondre, ce qui aide nettement pour les calculs, le code et les questions à plusieurs étapes. Pour les invités et les comptes sans crédit, le mode direct rapide reste en place.
- Limite pour les invités : en tant qu’invité, la longueur de réponse est plafonnée. Pour de longs textes ou du code, mieux vaut créer un compte. Le modèle reste gratuit dans les deux cas.
V4.1 Flash montre la direction du marché. Les petits modèles rattrapent les grands et la compréhension des images devient un standard, y compris chez les modèles gratuits.
