DeepSeek V4 « version pleine puissance » dévoilé, lancement prévu demain au plus tôt

marsbitPublié le 2026-07-19Dernière mise à jour le 2026-07-19

Résumé

Après près de trois mois d'attente, la version complète de DeepSeek V4 (General Availability) devrait être publiée prochainement, potentiellement dès demain. Le modèle est actuellement en test restreint. Deux versions sont annoncées : DeepSeek V4 Flash et DeepSeek V4 Pro. Les premières impressions d'un développeur indiquent que les performances globales se rapprochent du niveau d'Opus 4.8, avec des capacités de codage similaires à GPT-5.6 Sol et une nette amélioration des capacités d'agent et de génération 3D/SVG. Cependant, le modèle nécessiterait plus d'itérations qu'un Fable 5 pour accomplir la même tâche. Le principal changement réside dans la tarification de l'API, qui introduit un système de « facturation aux heures de pointe » (peak/off-peak). Les prix restent très compétitifs : par exemple, le million de tokens en sortie pour la version Flash coûterait 0,28 $ (hors pointe) contre 0,56 $ en pointe. Bien que cette approche marque un changement pour DeepSeek, réputé pour ses prix bas, le modèle maintient un rapport performance/prix très attractif, se présentant comme une alternative économique face aux modèles majeurs comme Fable 5 ou GPT-5.6 Sol. Les premières démonstrations techniques, notamment la génération de jeux simples en HTML/JavaScript et d'éléments SVG, commencent à circuler, suscitant des retours partagés sur les performances finales. Les anciens modèles deepseek-chat et deepseek-reasoner seront officiellement retirés le 24 juillet. En résumé, DeepSeek V4...

Le monde entier a attendu presque trois mois !

La version officielle de DeepSeek V4 pourrait être publiée dès demain, au plus tard dans les prochains jours.

Actuellement, une partie des utilisateurs a déjà obtenu un accès anticipé aux tests en bêta gris de DeepSeek V4 (GA).

Il existe deux versions : DeepSeek V4 Flash et DeepSeek V4 Pro.

DeepSeek V4 « version pleine puissance »

va enfin arriver

Ce qui intéresse le plus tout le monde est probablement de savoir comment vérifier si l'on fait partie de la bêta grise.

Le blogueur AiBattle a donné une astuce « non officielle » : observer la première personne dans la chaîne de raisonnement (CoT).

Si le processus de réflexion du modèle commence par « Je suis » ou « Je vais », et non par l'ancienne formulation « Laissez-moi ».

Alors félicitations, vous utilisez probablement déjà la version V4 GA !

Dans le contexte actuel de la rivalité persistante entre Fable 5 et GPT-5.6 Sol, les attentes pour la grande annonce de l'IA open source sont à leur comble.

Un développeur, Pankaj Kumar, après l'avoir testé, a résumé de manière équilibrée les performances de V4 :

Les performances globales se rapprochent du niveau Opus 4.8, le codage rattrape GPT-5.6 Sol ;

Les capacités d'agent sont nettement améliorées, la génération 3D et SVG s'est significativement améliorée ;

Pour une même tâche, V4 nécessite plus d'itérations que Fable 5.

Il a déclaré que, d'après sa position actuelle sur le marché, V4 a peu de chances de surpasser le récemment publié Kimi K3, mais son prix sera nettement plus bas.

Si ces performances sont vraiment associées à ce prix, cela pourrait être un nouveau « moment DeepSeek ».

Les premiers tests sont sortis

Maintenant, les premières démos de test de DeepSeek V4 (GA) commencent à fuiter.

On peut dire que les réactions externes sont mitigées :

Certains pensent qu'il peut déjà égaler Claude 5, mais certains développeurs soulignent également que la version Pro n'est pas tellement plus avancée que la version Flash.

Voici un jeu de tir 3D généré par V4 Pro, dont le gameplay principal consiste à contrôler une catapulte pour un entraînement au tir, et les fonctions d'interface utilisateur de base sont également complètes.

Un jeu hybride HTML, mélange de « Minecraft » et « No Man's Sky », créé par la version officielle de V4, offre une jouabilité assez élevée.

Ce jeu classique « Cut the Rope » a également été généré en une seule fois par V4.

Voici également d'autres démos générées par V4, un test SVG d'une manette Xbox, et une génération de jeu.

Introduction pour la première fois de la « tarification heure pleine/heure creuse »

Toujours aussi alléchante

Recréer un « moment DeepSeek », la plus grande variable est le prix.

Toutes les informations pointent vers la même affirmation : les performances ne seront peut-être pas les premières, mais le prix sera nettement plus bas.

Fin du mois dernier, DeepSeek a envoyé un e-mail à tous les utilisateurs de l'API, annonçant le lancement imminent de la version officielle de V4 à la mi-juillet.

Après la publication de la GA, les tarifs de l'API seront ajustés simultanément, avec l'introduction de la « tarification heure pleine/heure creuse ».

deepseek-v4-pro : 0,87 $ pour un million de tokens de sortie en heure creuse, 1,74 $ en heure pleine ; 0,435 $ pour l'entrée en cas d'échec du cache en heure creuse.

deepseek-v4-flash est encore plus agressif : 0,28 $ pour un million de tokens de sortie, 0,56 $ en heure pleine, 0,0028 $ pour l'entrée en cas de succès du cache.

Autrement dit, le « tueur de prix » qui n'a jamais augmenté ses tarifs a installé pour la première fois un compteur sur sa puissance de calcul.

L'impact sera faible pour les utilisateurs individuels, mais pour les équipes qui font tourner leurs agents en continu pendant les heures de travail, c'est un calcul qui doit être refait sérieusement.

Heureusement, le prix en cas de succès du cache reste extrêmement bas, et en déplaçant les tâches par lots, les benchmarks, la génération de données en dehors des heures de pointe, les coûts peuvent être ramenés à la baisse.

Cependant, comparé à Fable 5 dont le prix pour un million de tokens de sortie est de 50 $, V4 reste toujours le plus attractif en termes de rapport qualité-prix.

Après tout, les performances atteignent également le niveau Opus. Lors de la sortie de la version preview de V4, dans les tests officiels du SWE-bench Verified —

DeepSeek-V4-Pro-Max n'était qu'à 0,2 point de pourcentage de Claude Opus 4.6 Max, mais son prix n'était qu'un septième de celui de ce dernier.

Mais dans la recherche contextuelle longue, l'ingénierie logicielle professionnelle et certains benchmarks de raisonnement de connaissances, Opus maintient toujours son avance.

Soit dit en passant, les deux anciens noms de modèles, deepseek-chat et deepseek-reasoner, seront officiellement retirés le 24 juillet.

Quoi qu'il en soit, cette « chaussure » que le monde entier attendait depuis trois mois est sur le point de toucher le sol.

D'après les informations qui ont fuité, V4 ne sera probablement pas le modèle « premier en tout ».

Avec Fable 5 et GPT-5.6 Sol devant, et Kimi K3 sur le côté, il sera difficile pour V4 de bouleverser la table avec des performances pures.

Mais DeepSeek n'a jamais joué cette carte-là.

Le véritable point d'intérêt est cette ancienne voie, maintes fois vérifiée : offrir des capacités de niveau Opus à un septième du prix.

Après tout, face aux géants qui facturent des dizaines de dollars pour un million de tokens, même avec le « compteur heure pleine/heure creuse » installé, V4 reste le « tueur de prix » qui déchaîne les passions.

Références :

https://x.com/pankajkumar_dev/status/2078536231026372846

Cet article provient du compte WeChat officiel « Xin Zhi Yuan », rédacteur : Taozi

Questions liées

QQuand la version complète de DeepSeek V4 sera-t-elle probablement publiée ?

ALa version officielle de DeepSeek V4 pourrait être publiée dès demain, et au plus tard dans les prochains jours.

QQuels sont les deux modèles proposés dans la version DeepSeek V4 (GA) ?

AIl existe deux versions : DeepSeek V4 Flash et DeepSeek V4 Pro.

QComment savoir si on a accès à la version V4 GA selon la méthode « populaire » mentionnée ?

ASelon la méthode populaire, si le processus de réflexion du modèle (Chaîne de Pensée) commence par « I'm » ou « I'll » au lieu de l'ancien « Let me », il est probable que l'on utilise la version V4 GA.

QQuel est le principal changement dans la tarification de l'API pour DeepSeek V4 ?

ADeepSeek V4 introduit une tarification différenciée selon la période (pointe/hors pointe). Par exemple, pour deepseek-v4-flash, le coût est de 0,28 dollar pour un million de tokens en sortie hors pointe et de 0,56 dollar en période de pointe.

QSelon les premières impressions, comment les performances de DeepSeek V4 se comparent-elles à celles des modèles concurrents comme Claude Opus ou GPT ?

ALes premières impressions indiquent que les performances globales de DeepSeek V4 se rapprochent du niveau d'Opus 4.8, avec des capacités de codage comparables à GPT-5.6 Sol. Cependant, dans des tâches comme la recherche en contexte long ou le raisonnement spécialisé, Opus garderait encore un avantage.

Lectures associées

Claude s'introduit dans les salles de classe américaines : les enseignants qui travaillent 49 heures par semaine accueillent enfin un assistant pédagogique IA gratuit

Claude s’invite dans les salles de classe américaines : les enseignants, qui travaillent en moyenne 49 heures par semaine, accueillent désormais un assistant pédagogique IA gratuit. Anthropic a lancé « Claude for Teachers », offrant gratuitement aux enseignants américains vérifiés de la maternelle à la terminale (K-12) l’accès à ses capacités avancées. L’outil vise à réduire la charge administrative écrasante des enseignants, qui passent souvent leur temps libre à préparer des cours et à corriger des travaux. Contrairement aux générateurs de contenu IA génériques, Claude for Teachers est directement intégré aux programmes scolaires des 50 États américains via le système Learning Commons. Cela lui permet de créer des plans de cours et du matériel pédagogique déjà alignés sur les normes éducatives locales, épargnant aux enseignants de longues vérifications. Ses principales fonctionnalités sont : la préparation de cours alignés sur les programmes, la différenciation pédagogique pour adapter le contenu à différents niveaux d’élèves, et l’analyse des données scolaires pour identifier les difficultés individuelles ou collectives. Il peut aussi automatiser des tâches répétitives, comme l’analyse quotidienne des évaluations des élèves. Il est important de noter que les élèves eux-mêmes n’ont pas accès à Claude, réservé aux plus de 18 ans. Anthropic adopte une approche prudente, se positionnant comme un outil pour les enseignants, non comme un remplacement. Le but est de libérer du temps aux professeurs pour se concentrer sur l’interaction humaine et l’enseignement. Cette initiative suit celle d’OpenAI, mais mise sur la confiance en garantissant la conformité aux lois sur la vie privée des élèves (FERPA) et en collaborant avec des syndicats enseignants. Le débat sur le rôle de l’IA dans l’éducation, notamment les craintes concernant la vie privée ou la dépendance cognitive, reste toutefois vif, comme en témoigne la restriction récente de l’IA générative dans les écoles primaires norvégiennes.

marsbitIl y a 6 mins

Claude s'introduit dans les salles de classe américaines : les enseignants qui travaillent 49 heures par semaine accueillent enfin un assistant pédagogique IA gratuit

marsbitIl y a 6 mins

La philosophie, domaine autrefois confidentiel, devient un 'remède' brûlant pour l'IA

Alors que l'IA devient de plus en plus capable, générant des articles scientifiques ou simulant des sociétés, des questions fondamentales sur la nature de l'intelligence, la crédibilité des découvertes et la gouvernabilité émergent. Lors du Forum WAIC, des philosophes comme Sun Ning ont souligné que l'intelligence nécessite un ancrage dans le monde physique, à travers le corps, l'environnement et l'histoire. Pendant ce temps, des chercheurs présentaient des modèles d'auto-évolution capables de produire des articles académiques, posant la question de l'évaluation et de la propriété de ces recherches. La simulation sociale par IA, bien que prometteuse, risque de perpétuer des biais si elle n'est pas soigneusement auditée. Face à ces défis, la gouvernance de l'IA devient cruciale. Des initiatives comme le *Livre Bleu 2026* proposent des cadres pour une recherche crédible et une intégration responsable de l'IA dans la société, distinguant les rôles d'assistance et de prise de décision. Enfin, l'adoption industrielle, par exemple en biologie synthétique, révèle que les nouveaux modèles de production nécessitent également de repenser la répartition des bénéfices et les relations économiques. À Shanghai, un écosystème interdisciplinaire se forme, reliant la recherche technique, les sciences sociales et les politiques publiques pour guider le développement de l'IA vers une intégration stable et bénéfique dans la réalité.

marsbitIl y a 44 mins

La philosophie, domaine autrefois confidentiel, devient un 'remède' brûlant pour l'IA

marsbitIl y a 44 mins

32 milliards de financement sur papier après six ans, 90% détournés vers la trésorerie : le vrai et le faux de « l'industrialisation » du carbure de silicium chez Lixiao Technology | Investigation approfondie de Titanium Media

**Résumé :** En six ans, Luxiao Technology (002617.SZ) a levé environ 3,2 milliards de yuans via deux augmentations de capital axées sur le carbure de silicium (SiC). Finalement, plus de 90% des fonds (environ 2,9 milliards de yuans) ont été détournés pour combler des lacunes de trésorerie ou rembourser des dettes, avec moins de 3% réellement investis dans les projets annoncés. L'entreprise a récemment mis fin à ses principaux projets de substrats SiC de 6 pouces, invoquant une surcapacité du marché. Son entrée tardive dans le SiC (2020) a toujours été en retard sur le secteur, passant du 4 au 6 pouces alors que les concurrents (comme Tianke Heda et Tianyue Advanced) maîtrisaient déjà le 8 pouces. Luxiao promet désormais de se concentrer sur le 8/12 pouces avec des fonds propres, mais ses capacités de R&D et de production restent limitées. La situation de son scientifique en chef, Chen Zhizhan, est floue, et ses contributions récentes sont peu visibles. Historiquement, Luxiao a une stratégie erratique de "poursuite des tendances" (photovoltaïque, véhicules électriques, etc.), souvent financée par des levées de capitaux, avec des résultats médiocres. Depuis son introduction en bourse, elle a levé 7,07 milliards de yuans mais n'a généré que 221 millions de yuans de bénéfices cumulés. Parallèlement, la famille du contrôleur a réalisé des ventes importantes d'actions pour environ 1,99 milliard de yuans depuis 2018. L'histoire de Luxiao illustre les risques des sociétés cotées qui privilégient la narration financière à la réalisation industrielle concrète.

marsbitIl y a 1 h

32 milliards de financement sur papier après six ans, 90% détournés vers la trésorerie : le vrai et le faux de « l'industrialisation » du carbure de silicium chez Lixiao Technology | Investigation approfondie de Titanium Media

marsbitIl y a 1 h

ChatGPT peut enfin « se rechercher », près de 4 ans de conversations archivées, retrouvées en un clic

ChatGPT, lancé il y a près de quatre ans, vient enfin de recevoir une fonctionnalité de recherche unifiée, permettant aux utilisateurs de retrouver facilement leurs anciennes conversations, images, documents et projets stockés dans leur compte. Disponible sur le web, iOS et Android pour toutes les versions, cette mise à jour comble une lacune majeure : jusqu'à présent, retrouver un échange spécifique parmi des milliers s’apparentait à chercher une aiguille dans une botte de foin. Cette nouveauté dépasse la simple amélioration technique. Elle marque une évolution de ChatGPT d'un outil de conversation ponctuel vers une véritable base de connaissances personnelle, organisant les données accumulées au fil des interactions avec l'IA. Pour les utilisateurs, ces données constituent un actif précieux et unique. Cependant, cette capacité accrue à indexer et rechercher des historiques complets soulève également des questions sur la vie privée et le contrôle des données. Les conversations, souvent utilisées par défaut pour l'entraînement des modèles, pourraient dans certains contextes juridiques être exposées. Cette mise à jour s'inscrit dans une stratégie plus large d'OpenAI, qui, avec des lancements récents comme Projects, Memory, et ChatGPT Work, transforme ChatGPT en une plateforme de travail intégrée. Le secteur dans son ensemble se tourne désormais vers la gestion et la valorisation des données utilisateur comme nouveau champ de bataille, après des années concentrées uniquement sur les performances des modèles.

marsbitIl y a 1 h

ChatGPT peut enfin « se rechercher », près de 4 ans de conversations archivées, retrouvées en un clic

marsbitIl y a 1 h

Trading

Spot
活动图片