DeepSeek augmente les tarifs facturés aux développeurs pour l'accès à ses modèles V4-Flash et V4-Pro, avec des hausses allant de 50 % à plus de 1 100 % selon le modèle, le type de jeton et la durée d'utilisation. Ces nouveaux tarifs s'accompagnent d'une nouvelle structure distinguant les heures de pointe et les heures creuses. La société a déclaré qu'elle ajustait ses tarifs « afin d'allouer les ressources de manière plus raisonnable ». Même avec ces nouveaux tarifs de pointe, les prix de DeepSeek restent inférieurs à ceux de certains concurrents. DeepSeek avait auparavant proposé une remise promotionnelle de 75 % sur V4-Pro, ce qui souligne à quel point sa stratégie tarifaire a radicalement changé ces derniers mois.

En juillet 2026, DeepSeek a lancé la version bêta publique de son API DeepSeek-V4-Flash (0731). Ce modèle léger surpasse désormais la version V4-Pro-Preview sur plusieurs benchmarks clés grâce à une optimisation post-entraînement rigoureux. Il offre aux développeurs un agent de codage extrêmement performant à une fraction du coût des modèles premiums concurrents. L'API assure une compatibilité native avec les formats OpenAI et Codex, facilitant ainsi son intégration immédiate dans les écosystèmes existants. Alors que les applications Web et mobiles restent inchangées pour le moment, l'entreprise prévoit de publier prochainement une version V4-Pro officielle.

Récemment, DeepSeek a annoncé qu'elle prévoit d'augmenter considérablement les tarifs de son API, mais n'a pas encore dévoilé les nouveaux tarifs ni la date à laquelle ils entreront en vigueur. La société a informé les développeurs via sa plateforme et leur a conseillé de revoir leurs plans d'utilisation avant ce changement. Cette décision fait suite au lancement public en phase de test de DeepSeek-V4-Flash-0731. DeepSeek a bâti une grande partie de son attrait sur des modèles performants proposés à des prix relativement bas ; l'augmentation prévue pourrait donc compromettre cet avantage, alors que la concurrence s'intensifie. La société a clairement indiqué qu'il s'agirait d'une « augmentation significative ».

DeepSeek augmente les tarifs facturés aux développeurs pour l'accès à ses modèles V4-Flash et V4-Pro, avec des hausses allant de 50 % à plus de 1 100 % selon le modèle, le type de jeton et la durée d'utilisation. DeepSeek a indiqué que ces nouveaux tarifs entreront en vigueur le 16 août à 16 h 00 UTC. Cette hausse des tarifs s'accompagne d'une nouvelle structure tarifaire distinguant les heures de pointe et les heures creuses. Les heures de pointe sont définies comme allant de 01 h 00 à 04 h 00 et de 06 h 00 à 10 h 00 UTC, les tarifs hors pointe étant fixés à la moitié des tarifs de pointe, selon la page dédiée aux tarifs de DeepSeek.

Pour V4-Flash, les jetons générés coûteront 1,32 $ le million pendant les heures de pointe et 0,66 $ le million pendant les heures creuses, contre un tarif forfaitaire actuel de 0,28 $ le million, a indiqué la société. Pour V4-Pro, le prix des jetons générés passera à 3,96 $ le million en heures de pointe et à 1,98 $ le million en heures creuses, contre 0,87 $ le million actuellement. Les prix des jetons d’entrée sont également en hausse. Les jetons d’entrée liés aux échecs de mise en cache de V4-Flash passeront à 0,44 $ le million aux heures de pointe, contre 0,14 $ auparavant, tandis que ceux de V4-Pro passeront à 1,32 $ le million aux heures de pointe, contre 0,435 $ auparavant, a indiqué DeepSeek.

La société a déclaré qu’elle ajustait ses tarifs « afin d’allouer les ressources de manière plus raisonnable », et que cette structure tarifaire à plusieurs niveaux visait à décaler les charges de travail des développeurs vers des périodes moins encombrées. Même avec ces nouveaux tarifs de pointe, les prix de DeepSeek restent inférieurs à ceux de certains concurrents. Le modèle Fable 5 d’Anthropic facture 50 dollars par million de jetons de sortie.

DeepSeek a lancé V4-Flash au début du mois ; le cabinet d’études Artificial Analysis a constaté qu’il s’agissait alors du modèle d’IA connu le moins cher à exploiter à l’échelle mondiale, avec un coût d’environ 3 centimes par test de référence. La start-up basée à Hangzhou avait auparavant proposé une remise promotionnelle de 75 % sur V4-Pro jusqu’au 5 mai, ce qui souligne à quel point sa stratégie tarifaire a radicalement changé ces derniers mois. DeepSeek avait annoncé la semaine dernière qu'une hausse des prix était à prévoir, sans toutefois préciser les montants exacts. La société a également commencé à préparer son introduction en bourse et a clôturé son premier tour de table, qui a dépassé les 7 milliards de dollars.

En décembre 2025, les modèles d'IA open source chinois ont considérablement étendu leur présence à l'échelle mondiale, leur taux d'adoption passant de 13 % à près de 30 % de l'utilisation totale en 2025, principalement grâce à Qwen et DeepSeek. Cette tendance a été documentée dans le rapport "State of AI" d'OpenRouter, qui a analysé plus de 100 000 milliards de jetons sur plus de 300 modèles, révélant ainsi le passage d'une domination propriétaire à une concurrence pluraliste et open source à l'échelle mondiale

Plus récemment, en juillet 2026, la start-up chinoise DeepSeek a développé sa propre puce d’IA. Cette initiative pourrait lui permettre de réduire sa dépendance vis-à-vis des puces de Nvidia et de Huawei, sur lesquelles elle s’appuie actuellement pour entraîner et faire fonctionner ses modèles, très populaires à l’échelle mondiale. Cette puce est conçue pour l’inférence — l’étape du calcul IA au cours de laquelle un modèle entraîné génère des réponses pour les utilisateurs — plutôt que pour l’entraînement de nouveaux modèles.

Source : Documentation de l'API DeepSeek

Et vous ?

Pensez-vous que cette annonce est crédible ou pertinente ?
Quel est votre avis sur le sujet ?

Voir aussi :

Le nouveau modèle DeepSeek-V4-Flash-0731 surpasse sa propre version « Pro ». Il rivalise avec GPT-5.6 Luna, pour un coût inférieur d'environ 60 %, même après la baisse de prix de 80 % pratiquée par OpenAI

L'âge d'or du forfait IA illimité tire à sa fin : pubs ciblées, limitations d'usage, fonctionnalités verrouillées, prix en hausse. L'IA agentique contraint les fournisseurs à changer leurs modèles économiques

OpenAI met fin à l'abonnement forfaitaire de Codex et bascule vers la facturation au token : les développeurs vont-ils payer dix fois plus cher pour le même usage ?

Vous avez lu gratuitement 56 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.