Le prix de votre IA dépend désormais de l’heure à Pékin
Depuis le 16 août, DeepSeek a modifié sa politique tarifaire, augmentant le coût de ses modèles en heures de pointe. Ces nouvelles fenêtres tarifaires coïncident avec les horaires de bureau chinois, impactant ainsi la journée de travail en France.
Le 13 août, DeepSeek a annoncé une nouvelle grille tarifaire pour ses modèles V4, qui est entrée en vigueur trois jours plus tard à 16 heures UTC. Le prix de son modèle V4-Pro a été ajusté, passant de 0,87 dollar à 1,98 dollar par million de tokens en heures creuses et atteignant 3,96 dollars en heures de pointe.
Cette augmentation tarifaire, même au tarif le plus bas, représente un doublement des coûts. Pour un fournisseur qui s’est initialement fait connaître pour ses tarifs compétitifs, cette évolution marque un tournant significatif.
Les heures de pointe sont définies de 1 heure à 4 heures et de 6 heures à 10 heures UTC, du lundi au vendredi, soit sept heures par jour. En heure de Pékin, cela correspond à 9 heures à midi et 14 heures à 18 heures, reflétant ainsi les horaires de bureau chinois.
DeepSeek ne facture pas seulement la rareté du calcul, mais s’ajuste à l’affluence de son marché intérieur, ce qui peut sembler indifférent pour les clients européens. Pour une direction informatique en France, la conversion est immédiate : en été, la fenêtre tarifaire élevée couvre 8 heures à midi à Paris, tandis qu’en hiver, ce créneau se déplace.
Cette nouvelle approche remet en question la structure des dossiers d’investissement. Un business case en intelligence artificielle repose sur un calcul simple : coût par requête multiplié par le volume, où le coût était jusqu’alors constant. La variable qui influe désormais sur ce coût est la congestion des serveurs, sur laquelle les entreprises françaises n’ont pas de visibilité.
Un argument courant pourrait être de décaler les traitements, mais cela ne s’applique pas à tous les usages. Si un traitement de nuit est envisageable, un copilote IA qui assiste un commercial en rendez-vous ne peut pas être décalé.
DeepSeek n’est pas le seul à adapter ses tarifs. D’autres acteurs du marché, comme OpenAI, ont également modifié leur approche. Par exemple, OpenAI propose des réductions sur les traitements asynchrones, mais c’est le client qui choisit d’en profiter. Dans le cas de DeepSeek, c’est l’horloge qui impose les tarifs.
Pour les entreprises, deux questions essentielles se posent : combien de temps faut-il pour changer de modèle en production sans réécrire les prompts, et quelles sont les conditions de préavis sur les prix dans les contrats ? Si le changement prend plusieurs mois, le tarif affiché par le fournisseur pourrait ne pas refléter la réalité des coûts.
L’industrie a traditionnellement considéré le prix par token comme une donnée stable et négociable. Cependant, depuis le 16 août, cette dynamique a changé, et les tarifs ressemblent désormais à ceux de l’électricité, où l’on achète un profil de consommation plutôt qu’un tarif fixe.
Source : DeepSeek

