Résumé des principales informations
Après avoir augmenté les tarifs de ses API de jusqu'à 11 fois en août, provoquant la défection de nombreux développeurs, DeepSeek, un fabricant de grands modèles en Chine, a annoncé moins d'un mois plus tard la réduction des prix de sa série de modèles Flash, axée sur le rapport qualité-prix. Certaines des prestations payantes sont même retournées aux niveaux d'avant l'augmentation. Cette baisse de prix n'est ni le résultat d'un soudain repentir de la part de l'entreprise, ni un retour complet aux anciens tarifs, mais plutôt une mesure adaptée à la sortie d'une nouvelle génération de modèles à faible coût. L'objectif est de conserver les hauts bénéfices des produits haut de gamme tout en gagnant à nouveau des parts sur le marché des développeurs à faible budget. Cela marque également la fin de la phase de concurrence tarifaire basée sur le gaspillage de ressources, et l'entrée dans un modèle de revenus plus pragmatique et différencié.
---
Analyse détaillée
1. La baisse de prix n'est pas un retour complet aux niveaux d'avant l'augmentation, mais plutôt un ajustement ciblé
Beaucoup pensent que DeepSeek a cédé en réduisant tous les tarifs, mais ce n'est pas le cas. Pour faire comprendre cela de manière plus simple, imaginons que 1 million de tokens équivaut à environ 700 000 caractères chinois, soit l'équivalent de l'information contenue dans un roman de taille moyenne :
- Seuls deux services payants ont été entièrement réduits aux niveaux d'avant l'augmentation :
- Pour les requêtes qui utilisent la mémoire cache (c'est-à-dire lorsque l'IA n'a pas besoin de recalculer à partir de zéro), le tarif est passé de 0,05 yuane par million de caractères après l'augmentation en août à 0,02 yuane, soit une réduction de 60 %.
- Pour les requêtes qui ne utilisent pas la mémoire cache, le tarif est passé de 1,5 yuane à 1 yuane, soit une réduction de 33 %.
- En revanche, le tarif pour la production de contenu est resté inchangé, passant de 2 yuanes à 4 yuanes par million de caractères après l'augmentation en août.
En général, le coût de utilisation pour les développeurs ordinaires devrait baisser de 40 %, mais la réduction dépendra de l'utilisation : si les mêmes données sont fréquemment requises, la baisse sera plus importante ; si chaque demande est unique, elle sera plus faible. De plus, les tarifs doublent pendant les heures de pointe, ce qui augmente directement les coûts pendant les heures de travail.
2. La baisse de prix n'est pas le résultat d'un repentir, mais d'une erreur stratégique lors de l'augmentation précédente
L'augmentation globale des tarifs en août a été menée en même temps que le lancement du modèle haut de gamme V4 Pro. À l'époque, les prix de la série Pro ont augmenté de 11 fois, faisant passer le coût de l'infrastructure nécessaire pour obtenir les mêmes performances de 10 yuans à 120 yuans, ce qui a découragé de nombreux petits entrepreneurs et développeurs utilisant des IA à faible coût. DeepSeek n'a pas pu réduire les prix de la série Pro, car elle vise des entreprises disposant de moyens importants et recherchant les meilleures performances. La baisse des prix concerne donc principalement la série Flash, plus accessible.
3. La réduction des prix n'est pas le résultat d'un gaspillage de ressources, mais de l'amélioration des technologies
Le jour précédant la baisse, DeepSeek a commencé les tests internes du nouveau modèle V4.1 Flash, qui offre des performances améliorées et des coûts de calcul réduits. En d'autres termes, l'équipe technique a optimisé les algorithmes de manière significative, permettant au nouveau modèle de consommer beaucoup moins de ressources pour produire le même résultat que l'ancien modèle. Par exemple, si fabriquer un tel modèle coûtait 1 yuane auparavant, il ne coûte plus que 0,3 yuane maintenant, ce qui laisse de la marge pour réduire les prix. De plus, avec un plus grand nombre d'utilisateurs, l'utilisation des serveurs augmente, réduisant encore les coûts unitaires et augmentant les profits.
4. Une tarification intelligente en fonction des heures de pointe et des heures creuses
DeepSeek a maintenu une tarification différenciée en fonction des heures de travail et des heures creuses : les prix doublent pendant les heures de pointe (9h-12h et 14h-18h), tandis qu'ils restent inchangés pendant les heures creuses. Cette approche est très astucieuse : pendant les heures de pointe, les serveurs sont très sollicités, et les prix plus élevés permettent de percevoir des frais supplémentaires. Pendant les heures creuses, les serveurs sont moins utilisés, et les prix bas attirent des développeurs moins pressés ou des étudiants qui effectuent des tâches en masse. Ainsi, les ressources inutilisées sont mises à profit, augmentant l'efficacité globale des serveurs et les profits.
5. La fin de la concurrence tarifaire basée sur le gaspillage de ressources et l'entrée dans une concurrence différenciée
Les années précédentes, les fabricants de grands modèles se sont affrontés en baissant les prix de manière agressive (par exemple, en offrant des licences illimitées pour 9,99 yuans ou même gratuitement), mais cela ne menait souvent qu'à un gaspillage de ressources et à l'abandon des services par les utilisateurs. Avec cette nouvelle stratégie de DeepSeek, il n'est plus nécessaire de sacrifier des profits pour attirer les utilisateurs. Les produits peuvent être divisés en deux catégories : les modèles haut de gamme à forte performance vendus à des prix élevés pour les grandes entreprises, et les modèles à faible coût et à bonne performance vendus à des prix abordables pour les petits développeurs et les particuliers. D'autres fabricants suivront probablement cette approche, rendant les interfaces AI plus accessibles et les prix plus stables. Les interfaces gratuites disparaîtront progressivement, et les prix deviendront plus justes et prévisibles.