Aller au contenu
Chandler Nguyen
IA6 min de lecture

Ma facture IA est passée de $200/mois à $45. J'ai livré plus, pas moins.

Juin  : $57.01. Juillet  : $33.09. Deux mois après être passé à DeepSeek V4 Pro via OpenCode, mes coûts IA ont chuté de 75  %. L'historique de commits le prouve  : j'ai livré plus, pas moins — 786 commits sur 4 produits. Voici le détail complet.

J'ai payé Anthropic US$1,892.38 sur 13 mois. C'était Claude Code Max à $200 par mois, plus $20-100 supplémentaires pour Codex d'OpenAI. Au total, entre $200 et $300 chaque mois, uniquement pour les outils IA.

J'ai résilié Claude Max en avril. J'en ai écrit — plusieurs fois. Chaque post était une tentative honnête de comprendre à quoi ressemblait la bonne config, alors que les outils changeaient sans cesse sous mes pieds.

Il y a deux mois, j'ai complètement arrêté le double usage. Je suis passé à un seul modèle — DeepSeek V4 Pro avec High Thinking — via un seul outil de codage. Voici ce qui s'est réellement passé.

Juin  : $57.01. Juillet  : $33.09.

Facture DeepSeek juin 2026

Ma facture DeepSeek de juin  : 4,1 milliards de tokens traités, $57.01 au total.

Facture DeepSeek juillet 2026

Juillet  : 2,1 milliards de tokens, $33.09. La baisse s'explique en partie parce que j'ai terminé un énorme projet de localisation en juin, et en partie parce que je me suis amélioré en prompt engineering — des prompts plus courts, moins de retries, une qualité de sortie identique.

Les deux mois cumulés  : $90.10. C'est moins de la moitié de ce que je payais pour un seul mois de Claude Max. Moins d'un tiers si on ajoute l'abonnement Codex par-dessus.

La question que tout le monde pose quand tu réduis tes coûts de 75  % est  : « As-tu ralenti  ? » Voici la réponse.

786 commits. 4 produits. Aucun ralentissement.

Je suis mon travail avec git. Ce n'est pas une métrique de productivité parfaite — le nombre de lignes ne veut rien dire, et un seul commit peut représenter n'importe quoi, d'une correction de typo à une migration de base de données. Mais directionnellement, ça raconte quelque chose de réel.

Entre le 1er juin et le 31 juillet 2026, sur les quatre produits que je maintiens  :

  • DIALOGUE (plateforme de podcasts)  : 382 commits. Lancé un réseau de podcasts Coupe du Monde en 6 langues avec publication automatisée vers YouTube, Spotify et Apple Podcasts. Construit un calendrier de contenu SEO de 41 posts. Fait tourner un framework d'évaluation complet du pipeline avec 40 épisodes et un juge LLM notant 7 dimensions par épisode.

  • chandlernguyen.com (ce site + Ask Sydney)  : 168 commits. Localisé entièrement un cours de 7 modules en japonais. Construit un framework d'évaluation Sydney de 30 questions avec notation LLM-as-judge. Restructuré le prompt système de Sydney de zéro. Refondu la page d'accueil.

  • Prova (coach AI builder)  : 228 commits. Livré des séquences de cursus unifiées sur trois personas. Construit une expérience native iPad avec drag-and-drop. Ajouté la synchronisation des brouillons multi-appareils et des parcours de reset pilotés par brief.

  • STRAŦUM (intelligence marketing)  : 8 commits. Période calme. Parfois, ne pas livrer est la bonne décision.

Je ne ralentissais pas. Si quoi que ce soit, j'accélérais — 786 commits en deux mois, c'est ma période la plus productive depuis que j'ai commencé à construire en public en 2023.

Le modèle  : DeepSeek V4 Pro avec High Thinking

Le modèle que j'utilise n'est pas l'option la moins chère de DeepSeek. V4 Flash coûte $0.14 par million de tokens en entrée (cache miss) et $0.28 par million en sortie. J'ai utilisé la version Pro — $0.435 par million en entrée, $0.87 par million en sortie — avec le mode High Thinking activé. Pas la config la moins chère. Je devrais sans doute passer à Flash — c'est encore moins cher. Mais quand la facture totale est de $33, l'urgence n'y est tout simplement pas.

Je vais utiliser davantage Flash à partir de maintenant. Mais ça en dit long sur la psychologie des outils bon marché  : quand le coût est assez bas, tu arrêtes d'optimiser. Tu construis, c'est tout.

Le multiplicateur de cache dont personne ne parle

Voici la partie la plus importante, celle qui rend possibles les chiffres du titre ci-dessus.

OpenCode, l'outil de codage que j'utilise, gère un cache de prompts DeepSeek. Mon taux de cache hit tourne à 90-95  %+. Ce qui transforme complètement l'économie  :

Type de tokensPrix par million de tokens
Entrée (cache miss)$0.435
Entrée (cache hit)$0.003625
Sortie$0.87

Les tokens d'entrée en cache hit coûtent 120 fois moins cher que les tokens en cache miss. Avec un cache hit de 90  %+, ton coût d'entrée effectif devient une erreur d'arrondi. L'essentiel de ce que tu payes, c'est la sortie — le code réellement généré, les réponses réelles. C'est l'architecture qui rend la facture à $33/mois possible, même avec une utilisation intensive.

Sans le cache, 4,1 milliards de tokens d'entrée à $0.435/M coûteraient environ $1,780 — rien que pour juin. Avec 95  % de cache hit, le coût d'entrée effectif tombe à environ $7. Le modèle est bon marché. Le cache le rend gratuit.

À quoi ressemble la qualité à ce prix

La question honnête  : est-ce que DeepSeek V4 Pro produit la même qualité que ce que j'obtenais avec le combo Claude Max + Codex à $200/mois  ?

La réponse  : ça dépend de ce que tu mesures, mais pour mes workloads, l'écart est faible et se resserre.

Sur les tâches de codage  : OpenCode + DeepSeek gère le même éventail de travail que je faisais avec Claude Code et Codex — TypeScript, React, Next.js, FastAPI, Python, Swift, migrations de base de données, configs YAML, scripts shell. La différence d'efficacité token que j'avais notée avec Codex (environ 3x moins de tokens que Claude pour un travail équivalent, comme je le mentionnais dans mes posts de mars) se retrouve ici aussi, d'une autre façon — DeepSeek est plus concis. Moins de commentaires, plus de code.

Sur les tâches d'écriture  : j'utilise le même modèle DeepSeek pour écrire — posts de blog, contenu de cours, prompts système — directement dans OpenCode. Le cycle d'édition est différent de ce à quoi Claude m'avait habitué. Le style par défaut de Claude est plus léché  ; DeepSeek est plus direct. Ni l'un ni l'autre n'est meilleur. Tu adaptes tes prompts.

Sur l'évaluation de Sydney  : après avoir basculé Ask Sydney sur DeepSeek, j'ai fait tourner une évaluation de 30 questions avec un juge LLM. Les résultats  : la qualité de récupération était inchangée, la précision des citations atteignait en moyenne 4.2/5, et la fidélité vocale — à quel point Sydney sonne comme moi — a obtenu 4.4/5. Ce qui demandait du travail, c'était l'ancrage des sources sur les sujets finance et santé, mais c'était une correction de prompt engineering, pas un problème de qualité du modèle. J'ai resserré le prompt système — ajouté une règle exigeant au moins une citation de post de blog par affirmation majeure sur les sujets sensibles — et redéployé.

Le pattern que j'ai observé sur DIALOGUE comme sur Ask Sydney est le même  : à ce niveau de prix, le prompt engineering pèse plus lourd. Quand tu payes $200 par mois à Claude, tu peux te permettre que le modèle se débrouille tout seul. Quand tu payes $33, tu dois être plus précis. La bonne nouvelle  : le modèle suit les instructions.

Un seul outil, un seul modèle. La simplification mentale dont personne ne parle.

Ce que les gens remarquent, c'est l'argent économisé. Le changement qui compte le plus  : quand tu arrêtes de gérer plusieurs abonnements et chaînes d'outils, tu récupères de la bande passante mentale.

Ma config d'avril, c'était Claude Code pour l'architecture et le frontend, Codex pour l'implémentation, et l'API de Claude pour le pipeline de podcasts de DIALOGUE. Trois flux d'authentification différents. Trois comportements de rate limit différents. Trois pages d'abonnement à vérifier quand quelque chose cessait de fonctionner.

Le double usage ne me manque pas. Pas du tout. Un outil, un modèle, un seul modèle mental du comportement du système. J'ouvre OpenCode. Je tape. Ça marche.

C'est le seuil qui compte. Pas « est-ce meilleur ». Mais  : « est-ce assez bon pour que le prix disparaisse en tant que variable. »

La réalité des prix — et ce qui vient ensuite

La tarification actuelle de DeepSeek inclut cette note  :

Nous prévoyons d'augmenter prochainement la tarification globale des services API DeepSeek, avec une hausse significative attendue.

Les prix vont augmenter. Ils augmentent toujours. Le mois à $33 ne restera pas à $33 éternellement. Mais le pattern — assez bon marché pour que tu arrêtes d'optimiser, des taux de cache hit qui transforment les coûts d'entrée en erreurs d'arrondi, un prompt engineering qui comble l'écart de qualité —, lui, est durable.

Deux mois, $90.10 au total, 786 commits. Je ne reviendrai pas à des chaînes d'outils à $300/mois, sauf si quelque chose m'y force. Et je vais utiliser davantage Flash — parce qu'à ce stade, pourquoi pas  ?

Toujours en train de coder, toujours en train d'apprendre, toujours en train de livrer (pour $45 par mois).

À bientôt, Chandler  :P