Saltar al contenido
Chandler Nguyen
IA6 min de lectura

Mi factura de AI bajó de $200/mes a $45. Entregué más, no menos.

Junio: $57.01. Julio: $33.09. Dos meses después de cambiarme a DeepSeek V4 Pro mediante OpenCode, mis costos de AI bajaron un 75 %. El historial de commits demuestra que entregué más, no menos: 786 commits en 4 productos. Aquí está el desglose completo.

Le pagué a Anthropic US$1,892.38 a lo largo de 13 meses. Eso era Claude Code Max a $200 al mes, más otros $20-100 por Codex de OpenAI. En total, algo entre $200 y $300 cada mes solo en herramientas de AI.

Cancelé Claude Max en abril. Escribí sobre eso — varias veces. Cada post era un intento honesto de entender cómo se veía la configuración correcta mientras las herramientas seguían cambiando bajo mis pies.

Hace dos meses, dejé de usar dos herramientas a la vez por completo. Me cambié a un solo modelo — DeepSeek V4 Pro con High Thinking — a través de un solo harness de codificación. Esto es lo que realmente pasó.

Junio: $57.01. Julio: $33.09.

Facturación de DeepSeek de junio 2026

Mi factura de DeepSeek de junio: 4.1 mil millones de tokens procesados, $57.01 en total.

Facturación de DeepSeek de julio 2026

Julio: 2.1 mil millones de tokens, $33.09. La caída se debió en parte a que terminé un proyecto enorme de localización en junio y en parte a que mejoré en prompt engineering — prompts más cortos, menos reintentos, la misma calidad de salida.

Dos meses combinados: $90.10. Eso es menos de la mitad de lo que pagaba por un solo mes de Claude Max. Menos de un tercio si además cuentas la suscripción de Codex.

La pregunta inmediata que todos hacen cuando recortas costos un 75 % es: "¿Bajaste el ritmo?" Aquí está la respuesta.

786 Commits. 4 Productos. Cero Desaceleración.

Sigo mi trabajo con git. No es una métrica perfecta de productividad — el número de líneas no significa nada, y un solo commit puede representar desde una corrección de typo hasta una migración de base de datos. Pero en dirección, te dice algo real.

Entre el 1 de junio y el 31 de julio de 2026, en los cuatro productos que mantengo:

  • DIALOGUE (plataforma de podcast): 382 commits. Lancé una red de podcasts del Mundial en 6 idiomas con publicación automatizada a YouTube, Spotify y Apple Podcasts. Construí un calendario de contenido SEO de 41 posts. Ejecuté un framework completo de evaluación del pipeline con 40 episodios y un juez LLM puntuando 7 dimensiones por episodio.

  • chandlernguyen.com (este sitio + Ask Sydney): 168 commits. Localicé por completo un curso de 7 módulos al japonés. Construí un framework de evaluación de Sydney con 30 preguntas y un LLM actuando como juez. Reestructuré el system prompt de Sydney desde cero. Rediseñé la página de inicio.

  • Prova (AI builder coach): 228 commits. Entregué secuencias de currículo unificadas para tres personas. Construí una experiencia nativa para iPad con arrastrar y soltar. Agregué sincronización de borradores entre dispositivos y rutas de reinicio guiadas por brief.

  • STRAŦUM (marketing intelligence): 8 commits. Período tranquilo. A veces no lanzar nada es la decisión correcta.

No estaba reduciendo el ritmo. Si acaso, estaba acelerando — 786 commits en dos meses es mi etapa más productiva desde que empecé a construir en público en 2023.

El Modelo: DeepSeek V4 Pro con High Thinking

El modelo que estoy usando no es la opción más barata de DeepSeek. V4 Flash cuesta $0.14 por millón de tokens de entrada (cache miss) y $0.28 por millón de salida. Usé la versión Pro — $0.435 por millón de entrada, $0.87 por millón de salida — con el modo High Thinking activado. No es la configuración más barata. Probablemente debería cambiarme a Flash — es aún más barata. Pero cuando la factura total es de $33, la urgencia simplemente no está ahí.

Empezaré a usar más Flash de ahora en adelante. Pero eso te dice algo sobre la psicología de las herramientas baratas: cuando el costo es lo suficientemente bajo, dejas de optimizar. Simplemente construyes.

El Multiplicador de la Caché del que Nadie Habla

Aquí está la parte que más importa, y la que hace posibles los números del título de arriba.

OpenCode, el harness de codificación que uso, mantiene una caché de prompt de DeepSeek. Mi tasa de aciertos de caché ronda el 90-95 %+. Eso transforma por completo las matemáticas:

Tipo de tokenPrecio por 1M de tokens
Entrada (cache miss)$0.435
Entrada (cache hit)$0.003625
Salida$0.87

Los tokens de entrada con acierto de caché cuestan 120 veces menos que los tokens sin caché. Con un 90 %+ de aciertos, tu costo efectivo de entrada es un error de redondeo. La mayor parte de lo que pagas es la salida — el código generado, las respuestas reales. Esa es la arquitectura que hace posible pagar $33 al mes con un uso intensivo.

Sin la caché, 4.1 mil millones de tokens de entrada a $0.435/M costarían alrededor de $1,780 — solo en junio. Con un 95 % de aciertos de caché, el costo efectivo de entrada baja a aproximadamente $7. El modelo es barato. La caché lo hace gratis.

Cómo Se Ve la Calidad a Este Precio

La pregunta honesta: ¿produce DeepSeek V4 Pro la misma calidad que obtenía con la combinación de $200/mes de Claude Max + Codex?

La respuesta es: depende de qué midas, pero para mis cargas de trabajo, la brecha es pequeña y se está cerrando.

En tareas de codificación: OpenCode + DeepSeek maneja el mismo rango de trabajo que hacía con Claude Code y Codex — TypeScript, React, Next.js, FastAPI, Python, Swift, migraciones de base de datos, configuraciones YAML, shell scripts. La diferencia de eficiencia de tokens que noté con Codex (aproximadamente 3 veces menos tokens que Claude para el trabajo equivalente, como mencioné en mis posts de marzo) se mantiene aquí también, de otra forma — DeepSeek es más conciso. Recibes menos comentario, más código.

En tareas de escritura: uso el mismo modelo de DeepSeek para escribir — posts del blog, contenido del curso, system prompts — directamente en OpenCode. El ciclo de edición es distinto al que estaba acostumbrado con Claude. El estilo por defecto de Claude es más pulido; DeepSeek es más directo. Ninguno es mejor. Ajustas tus prompts.

En la evaluación de Sydney: después de pasar Ask Sydney a DeepSeek, ejecuté una evaluación de 30 preguntas con un LLM como juez. Los resultados: la calidad de recuperación no cambió, la precisión de las citas promedió 4.2/5, y la fidelidad de voz — qué tan bien suena Sydney como yo — obtuvo 4.4/5. Lo que sí necesitaba trabajo era la base de fuentes en temas de finanzas y salud, pero eso era una corrección de prompt engineering, no un problema de calidad del modelo. Ajusté el system prompt — agregué una regla que exige al menos una cita a un post del blog por cada afirmación importante en temas sensibles — y lo redesplegué.

El patrón que he visto tanto en DIALOGUE como en Ask Sydney es el mismo: a este precio, el prompt engineering pesa más. Cuando le pagas $200 al mes a Claude, puedes permitirte que el modelo resuelva las cosas. Cuando pagas $33, tienes que ser más específico. La buena noticia: el modelo sigue las instrucciones.

Una Herramienta, Un Modelo. La Simplificación Mental de la que Nadie Habla.

El ahorro de costos es lo que la gente nota. El cambio que importa más: cuando dejas de administrar múltiples suscripciones y cadenas de herramientas, recuperas ancho de banda mental.

Mi configuración de abril era Claude Code para arquitectura y trabajo de frontend, Codex para la implementación, y la API de Claude para el pipeline de podcast de DIALOGUE. Tres flujos de autenticación distintos. Tres comportamientos de rate limit distintos. Tres páginas de suscripción que revisar cuando algo dejaba de funcionar.

No extraño usar dos herramientas a la vez. Para nada. Una herramienta, un modelo, un modelo mental de cómo se comporta el sistema. Abro OpenCode. Escribo. Funciona.

Ese es el umbral que importa. No "es mejor." Es: "es lo suficientemente bueno como para que el precio desaparezca como variable."

La Realidad de los Precios — y Qué Pasa Después

La política de precios actual de DeepSeek incluye esta nota:

Planeamos aumentar el precio general de los servicios de API de DeepSeek en un futuro cercano, y se espera un aumento significativo.

Los precios van a subir. Siempre suben. El mes de $33 no se quedará en $33 para siempre. Pero el patrón — tan barato que dejas de optimizar, tasas de acierto de caché que convierten los costos de entrada en errores de redondeo, prompt engineering que cierra la brecha de calidad — es duradero.

Dos meses después, $90.10 en total, 786 commits. No voy a volver a cadenas de herramientas de $300/mes a menos que algo me obligue. Y empezaré a usar más Flash — porque a este punto, ¿por qué no?

Sigo codificando, sigo aprendiendo, sigo lanzando (por $45 al mes).

Un abrazo, Chandler :P