Pagar a la IA por contenido: lo que cuesta de verdad en 2026
Todos nos hemos acostumbrado a delegar los artículos en la IA. Esa costumbre trae factura. Esto es lo que cuesta realmente un artículo de longitud media en las principales APIs en agosto de 2026 — y el momento en que esa factura deja de tener sentido.
El precio de lista
Los precios son por 1M de tokens en USD, verificados en agosto de 2026 contra las páginas de precios de los proveedores. La tabla ha vuelto a renovarse en el único mes transcurrido desde nuestra edición de julio — consulta las páginas de los proveedores antes de presupuestar un pipeline.
| Proveedor | Modelo | Input | Output |
|---|---|---|---|
| Anthropic | Claude Fable 5 (buque insignia) | $10 | $50 |
| Claude Opus 5 | $5 | $25 | |
| Claude Sonnet 5 (gama media) | $3 | $15 | |
| Claude Haiku 4.5 (económico) | $1 | $5 | |
| OpenAI | GPT-5.5 Pro (buque insignia) | $30 | $180 |
| GPT-5.6 Sol | $5 | $30 | |
| GPT-5.6 Terra (gama media) | $2 | $12 | |
| GPT-5.6 Luna (económico) | $0.20 | $1.20 | |
| Gemini 3.1 Pro | $2.00 | $12 | |
| Gemini 3.7 Flash | $0.75 | $3.75 | |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | |
| xAI | Grok 4.6 | $2 | $6 |
| Grok 4.3 | $1.25 | $2.50 | |
| DeepSeek | V4 Pro (off-peak) | $0.66 | $1.98 |
| V4 Flash (off-peak) | $0.22 | $0.66 | |
| Alibaba | Qwen3.8 Max | $2 | $6 |
| Qwen3.7 Plus | $0.32 | $1.28 | |
| Qwen3.7 Flash | $0.03 | $0.13 | |
| Moonshot | Kimi K3 | $3 | $15 |
| Kimi K2.5 | $0.60 | $3.00 | |
| Mistral | Medium 3.5 | $1.50 | $7.50 |
| Large 3 | $0.50 | $1.50 | |
| Small 4 | $0.15 | $0.60 |
Mistral es el único bloque que no se movió este mes — el resto de precios de los demás proveedores de arriba son nuevos desde julio, y Kimi de Moonshot se suma a la tabla por primera vez (su buque insignia K3 llega justo al precio de Claude Sonnet 5). El output sale entre 2–6× más caro que el input en todos los niveles. Eso importa: un artículo largo es sobre todo tokens de output. Un brief corto con un system prompt largo es sobre todo input. Hay más notas al pie que nunca sobre las cifras del titular — el precio introductorio de Claude Sonnet 5 ($2/$10) termina el 2026-08-31; Gemini 3.7 Flash también es introductorio ($1.50/$7.50 a partir de enero de 2027); Gemini 3.1 Pro y Grok 4.6 prácticamente duplican su precio por encima de un contexto de 200K tokens ($4/$18 y $4/$12); DeepSeek se factura según el reloj — la tabla muestra el precio off-peak, y en las horas punta (01:00–04:00 y 06:00–10:00 UTC) se duplica; y Qwen3.7 Flash está escalonado por la longitud de la petición ($0.03/$0.13 por debajo de 32K tokens, hasta $0.20/$0.80).
Lo que cuesta un artículo de verdad
Un artículo de longitud media — unas 2,500 palabras — se sitúa en torno a 3,000 tokens de input (system prompt, brief, indicaciones de plantilla, material de origen) y 3,500 tokens de output (~2,500 palabras). Con esas cifras:
| Modelo | Lista por artículo | Con cache (descuento de lectura) | Con cache + batch |
|---|---|---|---|
| GPT-5.5 Pro | ~$0.72 | n/a | ~$0.36 |
| Claude Fable 5 | ~$0.21 | ~$0.18 | ~$0.089 |
| GPT-5.6 Sol | ~$0.12 | ~$0.11 | ~$0.053 |
| Claude Opus 5 | ~$0.10 | ~$0.089 | ~$0.045 |
| Claude Sonnet 5 | ~$0.062 | ~$0.053 | ~$0.027 |
| Kimi K3 | ~$0.062 | ~$0.053 | n/a |
| GPT-5.6 Terra | ~$0.048 | ~$0.043 | ~$0.021 |
| Gemini 3.1 Pro | ~$0.048 | ~$0.043 | ~$0.021 |
| Mistral Medium 3.5 | ~$0.031 | ~$0.027 | ~$0.013 |
| Qwen3.8 Max | ~$0.027 | ~$0.024 | ~$0.014 (solo batch) |
| Grok 4.6 | ~$0.027 | ~$0.023 | ~$0.018 (batch −20%) |
| Claude Haiku 4.5 | ~$0.021 | ~$0.018 | ~$0.009 |
| Gemini 3.7 Flash | ~$0.015 | ~$0.013 | ~$0.0067 |
| Kimi K2.5 | ~$0.012 | n/a | ~$0.0074 (batch −40%) |
| Gemini 3.5 Flash-Lite | ~$0.0097 | ~$0.0088 | ~$0.0044 |
| DeepSeek V4 Pro (off-peak) | ~$0.0089 | ~$0.0070 | n/a |
| Mistral Large 3 | ~$0.0068 | ~$0.0054 | ~$0.0027 |
| GPT-5.6 Luna | ~$0.0048 | ~$0.0043 | ~$0.0021 |
| DeepSeek V4 Flash (off-peak) | ~$0.003 | ~$0.0023 | n/a |
| Mistral Small 4 | ~$0.0026 | ~$0.0021 | ~$0.0011 |
| Qwen3.7 Flash | ~$0.00055 | n/a | ~$0.00027 |
Un nivel económico como Luna, Gemini Flash-Lite o Haiku deja el artículo en un par de céntimos a precio de lista. Qwen3.7 Flash se queda cerca de una veinteava parte de un céntimo — el nuevo suelo ahora que la repreciación de DeepSeek lo sacó de ese puesto. Un buque insignia real como GPT-5.5 Pro cuesta aproximadamente 1,300× lo que Qwen Flash y 12–15× lo que una gama media como Sonnet 5 o GPT-5.6 Terra.
Los descuentos que de verdad aplican
Dos mecanismos importan a quien produce contenido con IA a volumen — y ambos se han vuelto más condicionales otra vez este mes:
- Prompt caching. Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot y Mistral descuentan todos las lecturas del input cacheado — normalmente un 90% (Anthropic, OpenAI, Google, Mistral, Moonshot), un 75% (xAI), y alrededor de un 97% en DeepSeek, cuyo precio de cache-hit sigue siendo la mayor palanca de esta página incluso después de la repreciación de agosto. La trampa está en el otro lado: las escrituras en cache llevan recargo (Anthropic factura 1.25× con un TTL de 5 minutos y 2× con uno de una hora; OpenAI añadió un cargo de escritura de 1.25× en la familia GPT-5.6), y Google cobra almacenamiento por hora. El cache solo compensa cuando de verdad relees el prefijo cacheado unas cuantas veces.
- Batch API. Anthropic, OpenAI, Google, Alibaba y Mistral ofrecen un 50% de descuento en trabajos asíncronos que terminan en 24 horas. Ya no es un 50% universal: xAI descuenta solo un 20%, Moonshot factura el batch al 60% de lista (−40%, y ni siquiera incluye su buque insignia K3 en la página de batch), Alibaba no permite combinar batch y cache en la misma petición, y el descuento de DeepSeek es el reloj, no una cola — la repreciación del 16 de agosto trajo de vuelta la facturación peak/off-peak, con el off-peak (la mayor parte del día) a la mitad de la tarifa punta.
Los dos se acumulan allí donde ambos existen. Batch + cache te deja aproximadamente un 95% por debajo de lista en input y un 50% en output. Si generas contenido en lotes programados con un system prompt fijo, deberías estar usando los dos.
Las cuentas a escala
Toma un modelo de gama media razonable — Claude Sonnet 5 a precio de lista, $0.062 por artículo:
| Volumen | Solo IA (regenerar cada vez) | Plantilla con IA una vez + renders locales |
|---|---|---|
| 1 artículo | $0.06 | $0.06 |
| 100 artículos | ~$6.15 | ~$0.06 |
| 1,000 artículos | ~$61.50 | ~$0.06 |
| 10,000 artículos | ~$615 | ~$0.06 |
Frente a un buque insignia como GPT-5.5 Pro la brecha se abre más: 10,000 artículos cuestan unos $7,200 a precio de lista, frente al coste de generar una buena plantilla (bastante por debajo de $1) y pasarla por un renderizador local gratis. Ese es el momento en que la factura deja de tener sentido.
El catálogo rota más rápido que tu plan de contenidos
Hay un segundo coste que no aparece en ninguna página de precios. Todos los modelos citados en la edición de abril de 2026 de este artículo — GPT-5.4, Gemini 3 Flash, Grok 4, DeepSeek V3 y R1, Qwen3 Max, Mistral Small 3.1, Claude Opus 4.7 y Sonnet 4.6 — han sido desde entonces renombrados, sustituidos o marcados como obsoletos. Tres meses. OpenAI abandonó los niveles numéricos por nombres propios (Sol / Terra / Luna). DeepSeek retiró directamente los alias deepseek-chat y deepseek-reasoner.
La edición de julio apenas sobrevivió un mes. Desde entonces: Anthropic lanzó Claude Opus 5 (2026-07-24) y el Opus que figuraba en la tabla pasó a ser la generación anterior; OpenAI recortó GPT-5.6 Terra un 20% y Luna un 80% (2026-07-30); Google lanzó Gemini 3.6 Flash y después 3.7 Flash con cinco semanas de diferencia; xAI lanzó Grok 4.6 (2026-08-12); Alibaba sustituyó Qwen3.7 Max por Qwen3.8 Max (2026-08-03); y DeepSeek subió los precios hasta un 1,100% en horas punta (2026-08-16), reintroduciendo la facturación según la hora del día que había abandonado con V4. Un mes; seis de los siete proveedores cambiaron su lista de precios.
Si tu pipeline de contenido llama a un modelo en cada render, cada uno de esos cambios es una migración: nuevos IDs de modelo, prompts reajustados, costes recalculados y un texto que se lee distinto al del trimestre pasado. Si tu pipeline llama al modelo una sola vez para redactar una plantilla y luego renderiza en local, nada de eso te toca. La rotación de modelos es un argumento a favor de la plantilla, no solo una molestia.
Cuándo conviene pagar por artículo
No todos los artículos son repetición. Pagar la factura de la API tiene sentido para:
- piezas editoriales únicas con voz o enfoque propios;
- temas nuevos que nunca has cubierto, donde el modelo investiga de verdad;
- reportajes largos donde el matiz importa más que el volumen;
- borradores que vas a editar a mano de forma intensa de todos modos.
Para este tipo de trabajo quieres el mejor modelo que puedas permitirte. La calidad de un buque insignia se paga sola en tiempo de edición ahorrado.
Cuándo conviene pagar una vez y renderizar muchas
Las cuentas se invierten en cuanto tienes que producir la misma forma de artículo más de unas pocas veces:
- páginas de producto a lo largo de un catálogo de SKUs;
- variantes localizadas por idiomas y regiones;
- landings SEO para una lista larga de keywords;
- sitios de marketing SaaS multi-tenant que comparten estructura;
- cualquier cosa donde la estructura es constante y los datos cambian.
Aquí, pagar por render es puro desperdicio. Escribe la plantilla una vez con IA y luego delega el renderizado a una herramienta que lo hace gratis.
El flujo híbrido
Este es el flujo de trabajo para el que está hecho Spintax:
- Paga al buque insignia una vez. Usa el mejor modelo que puedas permitirte — Fable 5, Opus 5, GPT-5.6 Sol, Gemini 3.1 Pro — para redactar la plantilla. Pagas $0.05–$1 y obtienes una plantilla de alta calidad, gramaticalmente segura y multivariante.
- Renderiza para siempre, en local. Spintax resuelve la plantilla en tu CPU. Miles de variantes cuestan prácticamente cero.
- Actualiza cuando cambie el significado. Regenera la plantilla solo cuando cambian los datos o el posicionamiento — no cuando el proveedor renombra un modelo. Para un producto estable, eso puede ser trimestral.
Pagas por calidad donde importa. Dejas de pagar por cantidad.
Advertencias
- Los precios cambian, y los nombres también. La tabla de arriba se renovó por completo entre abril y julio de 2026 — y volvió a hacerlo entre julio y agosto. Vuelve a revisar las páginas de los proveedores antes de presupuestar, y nunca dejes fijo en el código un ID de modelo que no hayas reverificado este trimestre.
- Escribir en cache no es gratis. El “90% de descuento” del titular se aplica a las lecturas de cache. Anthropic y OpenAI facturan un extra por la escritura, y Google cobra almacenamiento por hora. Un cache que se lee una sola vez es más caro que no tener cache.
- El batch no es un 50% universal. xAI es un 20%. Moonshot es un 40% y excluye su buque insignia. Alibaba se niega a combinar batch con cache. El descuento de DeepSeek es la hora del día, no una cola de batch. No des por hecho el apilado de descuentos antes de comprobarlo.
- El contexto largo cuesta extra en algunos proveedores. Los niveles Gemini Pro y Grok 4.6 casi duplican su precio pasados los 200K tokens. Anthropic y OpenAI cobran tarifas planas en toda su ventana de contexto.
- La calidad no es la misma en todos los niveles. Los niveles económicos sirven para andamiaje y reescrituras. La voz matizada, la fidelidad con contexto largo y el anclaje factual siguen favoreciendo al buque insignia. Usa modelos baratos para los renders locales, no para la plantilla en sí.
Qué leer a continuación
¿Listo para convertir una buena generación de IA en miles de renders? Empieza por la serie de redacción:
La serie de guías de redacción está disponible solo en inglés.
Fuentes de datos: páginas de precios de Anthropic, OpenAI, Google, xAI, DeepSeek, Alibaba, Moonshot, Mistral — verificadas el 2026-08-20. Los cálculos por artículo asumen 3,000 tokens de input + 3,500 tokens de output por artículo.