Costo API ChatGPT, Claude y Gemini por tokens 2026
Calculá el costo mensual de APIs LLM (Claude, GPT-4o, Gemini) por tokens. Precios 2026 actualizados, comparativa y tips para reducir hasta 90% el gasto.
- Datos verificados · junio de 2026
- Editado por Martín Rodríguez
- Fórmula verificada con pruebas automatizadas
- Cálculo privado en tu dispositivo
Ver cálculo paso a paso
Ver el paso a paso de esta cuenta
Ver detalle período a período
Cómo usar esta calculadora
Usá los pasos de esta herramienta y revisá debajo la fórmula, los supuestos y sus límites.
Avisame cuando cambie este dato
Te mandamos un solo mail cuando Anthropic API Pricing publique el dato nuevo que usa esta calculadora. Nada más.
Gratis · Sin spam · Salís con un click
Calculadora específica para Argentina. Las leyes, escalas y valores son los vigentes en Argentina (ARCA, BCRA, ANSES).
El dato clave que la mayoría subestima: en español, 1 token equivale a apenas 0,5 palabras en promedio, contra 0,75 en inglés. Eso significa que si tu app habla en castellano, tus prompts y respuestas consumen entre 30% y 50% más tokens que el mismo texto en inglés. Un sistema de soporte con respuestas de 200 palabras en español puede estar mandando 400 tokens de output por llamada, no 150.
Esta calculadora te permite proyectar el costo diario, mensual y anual en base a tu volumen real de llamadas, el tamaño de tus prompts y el precio del modelo que estás evaluando. Viene cargada con los precios vigentes de 2026 para Claude Sonnet 4, Claude Haiku 4, GPT-4o, GPT-4o-mini y Gemini 1.5 Pro, y te ayuda a comparar escenarios antes de comprometerte con una arquitectura.
Lo que no te va a decir la documentación oficial de Anthropic u OpenAI es cuánto impacta la diferencia de idioma en tu caso concreto, o qué pasa cuando tu sistema prompt de 3.000 tokens se repite en cada llamada multiplicado por 50.000 usuarios. Eso es exactamente lo que esta calculadora te muestra con tus propios números.
Cuándo usar esta calculadora
- Un developer argentino lanza un chatbot de soporte en español: 500 tokens in (system prompt + historial) y 200 tokens out por consulta, 3.000 llamadas/día con GPT-4o. El costo mensual ronda USD 150, viable para SaaS con plan pago.
- Una agencia de marketing evalúa Claude Haiku 4 vs. Claude Sonnet 4 para generar copies: Haiku a USD 0,80/MTok in resulta 10x más barato que Sonnet para tareas simples de 300 tokens out.
- Una startup de legaltech procesa contratos con RAG: 8.000 tokens in (documento + contexto) y 600 tokens out por análisis, 200 análisis/día. Con Gemini 1.5 Pro el costo mensual es USD 360 vs. USD 720 con GPT-4o.
- Un equipo de data enrichment corre 50.000 clasificaciones diarias no interactivas: con Batch API de OpenAI al 50% de descuento, pagan USD 225/mes con GPT-4o-mini en lugar de USD 450.
- Una app de e-learning con system prompt fijo de 12.000 tokens habilita prompt caching en Claude: el costo de input cae de USD 36 a USD 3,60 por cada 1.000 llamadas, ahorrando USD 970/mes a 30k calls diarias.
- Un freelancer que factura en pesos evalúa viabilidad: USD 80/mes de API equivale a $120.000 ARS al tipo de cambio oficial de referencia (BCRA), que puede recuperar con tan solo 3 clientes en un proyecto de automatización.
- Una empresa de RRHH usa GPT-4o para screening de CVs: 2.000 tokens in y 400 tokens out por CV, 1.500 CVs/día. El costo mensual es USD 285, y cambiar a GPT-4o-mini lo baja a USD 18,50 sin pérdida de precisión en clasificación básica.
- Un equipo de DevOps proyecta el costo anual antes de presentar el budget: USD 200/mes con Claude Sonnet 4 se convierte en USD 2.400 anuales, lo que justifica priorizar prompt caching desde el día uno del desarrollo.
Precios de API por millón de tokens (USD, 2026)
| Modelo | Input (USD/MTok) | Output (USD/MTok) | Cache read (USD/MTok) |
|---|---|---|---|
| Claude Opus 4 | 15,00 | 75,00 | 1,50 |
| Claude Sonnet 4 | 3,00 | 15,00 | 0,30 |
| Claude Haiku 4 | 0,80 | 4,00 | 0,08 |
| GPT-4o | 2,50 | 10,00 | 1,25 |
| GPT-4o-mini | 0,15 | 0,60 | 0,075 |
| Gemini 1.5 Pro | 1,25 | 5,00 | 0,3125 |
| Gemini 1.5 Flash | 0,075 | 0,30 | 0,01875 |
Fuente: Anthropic (anthropic.com/pricing) y OpenAI (openai.com/api/pricing), precios vigentes 2026. MTok = millón de tokens.
Cómo funciona
Cómo se calcula
Costo por llamada = (tokens_in / 1M × precio_in) + (tokens_out / 1M × precio_out). Multiplicá por llamadas/día × 30 para el mensual.
1 token ≈ 4 caracteres en inglés, ~3 en español. Un prompt de 500 palabras ES ≈ 900-1.100 tokens. Una respuesta de 300 palabras ≈ 500-600 tokens.
Tabla de precios (USD por millón de tokens, 2026)
| Modelo | Input | Output | Cache read |
|---|---|---|---|
| Claude Opus 4 | 15.00 | 75.00 | 1.50 |
| Claude Sonnet 4 | 3.00 | 15.00 | 0.30 |
| Claude Haiku 4 | 0.80 | 4.00 | 0.08 |
| GPT-4o | 2.50 | 10.00 | 1.25 |
| GPT-4o-mini | 0.15 | 0.60 | 0.075 |
| Gemini 1.5 Pro | 1.25 | 5.00 | 0.3125 |
| Gemini 1.5 Flash | 0.075 | 0.30 | 0.01875 |
Batch API: típicamente 50% off. Prompt caching en Claude: 90% off en reads repetidos.
Casos típicos
Errores comunes
Ejemplo de cálculo
Preguntas frecuentes
¿Cómo se calcula exactamente el costo de una llamada a la API?
¿Cuáles son los precios actuales de los modelos más usados en 2026?
¿Por qué en español gasto más tokens que en inglés?
¿Qué es el prompt caching y cuánto ahorra en la práctica?
¿Qué es Batch API y para qué tipo de tareas conviene?
¿Cómo cuento exactamente los tokens de mi prompt antes de mandarlo?
import tiktoken; enc = tiktoken.get_encoding('o200k_base'); len(enc.encode(texto)). Anthropic: endpoint POST /v1/messages/count_tokens que devuelve el conteo exacto antes de enviar, o el paquete anthropic-tokenizer. Google: método model.count_tokens() del SDK oficial. Conteo aproximado rápido si no querés usar código: dividí la cantidad de caracteres por 4 para inglés, o por 3 para español. Esto da un estimado con ±15% de error, útil para presupuestos, no para facturación exacta.¿El streaming afecta el costo? ¿Y los reintentos automáticos?
¿Hay límites gratuitos o créditos para arrancar a desarrollar?
¿Cuánto puede llegar a costar en pesos argentinos y cómo se factura?
¿Cuándo conviene cambiar de modelo más caro a uno más barato?
¿Cómo se manejan los errores de contexto muy largo? ¿Pago aunque falle?
¿Qué otras estrategias concretas existen para reducir el costo mensual?
Fuentes y referencias
Metodología y confianza
Calculadora de tecnología con fórmula verificada automáticamente contra Anthropic API Pricing, según nuestra política editorial y metodología.
Actualizado: junio de 2026. Los parámetros se verifican periódicamente con las fuentes citadas.
Los cálculos corren 100% en tu navegador. No guardamos ni transmitimos tus datos.
Resultados orientativos. Para decisiones críticas, consultá con un profesional.
Rodríguez, M. (2026). Costo API ChatGPT, Claude y Gemini por tokens 2026. Hacé Cuentas. https://hacecuentas.com/calculadora-costo-tokens-api-openai-claude-mensual
Contenido bajo licencia CC-BY 4.0 — reutilizable citando la fuente con enlace a Hacé Cuentas.