Calculadora de costo API OpenAI por tokens (GPT-4o, o1, mini)
Calculá cuánto te cuesta la API de OpenAI por mes según modelo y volumen de tokens. Tabla de precios GPT-4o, GPT-4o mini, o1 y o1-mini 2026 incluida.
- Datos verificados · junio de 2026
- Editado por Martín Rodríguez
- Fórmula verificada con pruebas automatizadas
- Cálculo privado en tu dispositivo
Ver cálculo paso a paso
Ver el paso a paso de esta cuenta
Ver detalle período a período
Cómo usar esta calculadora
Usá los pasos de esta herramienta y revisá debajo la fórmula, los supuestos y sus límites.
Avisame cuando cambie este dato
Te mandamos un solo mail cuando OpenAI — Pricing oficial publique el dato nuevo que usa esta calculadora. Nada más.
Gratis · Sin spam · Salís con un click
Un token equivale aproximadamente a 4 caracteres del inglés, o algo menos en español (el castellano tokeniza un poco peor, así que tus prompts en español suelen consumir un 15-20% más de tokens que el equivalente en inglés). Y acá está el punto crítico que muchos developers descubren tarde: el output es entre 4 y 6 veces más caro que el input. GPT-4o cobra USD 2,50 por millón de tokens de entrada pero USD 10 por millón de tokens de salida. Si tu sistema genera respuestas largas, el modelo más «barato» puede terminar costando más que uno premium con respuestas cortas y precisas.
Esta calculadora te permite estimar el costo mensual real según tu volumen de tokens de entrada y salida y el modelo que usás. También calcula el costo marginal por request, que es el número que necesitás para decidir si el modelo de negocio cierra.
Cuándo usar esta calculadora
- Un freelance que construye un chatbot de atención al cliente para un e-commerce: 500 interacciones diarias, 300 tokens de input y 400 de output promedio por turno, usando GPT-4o-mini. Resultado: aproximadamente USD 5,40/mes, un costo completamente viable para incluir en un retainer mensual.
- Una startup SaaS que procesa contratos legales con GPT-4o: 200 documentos por día, 8.000 tokens de input por documento y 1.500 de output (resumen). Sin caching, el costo mensual supera los USD 500. Activando prompt caching en el system prompt (≈2.000 tokens fijos), el ahorro puede ser de USD 90/mes.
- Un equipo de data que usa o1-mini para generar código Python de análisis: 50 requests diarios, 1.200 tokens de input y 2.000 de output. A USD 3/MTok input y USD 12/MTok output de o1-mini, el costo mensual ronda USD 11, mucho más barato que o1-full para tareas de código estándar.
- Una agencia que automatiza la generación de copies con GPT-4o: 1.000 copies por mes, promedio 200 tokens de input (brief) y 350 de output (copy). Costo total: menos de USD 5/mes. El modelo se autofinancia con el primer cliente.
- Un developer que evalúa si migrar de GPT-4o a GPT-4o-mini en su app de resumen de noticias: 10.000 requests diarios, 600 tokens in / 300 tokens out. Con GPT-4o el costo mensual es ≈USD 1.800; con GPT-4o-mini baja a ≈USD 108. Si la calidad del resumen es aceptable, el ahorro justifica ampliamente la migración.
- Un emprendedor que planifica el unit economics de su producto: si cobra USD 9,99/mes por usuario y cada usuario genera 200 interacciones mensuales con 400 tokens in / 300 tokens out en GPT-4o-mini, el costo de IA por usuario es ≈USD 0,20/mes, dejando margen operativo saludable.
Precios API OpenAI por millón de tokens (junio 2026)
Tarifas de input y output, y costo de un request típico de 500 tokens in + 300 out.
| Modelo | Input USD/MTok | Output USD/MTok | Costo por 1.000 requests (500 in / 300 out) |
|---|---|---|---|
| GPT-4o mini | 0,15 | 0,60 | USD 0,26 |
| GPT-4o | 2,50 | 10,00 | USD 4,25 |
| o1-mini | 3,00 | 12,00 | USD 5,10 |
| o1 | 15,00 | 60,00 | USD 25,50 |
| GPT-4 Turbo (legacy) | 10,00 | 30,00 | USD 14,00 |
| GPT-3.5 Turbo (legacy) | 0,50 | 1,50 | USD 0,70 |
Costo por 1.000 requests = (500×precio_input + 300×precio_output) ÷ 1.000. GPT-4o es ~16× más caro que GPT-4o mini en el mismo request.
Costo mensual estimado por volumen (ratio 2:1 input/output)
Comparativa GPT-4o mini vs GPT-4o según millones de tokens de entrada por mes.
| Tokens entrada (M) | Tokens salida (M) | GPT-4o mini | GPT-4o |
|---|---|---|---|
| 1 | 0,5 | USD 0,45 | USD 7,50 |
| 5 | 2,5 | USD 2,25 | USD 37,50 |
| 10 | 5 | USD 4,50 | USD 75,00 |
| 50 | 25 | USD 22,50 | USD 375,00 |
| 100 | 50 | USD 45,00 | USD 750,00 |
| 500 | 250 | USD 225,00 | USD 3.750,00 |
Costo = tokens_input_M × precio_input + tokens_output_M × precio_output. Prompt caching (−50% input) y Batch API (−50% total) reducen estas cifras.
Cómo funciona
Cómo se calcula el costo mensual de la API de OpenAI
El modelo de facturación es por tokens: input (prompt) y output (completion) tienen tarifas distintas según modelo. Un token ≈ 4 caracteres ≈ 0,75 palabras en inglés (un 15-25% más en español por la tokenización BPE).
costo_mensual = (tokens_input_M × precio_input) + (tokens_output_M × precio_output)Donde los precios son en USD por millón de tokens (MTok).
Tabla de precios API OpenAI — junio 2026
| Modelo | Input (USD/MTok) | Output (USD/MTok) | Ratio out/in | Caching |
|---|---|---|---|---|
| GPT-4o mini | 0,15 | 0,60 | 4× | Sí |
| GPT-4o | 2,50 | 10,00 | 4× | Sí |
| o1-mini | 3,00 | 12,00 | 4× | Sí |
| o1 | 15,00 | 60,00 | 4× | Sí |
| GPT-4 Turbo (legacy) | 10,00 | 30,00 | 3× | No |
| GPT-3.5 Turbo (legacy) | 0,50 | 1,50 | 3× | No |
Diferencia de costo entre extremos: o1 es 100 veces más caro que GPT-4o mini en input y 100 veces más en output.
Tabla de costos por volumen mensual (GPT-4o mini, ratio 2:1 in/out)
| Tokens entrada (M) | Tokens salida (M) | Costo mensual |
|---|---|---|
| 1 | 0,5 | USD 0,45 |
| 5 | 2,5 | USD 2,25 |
| 10 | 5 | USD 4,50 |
| 50 | 25 | USD 22,50 |
| 100 | 50 | USD 45,00 |
| 500 | 250 | USD 225,00 |
Tabla de costos por volumen mensual (GPT-4o, ratio 2:1 in/out)
| Tokens entrada (M) | Tokens salida (M) | Costo mensual |
|---|---|---|
| 1 | 0,5 | USD 7,50 |
| 5 | 2,5 | USD 37,50 |
| 10 | 5 | USD 75,00 |
| 50 | 25 | USD 375,00 |
| 100 | 50 | USD 750,00 |
| 500 | 250 | USD 3.750,00 |
Optimizaciones de costo más efectivas
1. Prompt caching: 50% de descuento sobre input cacheado en llamadas repetidas con el mismo system prompt (>1.024 tokens).
2. Batch API: 50% de descuento en procesamiento asincrónico (hasta 24 h). Ideal para pipelines offline.
3. Migrar a GPT-4o mini: 16x más barato que GPT-4o si la calidad es aceptable.
4. Truncar el historial de conversación: es el multiplicador oculto más grande en chatbots con múltiples turnos.
5. Limitar max_tokens en el output: evita respuestas innecesariamente largas.
Fuentes
Precios verificados en openai.com/api/pricing (junio 2026). Conteo de tokens con tiktoken. Benchmarks de costo en Artificial Analysis.
Ejemplo real: chatbot con GPT-4o mini
Preguntas frecuentes
¿Cuánto cuesta la API de OpenAI en junio 2026?
¿Qué es un token y cuántos tokens tiene una página de texto?
¿Cuándo conviene usar GPT-4o mini vs GPT-4o?
¿Cuándo conviene usar o1 u o1-mini?
¿Qué es el prompt caching y cuánto ahorra?
¿Qué es la Batch API y cuándo conviene usarla?
¿Cómo afecta el historial de conversación al costo en chatbots?
¿Por qué los textos en español generan más tokens que en inglés?
¿Cómo estimo los tokens de mi caso de uso antes de implementar?
¿Existen alternativas más baratas a la API de OpenAI?
¿Cómo configuro un límite de gasto mensual para no tener sorpresas?
¿Qué son los 'reasoning tokens' de o1 y cómo impactan el costo?
Fuentes y referencias
Metodología y confianza
Calculadora de tecnología con fórmula verificada automáticamente contra OpenAI — Precios oficiales de la API, según nuestra política editorial y metodología.
Actualizado: 12 de junio de 2026. Los parámetros se verifican periódicamente con las fuentes citadas.
Los cálculos corren 100% en tu navegador. No guardamos ni transmitimos tus datos.
Resultados orientativos. Para decisiones críticas, consultá con un profesional.
Rodríguez, M. (2026). Calculadora de costo API OpenAI por tokens (GPT-4o, o1, mini). Hacé Cuentas. https://hacecuentas.com/calculadora-tokens-openai-gpt-costo-uso-mensual
Contenido bajo licencia CC-BY 4.0 — reutilizable citando la fuente con enlace a Hacé Cuentas.