Calculadora de coste de API de IA
Estima cuánto te costará usar la API de los principales modelos de IA. Introduce los tokens por petición y el número de peticiones.
Coste estimado
Comparte el enlace y se abrirá con estos mismos valores.
Tabla de precios por millón de tokens
Precios en USD. Última verificación: 11 de julio de 2026.
| Modelo | Proveedor | Entrada / 1M | Salida / 1M |
|---|---|---|---|
| Claude Fable 5 | Anthropic | 10 $ | 50 $ |
| Claude Opus 4.8 | Anthropic | 5 $ | 25 $ |
| Claude Sonnet 5 | Anthropic | 3 $ | 15 $ |
| Claude Haiku 4.5 | Anthropic | 1 $ | 5 $ |
| GPT-5.6 Sol | OpenAI | 5 $ | 30 $ |
| GPT-5.6 Terra | OpenAI | 2.5 $ | 15 $ |
| GPT-5.6 Luna | OpenAI | 1 $ | 6 $ |
| GPT-5.2 | OpenAI | 1.75 $ | 14 $ |
| Gemini 3.1 Pro | 2 $ | 12 $ | |
| Gemini 3.5 Flash | 1.5 $ | 9 $ | |
| Gemini 3.1 Flash-Lite | 0.25 $ | 1.5 $ |
Por qué se cobra la entrada y la salida por separado
Entrada es todo lo que le mandas al modelo: la pregunta, las instrucciones y cualquier documento o historial que adjuntes. Salida es lo que responde. Se facturan por separado porque generar cuesta más que leer, y la salida suele valer entre tres y cinco veces más por token. Si tu servicio produce textos largos, ahí se va la mayor parte del gasto aunque las preguntas sean cortas.
El coste que casi nadie estima bien
En una conversación, cada mensaje reenvía todo el historial anterior como entrada. Una charla de treinta turnos no cuesta treinta peticiones sino bastante más, porque la última vuelve a mandar la conversación entera. Lo mismo pasa con el prompt de sistema: esas instrucciones fijas de 500 tokens se pagan en cada llamada, no una vez. Al presupuestar, multiplica por el número de turnos, no por el de usuarios.
Cómo bajar la factura sin perder calidad
Lo que más ahorra es probar primero un modelo pequeño: para clasificar, extraer datos o resumir dan un resultado equivalente por una fracción del precio, y solo tiene sentido subir a uno grande donde de verdad haga falta razonar. Después van dos cosas: resumir los turnos antiguos en vez de reenviar la conversación completa, y pedir respuestas de la longitud que necesitas, porque «sé breve» se traduce directamente en dinero.
Ten en cuenta además que el español consume alrededor de un 20-30 % más de tokens que el inglés para decir lo mismo, así que un servicio con el mismo volumen sale más caro en castellano. Puedes comprobarlo con tu propio texto en el contador de tokens.