blog/developers·18 ago 2026·5 min·por el equipo de eroq
Créditos vs tokens: precios de IA para productos, no benchmarks
Por qué cobramos la IA generativa en créditos fijos en lugar de medir por token, lo que nos cuesta y cómo modelar tu economía unitaria sobre ello.
Todas las API de IA cobran por tokens porque los tokens son lo que paga el proveedor. Esa lógica es impecable y produce una experiencia pésima para quien desarrolla. Este artículo explica por qué rompimos con ella.
El problema del precio por token
El precio por token traslada a ti la incertidumbre del proveedor. Tu costo por conversación pasa a depender de lo habladores que sean tus usuarios, de cuánto crezcan tus prompts y de lo prolijo que se haya levantado hoy el modelo. Descubres tu economía unitaria después del lanzamiento, en un panel, normalmente por sorpresa.
Para un asistente que responde tickets de soporte, vale: los volúmenes son predecibles. Para un producto con personajes, es hostil: las conversaciones de rol son largas, de temperatura alta y las dirige el usuario. Cuanto mejor funciona tu producto, menos predecible es tu factura.
Lo que nos cuesta el precio fijo
Seamos honestos con el intercambio: el precio fijo significa que nosotros absorbemos la varianza. Una respuesta que llega a nuestro límite de tokens nos cuesta más que una que se para en dos frases, y cobramos los mismos 1 o 3 créditos.
Funciona por tres razones:
- Los límites acotan la varianza.
max_tokensllega como máximo a 1,200 y el contexto a 24k caracteres. Dentro de esos muros, la diferencia entre una llamada barata y una cara es lo bastante pequeña como para promediarla. - Los promedios son estables con volumen. Una conversación es impredecible; diez mil son una distribución. Ponemos el precio sobre la distribución y la volvemos a medir cada mes.
- La simplicidad vale margen. Un precio que se explica en cuatro palabras («una imagen, 10 créditos») convierte mejor que un precio que necesita calculadora. Preferimos ganar la cuenta que ganar los puntos básicos.
Por qué créditos prepago y no una factura mensual
El prepago invierte el riesgo. Con la medición pospago, tu bug es tu factura: un bucle de reintentos a las 3 de la madrugada es dinero de verdad a la hora del desayuno. Con créditos prepago, el peor caso de cualquier descontrol es tu saldo actual: el sistema falla cerrado, con un 402 sin ambigüedad, en lugar de fallar caro.
También hace honesto el camino del fallo por nuestra parte: una generación que no devuelve nada se reembolsa sola, como una línea negativa visible en tu historial de movimientos. Con la medición pospago, las llamadas fallidas se cobran en silencio; con créditos prepago, un cargo injusto te saltaría a la vista en la página de facturación. El incentivo apunta en la dirección correcta.
Dos decisiones de diseño evitan que el prepago parezca un timo de tarjetas regalo: los créditos no caducan nunca, y los paquetes más grandes añaden créditos extra en lugar de cambiar los precios por llamada, así que el precio de una imagen es un único número en todas partes y para siempre.
Que conste: los planes mensuales funcionan igual. Una suscripción concede sus créditos por adelantado (1,800 con Hobby por $15, 6,000 con Creator por $49) y los que no usas se acumulan para siempre en lugar de reiniciarse al final del ciclo. Lo que nunca hacemos es medirte a posteriori.
Modelar tu economía sobre esto
Las cuentas de servilleta que necesita un producto con personajes:
revenue_per_user = your_subscription_price
model_cost = msgs_per_day × credit_cost × $0.01 × 30
premium_moments = (images × 10 + voice_lines × input/100 × 3) × $0.01
margin = revenue - model_cost - premium_moments
Hazlas para tu usuario P50 y tu usuario P95, no para el promedio: el usuario de rol P95 envía 10× más mensajes. El precio fijo por llamada hace que el caso P95 sea calculable, que es justo lo que te quita el precio por token.
Cuándo el precio por token es lo correcto
Si procesas documentos por lotes con un control estricto de la salida, la medición por token es de verdad más justa: con nuestro modelo estarías subvencionando a los productos más habladores. Los créditos fijos brillan cuando el uso es interactivo, de cola larga y dirigido por el usuario. Es decir, los productos con personajes, que es para quienes construimos.
Preguntas frecuentes
¿Cuánto vale un crédito en dólares?
Más o menos un centavo con el paquete de entrada: Starter cuesta $10 por 1,000 créditos. Los paquetes más grandes mejoran la tarifa, no los precios: Builder cuesta $50 por 5,500 créditos y Scale $100 por 12,000, lo que sale a cerca de $0.0083 por crédito. Los precios por llamada no se mueven nunca.
¿Los créditos caducan?
No. Tanto los créditos de los paquetes como los del plan se quedan en el saldo de tu espacio de trabajo hasta que los gastas, y los créditos mensuales del plan se acumulan para siempre en lugar de reiniciarse al final de cada ciclo. Esa es la otra mitad del prepago: compras capacidad, no una asignación que pierdes si no la usas.
¿Qué pasa cuando una llamada falla o se bloquea?
Una generación que no devuelve nada se reembolsa sola, automáticamente, como una línea negativa visible en tu historial. Una petición que queda fuera de la política de uso aceptable devuelve content_blocked y nunca se cobra. Un saldo vacío falla cerrado con un 402 en lugar de inflar una factura en silencio.
¿El precio fijo en créditos siempre es más barato que la facturación por token?
No, y preferimos decirlo. Si tus salidas son cortas y están muy limitadas, la medición por token puede ser de verdad más justa, y con nuestro modelo estarías subvencionando a productos más habladores. Los créditos fijos ganan cuando el uso es interactivo y lo dirige el usuario: las respuestas largas cuestan los mismos 1 o 3 créditos que las cortas, y max_tokens tiene un tope de 1,200, así que la variación que absorbemos sigue acotada.
La tabla de precios tiene todas las cifras. Caben en una sola pantalla, y eso también forma parte de la idea.
Crea esto con los modelos detrás del artículo: empieza con 50 créditos gratis o explora todos los motores y sus precios.