blog/models·30 ago 2026·7 min·por el equipo de eroq
RP+ vs RP mini: qué modelo de rol va en cada turno
RP+ cuesta 3 créditos por respuesta y RP mini 1: dónde se nota, cuánto cuesta la visión y cómo enrutar un chat real.
Dos modelos de rol, una diferencia de precio de 3× y una pregunta que solo parece de calidad. RP+ cuesta 3 créditos por respuesta; RP mini, 1. Los dos son sin censura dentro de la política de uso aceptable, los dos hacen streaming y los dos aceptan imágenes. Si estás construyendo cualquier cosa que incluya una conversación, la decisión interesante no es «qué modelo es mejor», sino qué turnos merecen el modelo insignia, porque la mayoría no lo merecen.
Los dos modelos sobre el papel
RP+ es el modelo insignia de rol y chat. 3 créditos por respuesta. Su gran virtud es que no se sale del personaje en escenas largas: justo lo que separa un modelo que puedes lanzar de uno que luce en una demo y luego olvida el nombre del personaje en el turno cuarenta. Hace streaming por SSE.
RP mini cuesta 1 crédito por respuesta. Mismo marco de política, mismo comportamiento sin censura dentro de esa política, mismo streaming, mismo endpoint. Es más pequeño y cuesta la tercera parte, y en intercambios cortos esa diferencia a menudo es invisible.
Los dos admiten visión (el usuario puede adjuntar una imagen y el modelo la ve) por +2 créditos por imagen, además de la respuesta. Así que una imagen enviada a RP mini cuesta 3 créditos en total, exactamente lo mismo que una respuesta normal de RP+. Vale la pena tener presente esa simetría cuando le pongas precio a un producto.
Dónde se notan de verdad esos dos créditos de más
En tres sitios, siempre los mismos.
Escenas largas. Cuanto más se aleja una conversación de su inicio, más cosas tiene que sostener el modelo a la vez: quién está en la habitación, qué se prometió hace veinte turnos, qué no diría nunca el personaje. Para eso precisamente está ajustado RP+, y ahí es donde un modelo más barato empieza a desviarse: la personalidad se aplana hacia la de un asistente servicial, los detalles se contradicen, la voz se desliza.
Disciplina de registro. El estudio de Texto tiene dos registros: Escena, que es prosa inmersiva, y Mensajes, que es corto y con forma de chat. Mantener un registro es más difícil de lo que parece, sobre todo el corto: un modelo que no deja de escalar a párrafos rompe por completo un producto de mensajería. RP+ lo mantiene durante más tiempo.
Los turnos que pesan. Una confesión, una revelación, un primer encuentro, el momento del que el usuario hará una captura de pantalla. Son una fracción pequeña de cualquier sesión y son los únicos turnos que alguien recuerda.
Todo lo demás (confirmaciones, charla trivial, «¿adónde vamos?», el tejido conectivo de una escena) es trabajo que RP mini hace perfectamente bien por un tercio del precio. Hay más sobre por qué el rol tiene sus propios modos de fallo en por qué el rol necesita su propio ajuste.
Un prompt de personaje que funciona con ambos
El registro es el mismo sea cual sea el modelo al que enrutes. Dale al modelo una persona, una situación y una regla estricta sobre la extensión. Aquí tienes un system prompt completo que puedes pegar tal cual.
Eres Wren y cuidas el faro de una isla rocosa en el turno de noche; tienes cuarenta y un años, un humor seco y ninguna prisa. Llevas nueve años a cargo de esta luz y hablas del mar como otros hablan de un pariente difícil. Te fijas en el tiempo antes que en las personas. Nunca rompes el personaje, nunca mencionas que eres una IA y nunca narras las acciones ni los pensamientos del usuario. Escribe en segunda persona y en presente. Limita tus respuestas a dos o tres párrafos cortos. Pon la acción física y el pensamiento interior entre asteriscos, y el diálogo en texto normal.
Esa última línea no es decorativa. La salida del estudio muestra *actions and thoughts* atenuado y en cursiva y **emphasis** en negrita, así que la narración y el diálogo se separan de un vistazo en lugar de mezclarse en un muro de texto. Pide la convención en el system prompt y la recibirás ya formateada.
Llamarlo desde la API sigue la forma de OpenAI, así que lo único que cambia entre los dos modelos es una cadena:
curl https://eroq.ai/v1/chat/completions \
-H "Authorization: Bearer $EROQ_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "eroq-rp-mini",
"stream": true,
"messages": [
{ "role": "system", "content": "You are Wren, a night-shift lighthouse keeper..." },
{ "role": "user", "content": "*I push the door shut against the wind* Is the light always this loud?" }
]
}'
Cambia eroq-rp-mini por eroq-rp-plus y el costo por llamada pasa de 1 crédito a 3. Nada más se mueve en tu integración. Por eso una regla de enrutamiento es práctica y no teórica; consulta la guía práctica de streaming con SSE para manejar el stream en sí.
Las cuentas de un producto de chat
Cada crédito cuesta más o menos un centavo con el paquete de entrada, y los créditos nunca caducan. Toma una sesión de 24 turnos: una noche realista con un compañero virtual o un bot de rol.
- Todo RP+: 72 créditos, unos 72 centavos por sesión.
- Todo RP mini: 24 créditos, unos 24 centavos.
- Mixto (mini para los 18 turnos de enlace, RP+ para los 6 que importan): 18 + 18 = 36 créditos, la mitad de la factura del modelo insignia, y los turnos que los usuarios recuerdan siguen en el insignia.
Lleva eso a 5,000 sesiones al mes y las mismas tres filas dan 360,000 créditos, 120,000 y 180,000. En la tabla de planes, esa es la diferencia entre una factura que puedes defender y una que no: Creator cuesta $49 por 6,000 créditos al mes, Studio $149 por 20,000, Team $249 por 36,000, y los créditos mensuales se acumulan para siempre. La tabla completa está en /pricing.
Dos números más que deben entrar en tus cálculos:
- La visión cuesta +2 créditos por imagen. Si tu producto anima a enviar imágenes, esa línea puede convertirse sin hacer ruido en la más grande. Enruta los turnos con imagen a mini, salvo que la imagen sea el centro de la escena.
- Las solicitudes bloqueadas nunca se cobran. Una solicitud que choca con la política devuelve
content_blockedy no cuesta nada, y las generaciones fallidas se reembolsan solas. Presupuesta solo las respuestas que salen bien.
Los límites por clave son 60 solicitudes de chat por minuto, multiplicadas por tu plan: Creator los duplica, Studio los cuadruplica, y así sucesivamente en los niveles para empresas.
Una regla de enrutamiento lista para producción
Empieza aquí y ajústala con tus propios logs:
- Por defecto, RP mini. Intercambios cortos, saludos, navegación, cualquier cosa de menos de un par de frases.
- Sube a RP+ cuando la escena lo pida. Un mensaje largo del usuario, una escena que pasa de unos veinte turnos, un momento emocional o un usuario que pide prosa de forma expresa.
- Deja a los usuarios de pago en RP+ de forma permanente. La diferencia de 2 créditos por turno es una forma barata de que una suscripción se sienta como tal.
- Envía las imágenes a mini, salvo que la imagen sea el tema de la respuesta.
- Registra qué modelo respondió cada turno. Sin eso no puedes saber si la regla de escalado se gana lo que cuesta.
Si estás construyendo el producto que rodea a las llamadas, y no solo las llamadas, crea una app de chat con personajes de IA cubre el resto del stack, y la página de la herramienta de chat de rol tiene la versión del estudio.
Preguntas frecuentes
¿Cuál es la diferencia entre RP+ y RP mini?
RP+ es el modelo de rol insignia, a 3 créditos por respuesta, y no se sale del personaje en escenas largas. RP mini cuesta 1 crédito por respuesta. Los dos son sin censura dentro de la política, los dos hacen streaming por SSE y los dos aceptan imágenes.
¿RP mini admite visión?
Sí. Los dos modelos aceptan imágenes adjuntas por +2 créditos por imagen además del precio de la respuesta, así que un turno con imagen en RP mini cuesta 3 créditos en total.
¿Puedo cambiar entre RP+ y RP mini en la misma conversación?
Sí. Comparten el mismo endpoint chat/completions con la forma de OpenAI, así que cambiar es solo modificar la cadena model en cada solicitud. Enrutar los turnos baratos a mini y los importantes a RP+ es la forma habitual de operar un producto de chat.
Prueba los dos registros con el mismo personaje en el estudio de Texto antes de conectar la regla de enrutamiento.
Crea esto con los modelos detrás del artículo: empieza con 50 créditos gratis o explora todos los motores y sus precios.