Reverie LogoReverie
PersonajesHistoriasFuncionesCreadoresBlog
Iniciar sesiónRegistrarse
← Volver al blog
#precios#créditos#transparencia#infraestructura#operaciones

El coste real de una conversación con IA

Reverie Team
Reverie Team
•5 de agosto de 2026
En esta página
  1. La factura del modelo es una línea, no la factura entera
  2. Resumen: la función por la que no te cobramos
  3. Las llamadas al modelo que ocurren cuando no estás
  4. Sí, usamos caché de prompts
  5. Mito vs. realidad
  6. Por qué pagamos precios oficiales
  7. La forma de este negocio
  8. Los créditos gratis también son costes reales
  9. Hasta dónde llega eso realmente
  10. Si bajan los costes, baja el precio
  11. Por lo que estás pagando realmente

Una pregunta que nos llega con regularidad, de una forma u otra:

DeepSeek cuesta prácticamente nada por millón de tokens. ¿Por qué Reverie no puede ser gratis y ya está?

Es una pregunta justa y merece una respuesta de verdad, no un encogimiento de hombros. La premisa incluso es parcialmente correcta: hay modelos genuinamente baratos por token, y ese precio es público — cualquiera puede consultarlo.

Lo que ese número no muestra es todo lo que tiene que ocurrir alrededor de la llamada al modelo para que una conversación se sienta como una conversación. Este artículo recorre esa parte, con el mayor detalle posible.

Ya habíamos rozado el tema antes. Nuestro artículo sobre el sistema de créditos explicaba los multiplicadores y los programas de recompensas, y el de los modelos gratuitos explicaba por qué los lanzamos pese a la incertidumbre. Ambos se quedaban justo antes de la pregunta que la gente sigue haciendo igualmente: ¿a dónde va realmente el dinero? Esta es esa respuesta, con más detalle del que hemos dado hasta ahora.

La factura del modelo es una línea, no la factura entera

Cuando envías un mensaje, la llamada al modelo es la parte visible. También es la única con un precio publicado, y por eso domina toda la conversación sobre costes.

Este es un inventario aproximado de lo demás que interviene en un solo intercambio en Reverie:

  • Recuperar y ensamblar el contexto — la definición del personaje, tu persona, los world books, las entradas de memoria a largo plazo, el historial reciente y los plugins activos hay que traerlos, ordenarlos por prioridad y encajarlos en un presupuesto de tokens.
  • Resumen y compresión de memoria — lo explicamos en detalle más abajo; es una llamada al modelo por sí sola.
  • Moderación — y va mucho más allá de filtrar mensajes. Publicar un personaje pasa sus imágenes por un modelo de visión. Denunciar un personaje, un plugin o un creador dispara una revisión previa con IA que lee tanto el contenido como la queja antes de que lo mire una persona. Las revisiones de plugins se examinan igual.
  • Almacenamiento — cada mensaje, cada imagen, cada ficha de personaje, cada versión de cada bifurcación, guardados y servidos de forma indefinida.
  • Infraestructura — servidores de aplicación, la base de datos y sus réplicas, cachés, colas, CDN, y las conexiones de streaming abiertas durante toda la respuesta.
  • Monitorización y observabilidad — seguimiento de errores, métricas de latencia y fallos, comprobaciones de salud de los proveedores, y los logs que nos avisan de que un modelo empezó a degradarse hace dos horas y no hace dos días.
  • Ingeniería — quienes construyen las funciones, y quienes reciben la llamada a las 3 de la madrugada cuando un proveedor se cae.
  • Soporte y operaciones — atender tickets, gestionar reembolsos, revisar denuncias, apelaciones de moderación, comisiones de pago, impuestos, contabilidad.

Y esa lista tampoco es exhaustiva: es la parte fácil de nombrar.

Nada de eso aparece en la página de precios de un proveedor de modelos. Todo son costes reales y recurrentes, y la mayoría crecen con el uso en lugar de mantenerse fijos.

Aquí viene la parte que más sorprende: la llamada al modelo que puedes ver es solo una parte de lo que pagamos. A su alrededor están los servidores, el almacenamiento, las llamadas en segundo plano que no se facturan a nadie y las personas que mantienen la plataforma. Esos costes no desaparecen cuando baja el precio por token de un modelo.

No vamos a inventarnos un porcentaje limpio: el reparto se mueve con el uso y preferimos no dar una cifra que luego tengamos que retirar. Lo estable es la diferencia: el precio de la API de un proveedor y el coste operativo de una plataforma no son la misma cifra. Una inferencia más barata reduce una parte de la factura, pero no elimina todo lo que la rodea.

Resumen: la función por la que no te cobramos

Esta merece mención aparte, porque por diseño es invisible.

Las ventanas de contexto son finitas. Si una conversación creciera sin límite, pasaría una de dos cosas: las partes más antiguas se saldrían silenciosamente de la ventana y tu personaje empezaría a olvidar, o cada mensaje arrastraría todo el historial y se volvería progresivamente más lento y más caro hasta dejar de funcionar del todo.

Así que Reverie resume. Cuando un hilo se alarga, el sistema comprime la parte antigua en un resumen narrativo — preservando el estado de la relación, la dinámica emocional, los hilos sin cerrar — y lo introduce en el contexto en lugar del historial en bruto. Ocurre solo, en segundo plano, sin que lo pidas.

Ese resumen es en sí mismo una llamada al modelo. Lee muchos tokens y escribe otros nuevos. Y ocurre repetidamente a lo largo de la vida de una conversación larga.

No te lo cobramos. No hay ninguna línea de "mantenimiento de memoria" en tu historial de créditos. Se absorbe dentro del coste de operar la plataforma, porque cobrar a los usuarios por la maquinaria que mantiene coherentes sus propias conversaciones nos parecía el intercambio equivocado.

La misma lógica se aplica a otro trabajo de fondo: la optimización de contexto, la extracción de memoria, la pasada que decide qué merece recordarse siquiera.

Las llamadas al modelo que ocurren cuando no estás

Parte de lo que pagamos no está ligado a ninguna petición tuya.

Los mensajes proactivos — un personaje que escribe primero — se ejecutan de forma programada. Un proceso decide a quién tiene sentido contactar, lee el contexto suficiente para saber qué decir y escribe algo que valga la pena abrir. Eso es una llamada al modelo por mensaje, para una conversación que aún no habías empezado.

Los momentos de personaje funcionan igual: se generan en silencio, en segundo plano, para que la página de un personaje tenga algo nuevo, hubiera o no alguien hablando con él ese día.

Ninguno de los dos descuenta créditos. No hay cargo cuando un personaje te escribe primero, ni cuando aparece un momento. Se ejecutan según nuestro calendario y con cargo a nuestra factura.

Vale la pena detenerse aquí, porque invierte el modelo mental habitual. Una parte apreciable de nuestro gasto en modelos no tiene ninguna petición de usuario detrás. Existe porque un personaje que solo responde se siente menos vivo que uno que de vez en cuando empieza algo — y esa diferencia cuesta dinero real, gastado por adelantado, en conversaciones que quizá no reciban respuesta.

La revisión previa de moderación también entra aquí, y es el caso más raro de todos. Cuando alguien denuncia un personaje, la primera revisión es una llamada al modelo: la dispara un desconocido, contra contenido que quizá publicaste hace meses. A ninguno de los dos se le cobra. Lo mismo ocurre cuando un creador publica un personaje y sus imágenes pasan por un modelo de visión: la comprobación corre a nuestra cuenta, sobre un trabajo que esperamos que esté bien.

Las respuestas sugeridas, el ajuste de la primera respuesta y las demás pasadas pequeñas de calidad entran en la misma categoría. Baratas por separado, en marcha constante, nunca desglosadas.

Sí, usamos caché de prompts

Un seguimiento razonable: si la definición del personaje y el historial inicial no cambian entre mensajes, ¿por qué pagar por enviarlos cada vez?

No lo hacemos, donde podemos. La caché de prompts ya está en uso, y medimos la tasa de acierto por petición precisamente para detectar cuándo un cambio que hemos desplegado rompe sin querer un prefijo cacheado.

Pero la tasa de acierto no es perfecta, y nunca lo será. Las peticiones se enrutan a varios proveedores a través de OpenRouter, y una caché vive con el proveedor concreto que la creó. Si el siguiente mensaje va a otro backend, la caché no lo acompaña. Además, cada proveedor expone el cacheado con semánticas distintas, tamaños mínimos distintos y comportamientos de expiración distintos. Y por encima de eso, las partes del prompt que más cambian — los mensajes nuevos, un resumen actualizado, un plugin recién activado — están exactamente donde invalidan la cola del prefijo cacheado.

La caché reduce la factura de forma significativa. No la elimina, y tratar un 100 % teórico de aciertos como línea base produce números que no sobreviven al contacto con producción.

Mito vs. realidad

Mito: DeepSeek cuesta muy poco, así que cualquier web de IA debería ser casi gratis. Realidad: La API del modelo es un componente del coste de entregar un producto terminado. La inferencia es la parte con precio público; todo lo que la envuelve es la parte que nunca ves en una factura.

Mito: Si reduces la factura de API a cero, el producto sale barato de operar. Realidad: No. La infraestructura, el almacenamiento, la moderación, el soporte y la ingeniería no desaparecen porque los tokens se abaraten. Aunque la llamada al modelo al enviar un mensaje no costara nada, esos costes circundantes y las llamadas en segundo plano descritas antes seguirían existiendo.

Mito: El resumen y la memoria son funciones gratuitas, así que proporcionarlas también es gratis. Realidad: Son gratis para ti. El resumen, los mensajes proactivos, los momentos de personaje y las revisiones de moderación son llamadas al modelo que pagamos nosotros. Los mensajes proactivos y los momentos pueden ejecutarse sin que los pidas; la moderación se activa al publicar o denunciar, no mediante un mensaje de chat facturable.

Mito: Con caché de prompts, el contexto repetido sale gratis. Realidad: La caché ayuda muchísimo y la usamos. El enrutado multiproveedor, la expiración de cachés y la cola siempre cambiante de cada prompt hacen que las tasas reales de acierto queden bastante lejos de lo perfecto.

Mito: Usar una API no oficial más barata lo arreglaría todo. Realidad: Puede bajar una cifra y subir otras — latencia, inestabilidad, riesgo para los datos o calidad del roleplay. Algunos endpoints no oficiales alteran las solicitudes o revenden accesos obtenidos sin autorización del proveedor. Lo desarrollamos a continuación.

Mito: Los usuarios gratuitos son un coste que la plataforma tolera. Realidad: Los usuarios gratuitos son la forma en que la plataforma crece. Muchos acaban siendo creadores y suscriptores. La restricción no es si existe el uso gratuito, sino si se mantiene sostenible.

Por qué pagamos precios oficiales

Hay una forma muy conocida de reducir mucho la factura del modelo: endpoints no oficiales obtenidos por ingeniería inversa. Sus fuentes varían. Algunos revenden accesos obtenidos por vías no autorizadas por el proveedor; en el extremo abusivo de ese mercado, parte de la capacidad se financia con métodos de pago robados.

No los usamos, y no pensamos hacerlo. Esos canales recortarían nuestros costes de modelo de forma sustancial. Los hemos mirado y hemos dicho que no, por dos razones distintas.

La primera es que simplemente está mal. Cuando el acceso se obtiene o se financia mediante fraude, revenderlo es robo con pasos intermedios, por muy normalizado que esté en ciertas partes de este sector. No vamos a financiar la plataforma mediante esos canales y después escribir artículos sobre transparencia.

La segunda es que degrada el producto, y esta es la parte que los usuarios notan directamente aunque nunca lleguen a saber de dónde salió una respuesta:

  • La latencia sube. Las rutas de ingeniería inversa añaden saltos, hacen cola detrás de cuentas compartidas y limitan de forma impredecible. La diferencia entre una respuesta que llega en dos segundos y otra que llega en doce es la diferencia entre una conversación y rellenar un formulario.
  • Inyectan sus propios system prompts. Muchos endpoints no oficiales envuelven las peticiones en un system prompt propio antes de reenviarlas. Ese prompt es invisible para nosotros y para ti, y pelea contra la definición del personaje. La voz se aplana. Los personajes rompen el tono, rechazan cosas que no deberían o derivan hacia un registro de asistente genérico. La calidad del roleplay es justo lo primero que sufre, y es el tipo de regresión más difícil de depurar cuando no controlas el prompt.
  • Desaparecen sin avisar en cuanto el proveedor cierra el agujero, llevándose por delante tu configuración que funcionaba.
  • Las versiones del modelo cambian en silencio, así que un personaje que ayer sonaba bien hoy responde distinto sin que nadie pueda explicar por qué.
  • No hay responsabilidad alguna sobre tus datos. Ningún acuerdo de tratamiento, ninguna política de retención, nadie a quien preguntar.

Reverie custodia conversaciones en las que la gente ha invertido de verdad. Enrutarlas por un intermediario anónimo para ahorrar dinero no es un intercambio que estemos dispuestos a hacer. Los proveedores oficiales cuestan más. También cogen el teléfono, y no reescriben las instrucciones de tu personaje por el camino.

La forma de este negocio

El equipo es pequeño y Reverie no es un negocio muy rentable.

Hay una razón estructural por la que el precio en créditos de un mensaje no es simplemente el coste en tokens de ese mensaje, y vale la pena entenderla. La inferencia es la única parte de una conversación que se puede medir por mensaje. Todo lo demás en este artículo — el resumen, los mensajes proactivos, las revisiones de moderación, el almacenamiento, los servidores, las personas — no tiene una unidad natural contra la que facturar. Nadie puede emitirte una factura por "el proceso en segundo plano que decidió qué debía recordar tu personaje".

Así que lo único medible tiene que dar cuenta de más que de sí mismo. Esa es la razón de que exista un sistema de créditos en lugar de un traspaso directo de tokens: si un mensaje costara exactamente sus propios tokens y nada más, todo lo que lo rodea funcionaría sin nada detrás, y todo lo que lo rodea es la mayor parte.

No intentamos maximizar el beneficio. Tampoco podemos operar con pérdidas permanentes, porque una plataforma que se queda sin dinero deja de existir, y ese es un resultado bastante peor para todo el que la usa que un sistema de créditos con límites.

Entre esas dos restricciones, hemos elegido deliberadamente el lado más cercano al usuario. Ahora mismo la prioridad es construir el mejor producto posible antes del lanzamiento oficial, no apretar la monetización. Eso significa sacar funciones y mejorar calidad antes que optimizar conversión, y significa que las cuentas actuales son más holgadas de lo que serían si los ingresos fueran el objetivo principal.

Los créditos gratis también son costes reales

Hay bastantes formas de usar Reverie sin pagar:

  • la recompensa diaria por registro de entrada
  • el sorteo diario, que se suma a la anterior
  • logros
  • recompensas oficiales (bounties)
  • recompensas para creadores
  • recompensas por invitar, más la comisión cuando alguien a quien invitaste compra créditos
  • recompensas por compartir
  • códigos de canje y tarjetas de regalo
  • la recompensa del resumen anual (Wrapped)
  • contribuciones de la comunidad, incluida la ayuda para dar a conocer Reverie

Vale la pena concretar lo del sorteo, porque es lo que la gente da por decorativo. Tiene cinco niveles — 1.000 / 2.000 / 8.000 / 30.000 / 80.000 créditos — con pesos de 50 / 30 / 15 / 4 / 1. Al multiplicarlo, el valor esperado ronda los 4.300 créditos por tirada. Por usuario, por día, y encima de la recompensa diaria. Sumado todo, el nivel gratuito no es un gesto simbólico. La base del registro diario son 10.000 créditos, las bonificaciones por racha se añaden encima — +5.000 el día tres, +8.000 el día siete, +50.000 el día treinta, +200.000 el día cien — y el sorteo se sitúa por encima de todo eso. El séptimo día, el total esperado sin gastar nada es de unos 22.300 créditos; la cantidad real depende del resultado del sorteo.

Hasta dónde llega eso realmente

Llegados aquí, la pregunta justa es qué compran unos 22.300 créditos, y nunca lo hemos explicado con claridad.

Los créditos se consumen como tokens × el multiplicador del modelo. Los multiplicadores de los modelos de texto van de 0 a 2, y el selector de modelo muestra cada uno antes de que envíes nada.

Lo que se subestima es que el número de tokens no es fijo: crece con la conversación. Un chat nuevo envía un par de miles de tokens: el personaje, tu persona, algo de historial. Uno largo envía muchísimo más, porque la transcripción reciente viaja en cada turno. Limitamos el historial en bruto a unos 10.000 tokens y resumimos todo lo anterior, que es exactamente para lo que existe el resumen: sin ese tope, una conversación de seis meses reenviaría todo su historial en cada mensaje y el coste por turno crecería sin límite.

En la práctica, un turno en un chat nuevo con un modelo de 0,3× cuesta unos cientos de créditos, mientras que el mismo turno en lo hondo de una conversación larga con un modelo de 1× cuesta diez mil o más. Misma plataforma, mismo día, una diferencia de más de un orden de magnitud.

Ese rango es la respuesta honesta a "cuánto me duran los créditos". Si se te evaporan más rápido de lo que esperabas, probablemente estés metido en una conversación larga con un modelo caro — y ahora sabes cuál de los dos mandos girar.

La propia pantalla de registro de entrada también hace una llamada al modelo. Ese saludo que te escribe tu personaje al entrar no es una plantilla: se genera, se cachea una vez al día por personaje y tiene un tope diario para que no se desmande. Aun así es inferencia que pagamos, en una página cuyo propósito entero es regalar créditos.

Hay un detalle más sobre cómo se gasta que corresponde aquí: los créditos gratuitos siempre se consumen antes que los pagados. Si tienes ambos, el grifo se vacía primero. Es deliberado — los créditos que compraste te duran más — pero también significa que el nivel gratuito absorbe el coste primero, siempre.

Cada una de ellas es un gasto real. Cuando reclamas una recompensa diaria y la gastas en una conversación, el proveedor del modelo nos sigue facturando, los servidores siguen funcionando, el resumen sigue ejecutándose. Los créditos son gratis para ti; el cómputo detrás no es gratis para nadie.

Financiamos esos programas igualmente, porque el acceso gratuito es como la mayoría de la gente descubre si esta plataforma es para ellos, y porque una buena parte de los usuarios gratuitos de hoy son los creadores y suscriptores de mañana. Eso solo funciona si la parte gratuita se mantiene dentro de lo que la plataforma puede sostener. Cuando los números se mueven, los programas se ajustan — no porque queramos dar menos, sino porque regalar más de lo que puedes sostener acaba en no poder regalar nada.

Si bajan los costes, baja el precio

Esta parte es un compromiso, no una descripción.

Los precios de los modelos bajan con el tiempo. La caché mejora. La infraestructura se vuelve más eficiente. Nuestro propio código desperdicia cada vez menos tokens — buena parte del trabajo silencioso de los últimos meses en ensamblado de contexto y resumen ha sido exactamente eso.

Cuando encontramos una forma duradera de reducir costes operativos, nuestra preferencia clara es trasladarla a los usuarios en lugar de apuntarla como margen. Modelos más baratos, mejores multiplicadores, recompensas más generosas. Lo hemos hecho varias veces y preferimos seguir haciéndolo, porque una plataforma que la gente puede permitirse usar mucho vale más para nosotros que un diferencial un poco mejor.

La palabra que hace el trabajo ahí es duradera. Trasladar un ahorro que resulta ser temporal significa retirarlo después, y eso es peor que no haberlo dado nunca.

Por lo que estás pagando realmente

Cuando gastas créditos en Reverie, no estás comprando tokens de un proveedor de modelos con un margen encima.

Estás pagando por una conversación que recuerda lo que pasó, que se mantiene coherente más allá del punto en que el contexto en bruto se habría venido abajo, que corre sobre proveedores responsables de su disponibilidad y de tus datos, que está respaldada y es exportable, y que mejora de forma perceptible cada pocas semanas porque hay gente trabajando en ella a tiempo completo.

Puede que sigas queriendo más créditos gratis. Es completamente razonable, y nos gustaría dártelos — estamos trabajando en ello desde el lado de los costes, no desde el de la página de precios.

Pero preferimos que sepas por qué la respuesta no es tan simple como el número que aparece en la web de un proveedor de modelos.


¿Tienes dudas sobre un cargo concreto, o crees que nos hemos equivocado en algún número? Tu historial de créditos muestra el recuento real de tokens detrás de cada mensaje, y nuestro Discord está abierto. Preferimos discutir sobre números reales que sobre impresiones vagas.

Los importes de recompensa y los multiplicadores de créditos citados aquí reflejan la plataforma en el momento de la publicación y se ajustan a medida que cambian los costes. La app siempre muestra los valores vigentes.

En esta página

  1. La factura del modelo es una línea, no la factura entera
  2. Resumen: la función por la que no te cobramos
  3. Las llamadas al modelo que ocurren cuando no estás
  4. Sí, usamos caché de prompts
  5. Mito vs. realidad
  6. Por qué pagamos precios oficiales
  7. La forma de este negocio
  8. Los créditos gratis también son costes reales
  9. Hasta dónde llega eso realmente
  10. Si bajan los costes, baja el precio
  11. Por lo que estás pagando realmente

Publicaciones relacionadas

Volver al blog

Entendiendo el Sistema de Créditos de Reverie - Precios Transparentes y Recompensas Generosas

Descubre cómo funciona nuestro sistema de precios transparente basado en tokens, por qué algunos modelos cuestan más que otros, y cómo puedes ganar créditos gratuitos a través de nuestro generoso sistema de recompensas.

Eliminamos la renovación automática de tu suscripción. Te explicamos por qué.

Todos los servicios de suscripción apuestan a que olvidarás cancelar. Nosotros acabamos de eliminar la renovación automática por completo. Tu período de suscripción termina cuando termina - sin cargos silenciosos, sin renovaciones sorpresa, sin patrones oscuros. Si no valemos la pena para que nos elijas de nuevo, no merecemos tu dinero.

Honestamente, fuimos atacados — Pero tus datos están seguros

Después de lanzar modelos de IA gratuitos, enfrentamos olas de ataques - crawlers, robo de ancho de banda, DDoS y abuso de API. Aquí está la historia completa de lo que pasó, cómo contraatacamos y por qué tus datos nunca estuvieron en riesgo.

¿Listo para experimentar conversaciones dinámicas con IA?

Únete a miles de usuarios que ya están explorando personalidades infinitas e interacciones atractivas en Reverie.

Iniciar conversaciones gratuitas →Ver precios
Reverie LogoReverie

Una plataforma de chat y roleplay con personajes de IA. Sueñalo, créalo, chatea con ello.

Twitter·Discord·Acerca de·Contacto

Producto

FuncionesTemasRoleplay con IAIdeas de roleplayAI RPGChat con IA y MemoriaPersonajesHistoriasMomentosCreador de Personajes IACreador de personajes visualesWorld BooksPlugins de Roleplay con IAModo HistoriaEscritor de Novelas IAChat a novelaDesafíos de personajesLogrosReverie Wrapped

Explorar

Chat IA NSFWNovia IANovio IACompañero IAChat Grupal IAPersona de IALlamada de voz con IAClonación de voz con IAModelos de IARamificación de chatComandos de barraGenerador de Historias IAIA que escribe primeroMensajes IlimitadosHashtagsCreadores

Comparar

Mejores chatbots de roleplay con IAMejores apps de novia con IAMejor chat NSFW con IAAlternativa a Character.AIvs Character.AIvs Janitor AIvs Chai AIvs SpicyChatvs Crushon.AIvs Polybuzz.AIvs Chub AIvs SillyTavernvs Talkie AIvs AI Dungeonvs Replikavs Moematevs Figgs AI

Recursos

GuíasPara creadoresAPI de personajes de IAImportador de PersonajesImportador de historial de chatFAQBlogChangelogPreciosBot de DiscordBot de Telegram

Categorías

  • Fantasía
  • Ciencia Ficción
  • Anime
  • Videojuegos
  • Celebridades
  • Romance
  • Dominante
  • Sumiso
  • Juego de rol
  • Fetiche
  • BDSM
  • Criatura fantástica
  • Cosplay
  • Novia virtual
  • Novio virtual
  • Harén
  • Furry
  • Monstruo
  • Uniforme
  • Tentáculo
  • Sobrenatural
  • Waifu virtual
  • Femboy
  • Futa
  • Chica monstruo
Política de privacidadTérminos y condicionesDirectrices de la comunidad
support@reverie.im
651 N Broad St, Suite 206, Middletown, DE 19709, USA
© 2026 Reverie. All rights reserved.