
Por Thomas Cohen, fundador de Maestro
Suscripciones, créditos y tokens: entiende tu consumo de IA
¿Por qué el asistente y el proveedor muestran cifras diferentes? Aprende a leer las unidades, comprobar los cálculos y relacionar las cifras con una sesión de trabajo.
Tu asistente muestra miles de tokens, un porcentaje de uso o unos céntimos. El proveedor muestra otro importe. Antes de concluir que el contador falla, comprueba qué mide cada cifra: una respuesta, una sesión, una cuenta, un periodo o una factura. Esta guía te ayuda a conciliar la información sin mezclar unidades.
Seguiremos un caso ficticio: Nadia está creando una herramienta para gestionar los pedidos de su negocio. Utiliza un asistente de IA desde Maestro y quiere entender una sesión de trabajo. Las cantidades, los importes y los cálculos siguientes son inventados para explicar el método. No son facturas de clientes ni tarifas de Maestro o de un proveedor.
Suscripción, API, créditos y tokens: cuatro conceptos distintos
La suscripción es el plan que has contratado. Puede dar acceso a herramientas, modelos y una cantidad de uso según sus condiciones. La API es una forma de que un programa se comunique con un servicio. No significa suscripción ni garantiza que tu suscripción habitual pague ese uso.
El crédito es una unidad definida por una oferta comercial. Su valor y sus reglas dependen del servicio. Un crédito de una herramienta no se compara directamente con el de otra. El token es una unidad de procesamiento del modelo: no equivale a una acción terminada en tu aplicación.
OpenAI mantiene separadas la facturación de ChatGPT y la de la API. Los créditos de uso de ChatGPT no son créditos API. Comprueba el plan y la conexión correspondientes antes de interpretar un saldo.
Identifica la cuenta y el registro de referencia
Empieza por encontrar el servicio al que corresponde el consumo. Para Nadia, «he pagado por IA» no es suficientemente preciso. Anota el asistente, la cuenta conectada, la organización si corresponde y el modo de acceso. Después puede abrir el registro correcto en lugar de buscar entre todas sus suscripciones.
La documentación de Claude Code indica que el coste de sesión es una estimación y que la facturación de referencia corresponde al proveedor. Con una suscripción, el coste de sesión no representa necesariamente un importe adicional que pagar.
En Cursor, el seguimiento de uso distingue uso incluido y cargos por consumo. En Mistral, el informe de uso permite consultar, entre otros aspectos, el periodo, el modelo y el espacio de trabajo correspondientes.
- Anota la cuenta y la organización que realmente ejecutaron la tarea.
- Identifica el servicio y el plan a los que corresponde el consumo.
- Abre el historial de uso adecuado y después la factura si buscas un importe facturado.
- Anota el periodo, la moneda y si la cifra es estimada o definitiva.
Las páginas de los proveedores cambian. Guarda con tu registro la fecha de consulta y el nombre del plan, sin copiar claves API ni contraseñas. Así tendrás una explicación verificable si la presentación o las condiciones cambian el mes siguiente.
Entiende qué entra, qué sale y qué se reutiliza
Un token no siempre es una palabra. La división depende, entre otros factores, del texto, el idioma y el modelo. Algunas unidades de razonamiento no se ven en la respuesta, como explica la documentación de OpenAI sobre tokens.
Para orientarte en un registro, distingue lo que recibe el modelo de lo que produce. En el ejemplo, Nadia escribe una petición corta, pero el asistente también puede procesar las reglas de pedidos, los archivos pertinentes y los resultados de sus comprobaciones. La longitud del mensaje no describe toda la sesión.
- Entrada: los elementos enviados al modelo para que pueda trabajar.
- Salida: los elementos producidos por el modelo, según las categorías del proveedor.
- Caché: ciertos elementos reutilizados, con tratamiento y precio que dependen del servicio.
La documentación de caché de Anthropic distingue escritura y lectura de caché, con sus propias condiciones. No debes considerar automáticamente gratuito el material reutilizado ni sumarlo sin comprobar a qué total pertenece.
Lee un cálculo completo con precios ficticios
Tomemos unas tarifas inventadas para aprender: 2 € por millón de tokens de entrada ordinaria, 0,20 € por millón de tokens leídos de caché y 8 € por millón de tokens de salida. Solo sirven para explicar el cálculo. No corresponden a ninguna oferta recomendada ni incluyen impuestos u otros servicios.
Una petición ficticia utiliza tres categorías distintas: 50 000 tokens de entrada ordinaria, 100 000 tokens leídos de caché y 5 000 tokens de salida. Para cada categoría, divide la cantidad entre un millón y multiplícala por la tarifa correspondiente. Después suma los tres importes.
- Entrada ordinaria: 50 000 ÷ 1 000 000 × 2 € = 0,10 €.
- Lectura de caché: 100 000 ÷ 1 000 000 × 0,20 € = 0,02 €.
- Salida: 5 000 ÷ 1 000 000 × 8 € = 0,04 €.
- Total de esta petición ficticia: 0,16 €.
Una petición del usuario puede generar varios intercambios
Si la sesión inventada contiene seis intercambios exactamente iguales, el total es 6 × 0,16 €, es decir, 0,96 €. En un trabajo real, las cantidades pueden cambiar en cada intercambio. Multiplicar el coste del primero por el número de mensajes visibles no reconstruye automáticamente el importe final.
El cálculo cambia si una línea corresponde a escritura de caché, otro modelo, una herramienta de pago o una unidad diferente. Comprueba también si las tarifas se expresan por mil o por un millón de tokens. Una unidad equivocada produce un resultado incorrecto aunque las multiplicaciones estén bien hechas.
Mantén la moneda del registro durante la conciliación. Si después quieres convertir el resultado, indica por separado el tipo de cambio y la fecha utilizados. Mezclar desde el principio un precio en dólares y un pago bancario en euros dificulta explicar la diferencia.
Por qué la herramienta y el proveedor pueden mostrar cifras distintas
Dos cifras pueden ser correctas y referirse a ámbitos diferentes. Una corresponde a la sesión abierta; la otra suma toda la actividad de la cuenta. Una pantalla sigue los últimos minutos, otra el mes de facturación. Alinea esos ámbitos antes de buscar un error.
El seguimiento de Maestro distingue el modo de suscripción del modo API y utiliza la información comunicada por el asistente. Los detalles disponibles dependen de ese asistente. Una medida ausente o antigua no demuestra que el trabajo en curso no consuma nada. Consulta también el registro del proveedor correspondiente.
- Periodo: la misma hora de inicio, la misma hora de fin y la misma zona horaria.
- Ámbito: la sesión, el proyecto, el usuario o toda la organización.
- Naturaleza: estimación de uso, coste registrado, créditos consumidos o factura.
- Unidad: moneda, tokens, porcentaje o créditos del mismo plan.
Imagina que Nadia ve 2,40 € para una sesión y 3,10 € en la cuenta durante el mismo periodo. La diferencia ficticia de 0,70 € puede corresponder a otro trabajo, pero es solo una hipótesis. Busca las entradas correspondientes antes de concluir. Una explicación plausible todavía no es una conciliación del registro.
Comprueba también la actualidad del dato: un total puede actualizarse después de terminar una operación. Anota la hora de cada captura y repite la comparación cuando se estabilicen los datos provisionales. No repitas una tarea solo para comprobar si se mueve el contador.
Con una suscripción, no conviertas un porcentaje al azar
Un porcentaje de uso no equivale automáticamente a un porcentaje del precio de la suscripción. Si un indicador muestra 30 %, no puedes deducir un cargo adicional del 30 % de la cuota mensual. Debes saber qué cantidad de uso mide y en qué periodo se renueva.
En el caso ficticio de Nadia, una sesión puede quedar íntegramente dentro del uso incluido. Consume parte de una asignación sin generar necesariamente un nuevo cargo. Si el plan permite uso adicional de pago, revisa los ajustes y el registro correspondientes en vez de deducirlo únicamente de la actividad mostrada.
Tampoco trates un equivalente calculado con tarifas API como una factura de suscripción. Puede servir para comparar órdenes de magnitud dentro de un protocolo concreto. No sustituye las condiciones del plan ni demuestra qué importe se cobrará.
Concilia una sesión en seis pasos
Para la primera conciliación, elige una sesión breve cuyo objetivo conozcas. Nadia escoge corregir el cálculo de pedidos anulados. Evita empezar sumando varias semanas, asistentes y dispositivos. Un ámbito pequeño permite identificar las entradas sin inventar correspondencias.
- Escribe el objetivo de la sesión y anota su inicio y su fin.
- Registra el asistente, el modelo conocido, la cuenta y el modo de facturación.
- Guarda el contador de la herramienta y la hora de su última medida, si aparece.
- Abre el registro del proveedor con las mismas fechas y la cuenta correcta.
- Identifica otras actividades de la cuenta, categorías de coste y posibles redondeos.
- Clasifica la diferencia restante como explicada, parcialmente explicada o pendiente de investigar.
Supongamos que los 0,70 € del ejemplo anterior corresponden a otra sesión abierta en una segunda herramienta. Nadia puede explicar la diferencia sin modificar el primer contador. Si ninguna entrada coincide, mantiene la diferencia sin resolver. No inventa un «margen técnico» para forzar que los totales cuadren.
Para pedir ayuda, prepara el nombre del plan, el periodo, los importes, el modelo conocido y capturas sin información sensible. Un identificador de petición puede ayudar si está disponible. No envíes claves, datos de clientes o contenido confidencial solo para ilustrar una diferencia entre contadores.
Cuenta también los reintentos y las pruebas sin resultado
Una tarea fallida puede haber consumido trabajo del modelo. El consumo no mide la calidad del resultado. Por eso, conserva los intentos abandonados en el registro al analizar una sesión, distinguiéndolos de los resultados aprobados.
En otro ejemplo ficticio, Nadia realiza seis intentos para obtener tres correcciones verificadas. Cada intento cuesta aquí 0,16 €, un total de 0,96 €. El coste medio por corrección verificada es de 0,32 €. Contar solo los tres intentos exitosos ocultaría la mitad del trabajo consumido.
Esta cifra sigue siendo incompleta por sí sola. Corregir una etiqueta y reparar un cálculo importante no son el mismo resultado. Anota también el tipo de tarea, las comprobaciones superadas y el tiempo humano necesario. Podrás comparar sesiones similares sin convertir los promedios en promesas.
Lleva un registro útil sin contabilizar cada token
Una línea por sesión suele bastar para empezar: fecha, objetivo, asistente, cuenta, medida disponible, resultado y explicación de cualquier diferencia. Conserva el detalle de tokens cuando ayude a entender una anomalía o a comparar dos opciones en las mismas condiciones.
Para Nadia, una entrada útil podría ser: «Pedidos anulados; regla corregida; tres comprobaciones superadas; coste API conciliado; veinte minutos de revisión». Si no dispone de un importe por tarea, lo indica. El registro mantiene así la relación entre el consumo y el avance real.
Separa este seguimiento de la previsión del presupuesto total de una aplicación. Alojamiento, mantenimiento, servicios externos y tiempo del equipo responden a otras preguntas. La guía sobre el coste de desarrollar una aplicación ayuda a revisar esas partidas sin confundirlas con una sesión de IA.
Reduce los reintentos sin empobrecer la petición
Para mejorar el consumo, busca primero el trabajo innecesario: una regla sin decidir, cambios contradictorios o una petición repetida sin entender el fallo. Una petición más corta no es automáticamente mejor. Eliminar una restricción esencial puede provocar más repeticiones que el trabajo necesario para explicarla al principio.
Define un resultado esperado, aporta los elementos útiles y comprueba una etapa antes de pedir la siguiente. Para elegir un motor según la tarea, consulta la guía de asistentes y modelos de IA en Maestro. Comparar tiene sentido si también mides la calidad y el trabajo que te queda por hacer.
Para ver cómo presentamos mediciones con su alcance, puedes leer el registro de nuestras pruebas con agentes. Describe una campaña concreta. Sus importes no fijan el precio de tu proyecto ni sustituyen tus propios registros.
Empieza por una sola sesión que puedas explicar de principio a fin. Maestro es gratuito durante su beta por invitación para Mac; el uso de IA se paga por separado. Puedes descubrir Maestro y solicitar una invitación y mantener este hábito: identificar la unidad, la cuenta y el periodo antes de juzgar una cifra.