Uso de IA y límites
Qué es un token, qué cuenta para tu incluido, cuándo se reinicia y qué pasa si se te agota.
Actualizado 2026-09-06Tu plan incluye una cantidad de trabajo de IA cada mes. Esta página explica cómo se mide, para que el número de tu página de facturación sea uno que puedas prever y no uno que descubras.
Tokens, en breve
Los proveedores de IA no cobran por pregunta. Cobran por token: unas tres cuartas partes de una palabra, así que unas 750 palabras equivalen a 1.000 tokens. Cada pregunta que responde tu asistente usa tokens dos veces:
- Los tokens de entrada son todo lo que lee el modelo: la pregunta, los fragmentos recuperados de tu base de conocimiento, las instrucciones que hayas puesto y la conversación reciente.
- Los tokens de salida son lo que escribe de vuelta.
La salida cuesta unas cinco veces más que la entrada en todos los modelos que ofrecemos, y por eso tu página de facturación los muestra por separado y no como un único número. Una respuesta corta sobre mucho contexto es barata; una respuesta larga no.
Qué cuenta para tu incluido
Todo lo que la IA hace para tu espacio de trabajo:
Dos cosas no cuentan: una conversación que un visitante abre sin preguntar nada, y una pregunta que se rechaza antes de llegar al modelo (fuera de tu base de conocimiento, o pasado un límite).
Cómo consumen tokens los documentos
Cuando añades un documento lo dividimos en fragmentos y convertimos cada uno en una lista de números —un embedding— para poder encontrarlo después por significado y no por palabra clave. Eso ocurre una vez por documento, y hacer embeddings es mucho más barato que responder: alrededor de una centésima parte del precio por token.
Un manual de mil páginas cuesta menos indexarlo que una tarde movida de preguntas. La reindexación ocurre cuando cambias el modelo de embeddings o los ajustes de fragmentación de una base de conocimiento, y la app te avisa antes de hacerlo.
Cuándo se reinicia
Al empezar cada periodo de facturación, que aparece en tu página de facturación como Se reinicia. Si tienes una suscripción mensual, es el mismo día de cada mes, no el día 1 del mes natural.
Lo que no uses no se acumula para el mes siguiente.
Qué pasa al llegar al límite
Una respuesta que ya se está escribiendo siempre termina. A partir de ahí, las preguntas nuevas se rechazan hasta que se reinicie el periodo, y tus visitantes ven un mensaje breve en lugar de un error.
No se cobra nada por pasarse y nada se corta a media frase. Verás un aviso en tu página de facturación a partir del 80%.
Si necesitas más antes del reinicio, cambiar de plan tiene efecto inmediato.
Qué modelos consumen más
Todos los modelos leen el mismo contexto, así que la diferencia está en el precio por token, no en los tokens usados:
Puedes cambiar el modelo por base de conocimiento en Ajustes, y la elección solo afecta a las preguntas posteriores al cambio. Qué modelos tienes disponibles depende de tu plan.
Cómo afectan tus ajustes de recuperación
Esta es la palanca que casi nadie mira. Tu asistente lee los fragmentos recuperados antes de responder, así que cuántos fragmentos recuperas es la mayor parte de tu coste de entrada.
En cada base de conocimiento, en Recuperación:
- Top K es cuántos fragmentos se leen por pregunta. Pasar de 8 a 5 recorta alrededor de un tercio de la entrada en cada pregunta, y normalmente mejora la respuesta, porque los fragmentos flojos son ruido.
- Umbral de similitud descarta fragmentos que no encajan bien. Subirlo un poco tiene el mismo efecto, y por la misma razón.
- Tamaño de fragmento decide cómo de grande es cada pasaje. Los fragmentos pequeños recuperan con más precisión; los muy grandes hacen que cada uno de los K fragmentos traiga más texto.
Si tu uso es más alto de lo que esperabas, mira aquí antes de mirar el modelo.
Trae tu propia clave
En el plan Trae tu propia clave conectas tu clave de Anthropic o de OpenAI en Ajustes → Tus propias claves de IA. A partir de ese momento:
- Cada respuesta y cada embedding del espacio de trabajo se ejecuta en tu cuenta de proveedor, y ese proveedor te lo factura directamente.
- Tu incluido de WelcomeAI deja de aplicarse: no hay nada nuestro que se pueda agotar, así que no se rechaza nada por pasarse de un límite.
- Tu página de facturación sigue mostrando tokens y un coste estimado, para que veas lo que te están costando tus asistentes antes de que llegue la factura de tu proveedor.
- Puedes traer una clave para un proveedor y no para el otro. Si pones la de Anthropic pero no la de OpenAI, hacen falta las dos —las respuestas van con la tuya y los embeddings se quedan sin sitio—, así que añade ambas.
Tu clave se guarda cifrada, no se vuelve a mostrar después de guardarla y se comprueba con el proveedor antes de almacenarla. Quítala cuando quieras y el espacio vuelve a nuestras cuentas en la siguiente pregunta.
Cómo leer tu página de facturación
Facturación y uso muestra, para el periodo actual:
- Tokens de IA / mes: usado sobre incluido, en una barra.
- Entrada y Salida por separado.
- Incluido: lo que queda.
- Se reinicia: cuándo vuelve a cero.
- Por modelo: a dónde se fue, lo más caro primero. Esta es la tabla que hay que abrir cuando un número te sorprende.
El coste que se muestra es una estimación con las tarifas actuales del proveedor. Es lo que cuesta servir tu uso, no un cargo para ti, salvo que estés en Trae tu propia clave, en cuyo caso es una estimación cercana de lo que te va a facturar tu proveedor.