IdiomaENES
Empieza aquí

Uso de IA y límites

Qué es un token, qué cuenta para tu incluido, cuándo se reinicia y qué pasa si se te agota.

Actualizado 2026-09-06

Tu plan incluye una cantidad de trabajo de IA cada mes. Esta página explica cómo se mide, para que el número de tu página de facturación sea uno que puedas prever y no uno que descubras.

Tokens, en breve

Los proveedores de IA no cobran por pregunta. Cobran por token: unas tres cuartas partes de una palabra, así que unas 750 palabras equivalen a 1.000 tokens. Cada pregunta que responde tu asistente usa tokens dos veces:

  • Los tokens de entrada son todo lo que lee el modelo: la pregunta, los fragmentos recuperados de tu base de conocimiento, las instrucciones que hayas puesto y la conversación reciente.
  • Los tokens de salida son lo que escribe de vuelta.

La salida cuesta unas cinco veces más que la entrada en todos los modelos que ofrecemos, y por eso tu página de facturación los muestra por separado y no como un único número. Una respuesta corta sobre mucho contexto es barata; una respuesta larga no.

Qué cuenta para tu incluido

Todo lo que la IA hace para tu espacio de trabajo:

Trabajo
Cuenta como
La pregunta de un visitante
Entrada, más salida por la respuesta
Una pregunta tuya en el playground
Lo mismo: es una respuesta real, así que es uso real
Añadir o reindexar un documento
Solo entrada, y mucho menos por documento de lo que imaginas
Una respuesta servida desde la caché
Nada. Nunca se le preguntó al modelo

Dos cosas no cuentan: una conversación que un visitante abre sin preguntar nada, y una pregunta que se rechaza antes de llegar al modelo (fuera de tu base de conocimiento, o pasado un límite).

Cómo consumen tokens los documentos

Cuando añades un documento lo dividimos en fragmentos y convertimos cada uno en una lista de números —un embedding— para poder encontrarlo después por significado y no por palabra clave. Eso ocurre una vez por documento, y hacer embeddings es mucho más barato que responder: alrededor de una centésima parte del precio por token.

Un manual de mil páginas cuesta menos indexarlo que una tarde movida de preguntas. La reindexación ocurre cuando cambias el modelo de embeddings o los ajustes de fragmentación de una base de conocimiento, y la app te avisa antes de hacerlo.

Cuándo se reinicia

Al empezar cada periodo de facturación, que aparece en tu página de facturación como Se reinicia. Si tienes una suscripción mensual, es el mismo día de cada mes, no el día 1 del mes natural.

Lo que no uses no se acumula para el mes siguiente.

Qué pasa al llegar al límite

Una respuesta que ya se está escribiendo siempre termina. A partir de ahí, las preguntas nuevas se rechazan hasta que se reinicie el periodo, y tus visitantes ven un mensaje breve en lugar de un error.

No se cobra nada por pasarse y nada se corta a media frase. Verás un aviso en tu página de facturación a partir del 80%.

Si necesitas más antes del reinicio, cambiar de plan tiene efecto inmediato.

Qué modelos consumen más

Todos los modelos leen el mismo contexto, así que la diferencia está en el precio por token, no en los tokens usados:

Modelo
Coste relativo
Bueno para
Claude Haiku 4.5
El más bajo
Mucho volumen de soporte con respuestas claras en tu contenido
Claude Sonnet 5
Unas tres veces Haiku
Un buen valor por defecto cuando las respuestas requieren criterio
Claude Opus 5
Unas cinco veces Haiku
Preguntas complejas, razonamiento cuidadoso, documentos largos

Puedes cambiar el modelo por base de conocimiento en Ajustes, y la elección solo afecta a las preguntas posteriores al cambio. Qué modelos tienes disponibles depende de tu plan.

Cómo afectan tus ajustes de recuperación

Esta es la palanca que casi nadie mira. Tu asistente lee los fragmentos recuperados antes de responder, así que cuántos fragmentos recuperas es la mayor parte de tu coste de entrada.

En cada base de conocimiento, en Recuperación:

  • Top K es cuántos fragmentos se leen por pregunta. Pasar de 8 a 5 recorta alrededor de un tercio de la entrada en cada pregunta, y normalmente mejora la respuesta, porque los fragmentos flojos son ruido.
  • Umbral de similitud descarta fragmentos que no encajan bien. Subirlo un poco tiene el mismo efecto, y por la misma razón.
  • Tamaño de fragmento decide cómo de grande es cada pasaje. Los fragmentos pequeños recuperan con más precisión; los muy grandes hacen que cada uno de los K fragmentos traiga más texto.

Si tu uso es más alto de lo que esperabas, mira aquí antes de mirar el modelo.

Trae tu propia clave

En el plan Trae tu propia clave conectas tu clave de Anthropic o de OpenAI en Ajustes → Tus propias claves de IA. A partir de ese momento:

  • Cada respuesta y cada embedding del espacio de trabajo se ejecuta en tu cuenta de proveedor, y ese proveedor te lo factura directamente.
  • Tu incluido de WelcomeAI deja de aplicarse: no hay nada nuestro que se pueda agotar, así que no se rechaza nada por pasarse de un límite.
  • Tu página de facturación sigue mostrando tokens y un coste estimado, para que veas lo que te están costando tus asistentes antes de que llegue la factura de tu proveedor.
  • Puedes traer una clave para un proveedor y no para el otro. Si pones la de Anthropic pero no la de OpenAI, hacen falta las dos —las respuestas van con la tuya y los embeddings se quedan sin sitio—, así que añade ambas.

Tu clave se guarda cifrada, no se vuelve a mostrar después de guardarla y se comprueba con el proveedor antes de almacenarla. Quítala cuando quieras y el espacio vuelve a nuestras cuentas en la siguiente pregunta.

Cómo leer tu página de facturación

Facturación y uso muestra, para el periodo actual:

  • Tokens de IA / mes: usado sobre incluido, en una barra.
  • Entrada y Salida por separado.
  • Incluido: lo que queda.
  • Se reinicia: cuándo vuelve a cero.
  • Por modelo: a dónde se fue, lo más caro primero. Esta es la tabla que hay que abrir cuando un número te sorprende.

El coste que se muestra es una estimación con las tarifas actuales del proveedor. Es lo que cuesta servir tu uso, no un cargo para ti, salvo que estés en Trae tu propia clave, en cuyo caso es una estimación cercana de lo que te va a facturar tu proveedor.

Pon tu conocimiento a trabajar hoy

Gratis 14 dias. Sin tarjeta, y sin instalar nada en tu sitio.