Contador de tokens de IA y espacio en el contexto

Pega cualquier texto para ver en cuántos tokens es probable que se convierta, si cabe en una ventana de contexto dada y cuánto costaría con tus propias tarifas de API. Todo se ejecuta en tu navegador: el texto nunca se sube.

Nada sale de esta página. Prueba con un documento que estés pensando en darle a un modelo.
0 tokens estimados ±10–15%: más abajo explicamos cómo funciona la estimación
Caracteres0
Palabras0
Caracteres por tokenmás bajo = texto más denso
Tiempo de lectura aproximado

¿Cabe en la ventana de contexto?

Ventana de contextoTu texto¿Cabe?

La ventana de contexto se reparte entre tu entrada, la respuesta del modelo y todo lo que la app añade entre bastidores (prompt del sistema, documentos recuperados, historial de chat). Deja margen: llenar la ventana hasta el borde es la receta para que las respuestas salgan truncadas.

¿Cuánto costaría?

Coste de entrada
Coste de salida
Total
Introduce tú las tarifas, desde la página de precios actual de tu proveedor. No incluimos precios fijos a propósito: las tarifas de los modelos cambian a menudo y un número desfasado aquí sería peor que ninguno. Consulta OpenAI, Google, xAI o DeepSeek.
Cómo funciona esta estimación (y por qué no es exacta)

La tokenización real aplica a tu texto un vocabulario BPE específico de cada modelo, y cada familia de modelos usa uno distinto, así que el recuento «verdadero» cambia según el modelo. Hacerlo bien en el navegador supondría cargar un vocabulario de varios megabytes por familia, lo que volvería lenta esta página por un número que solo necesitas de forma aproximada.

En su lugar, usa un estimador basado en caracteres y palabras, ponderado por espacios, puntuación y dígitos, que se queda dentro de un margen del 10–15% aproximadamente en prosa inglesa corriente. Dos sesgos conocidos: el código y el texto con mucha puntuación se tokenizan de forma más densa de lo que sugiere la estimación, y las escrituras no latinas (chino, japonés, árabe, hindi) usan bastantes más tokens por carácter que el inglés, a menudo de 2 a 3 veces.

Si necesitas exactitud para facturar, usa el endpoint tokenizador de tu proveedor. Para «¿cabrá esto?» y «¿cuánto costará más o menos?», la herramienta adecuada es una estimación.

Qué es realmente un token

Los modelos no leen caracteres ni palabras: leen tokens, fragmentos a medio camino entre ambos. Las palabras comunes suelen ser un token; las largas o raras se parten en varios. «Unbelievable» pueden ser tres tokens; «the» es uno. En prosa inglesa, un token equivale de media a unos cuatro caracteres, o alrededor de tres cuartos de palabra.

Todo se cobra y se limita en tokens: lo que envías, lo que recibes y cuánto puede abarcar el modelo a la vez.

Por qué tu texto es más denso de lo que crees

Ventana de contexto ≠ tu presupuesto

Una ventana de un millón de tokens no significa que debas enviar un millón de tokens. La calidad de la atención se degrada hacia la mitad de las entradas muy largas, la latencia sube y el coste crece de forma lineal. La recuperación —traer solo los pasajes relevantes— suele funcionar mejor que atiborrar la ventana, y es más barata.

Preguntas frecuentes

¿Qué precisión tiene este contador?

Con un margen aproximado del 10–15% para prosa inglesa corriente. En código y en escrituras no latinas, el recuento real supera la estimación. Para cifras exactas de facturación, usa el tokenizador de tu proveedor.

¿Mi texto se sube a algún sitio?

No. El cálculo se hace en tu navegador. No hay petición, ni registro, ni almacenamiento.

¿Por qué no mostráis los precios de los modelos?

Porque cambian, y mostrar con seguridad un precio desfasado es peor que no dar ninguno. Introduce las tarifas actuales de tu proveedor y la herramienta hace las cuentas.

¿Las imágenes y el audio consumen tokens?

Sí: las entradas multimodales también se convierten en tokens, a tasas que varían según el proveedor y la resolución. Esta herramienta solo cubre texto.

Relacionado: ¿Qué es RAG? · Qué modelo de IA para qué tarea · Todas las herramientas gratuitas