Cuando usas ChatGPT o herramientas similares, cada palabra que escribes o recibes se descompone en fragmentos llamados tokens. No son palabras completas: una tilde o un carácter especial puede dividir un término en varias piezas. Para el usuario común, esto implica que cada interacción tiene un costo medido en tokens, la unidad de cobro en servicios de IA. Conocer su funcionamiento ayuda a controlar el gasto y evitar sorpresas en la factura.
Cómo se dividen las palabras y por qué importa 💰
Los modelos de lenguaje procesan texto en tokens, que pueden ser tan cortos como un carácter o tan largos como una sílaba. En inglés, una palabra suele ser un token; en español, las tildes y la letra ñ generan divisiones más frecuentes. Por ejemplo, la palabra acción se parte en tres tokens: ac, ci, ón. Esto afecta el límite de contexto de la IA y el precio de cada consulta. Un prompt extenso o con caracteres especiales consume más tokens de lo que parece, elevando el costo sin que el usuario lo note.
La letra ñ: la enemiga silenciosa de tu presupuesto 😤
Si creías que escribir en español era barato, piensa otra vez. Cada ñ, ü o acento convierte una palabra sencilla en un festival de tokens. Tu inocente camión se parte en tres fragmentos mientras que el inglés truck pasa como uno solo. Es como pagar peaje por cada tilde. La próxima vez que veas tu factura de IA, no culpes al algoritmo: culpa a la RAE por no pensar en tu bolsillo.