PIXELMENTE

¿Por qué ChatGPT no sabía cuántas erres tiene «strawberry»?

IAPublicado el 7 de octubre de 2026Vídeo de 1:40
La respuesta corta

Porque nunca ve las letras. Antes de leer, ChatGPT corta el texto en pedazos llamados tokens y cambia cada uno por un número. Para GPT-4o, « strawberry» dentro de una frase es un único token, el 101.830: no hay erres que contar, así que adivinaba.

Paso a paso

  1. Un tokenizador corta tu texto en pedazos: unos son palabras enteras y otros, trozos («fresa» = «f» + «resa»).
  2. Cada pedazo se cambia por un número de un diccionario de unos 200.000.
  3. Dentro de una frase, « strawberry» es un solo token: el 101.830 en el tokenizador de GPT-4o (o200k).
  4. El modelo trabaja con esos números, no con letras. Contar erres le obliga a adivinar.
  5. Trocear compensa: cada token vale unas cuatro letras, así que el texto es unas cuatro veces más corto, más rápido y más barato de procesar.

El dato curioso

¿Sabías que…?

El proyecto con el que OpenAI enseñó a razonar a su IA se llamaba en clave «Strawberry». Salió en septiembre de 2024 con el nombre o1.

Truco para hoy

Si necesitas que una IA cuente letras o revise un número largo, pídele antes que lo escriba separado por espacios. Cada letra pasa a ser su propio token y deja de adivinar.

Con las cuentas largas pasa lo mismo: 12345678 le llega como 123 | 456 | 78.

Fotogramas del vídeo

Fotograma: el texto cortado en tokens
El texto cortado en tokens
Fotograma: cada token se convierte en un número
Cada token se convierte en un número
Fotograma: strawberry como un único token
Strawberry como un único token

Ponte a prueba

Una pregunta de este vídeo

Fuentes

Sigue aprendiendo

Más vídeos que te pueden gustar

Todos los vídeos

¿Tienes una duda que quieras ver explicada?

Propón un tema, cuéntanos una colaboración o escribe para lo que necesites. Leemos todo.

Escríbenos