Estación 02 / 06
CrecerLAB · UNIBE

Escanea para ver la explicación

Comprender y encontrar

Lenguaje y conocimiento

¿Cómo aprende a hablar y dónde guarda lo que sabe?

Principio

El texto se divide en tokens y vectores. La atención relaciona palabras y la temperatura regula la variación de la respuesta. Los documentos se buscan por cercanía entre embeddings.

Tokens y atenciónEmbeddings

La siguiente palabra (modelo real)

Experimento 2
Temperatura0.70

Cerca de 0: siempre la palabra más probable. Alta: el modelo se arriesga.

De frase a tokens

Experimento 1

Caracteres

48

Tokens

9

Caracteres por token

5.3

Aurora6341responde42236las28878pregunta34642s14180de39285los48280estudiant11763es22751

Cada bloque es un token con su número de identificación. El modelo nunca ve letras: ve esta lista de números. (Partición didáctica, cercana a la de un modelo real.)

¿A qué presta atención?

Experimento 3

Toca una palabra: se iluminan las palabras a las que presta atención para entenderse.

Matriz de atención: cada fila es una palabra mirando hacia atrás.

Buscar por significado (embeddings reales)

Experimento 4

Aritmética de significados

Experimento 5
+≈ ?

Guía en vivo

Pregúntale a Aurora

Estoy viendo lo que haces en este experimento. Pregúntame lo que quieras: puedo explicarte qué está pasando en pantalla, paso por paso.