LLM Visualization (anatomía 3D de un modelo de lenguaje)

Un recorrido que despliega el interior de un modelo de lenguaje GPT como una figura tridimensional y baja por él de arriba abajo. Empieza con nano-gpt, un modelo de apenas 85.000 parámetros, y muestra cómo resuelve una tarea muy simple: ordenar alfabéticamente una cadena como "C B A B B C". Te deja una idea clara de qué cálculo ocurre en cada capa, desde que los números se vuelven embeddings hasta que salen las probabilidades del token siguiente.

LLM Visualization (anatomía 3D de un modelo de lenguaje)

Cómo probarlo

Pulsa "Continue" abajo o la barra espaciadora para avanzar la explicación paso a paso; la figura 3D se gira y se acerca con el mouse. En el índice de la izquierda puedes ir directo a apartados como embeddings, autoatención o softmax, y arriba puedes cambiar nano-gpt por GPT-2 o GPT-3 para comparar tamaños. La pantalla está solo en inglés.