Visualización 3D de una CNN (reconocer dígitos escritos a mano)

Una visualización que despliega en tres dimensiones el interior de una red convolucional (CNN) que adivina dígitos escritos a mano. Se ve cómo la imagen se va resumiendo en valores cada vez más pequeños y abstractos al pasar de la capa de entrada a las convolucionales, las de submuestreo, las totalmente conectadas y la de salida. Queda claro que una red neuronal no es una caja negra maciza, sino capas con papeles distintos puestas una tras otra.

Visualización 3D de una CNN (reconocer dígitos escritos a mano)

Cómo probarlo

Dibuja un número con el mouse en el recuadro "Draw your number here" y los valores de cada capa se actualizan en el espacio 3D, con la predicción en First guess y Second guess. Al hacer clic en una celda de una capa aparecen arriba el filtro y la fórmula que se usan ahí, y en la lista "Layer visibility" puedes encender y apagar las capas que quieras ver. La pantalla y las explicaciones están solo en inglés y el renderizado 3D es pesado, así que conviene usar una computadora de escritorio.