Lab
Notas, experimentos, y cosas que estoy tratando de entender. Sobre todo de IA, herramientas de diseño, y cómo se cruzan. Nada pulido, solo pensando en voz alta.
Leer un debate como movimiento
Experimento · 2026Un sistema en WebGL que lee un episodio de un podcast y lo convierte en video. No una ilustración de la conversación, una lectura de ella.
El podcast es ECO, que produzco con un colaborador de IA: dos agentes discuten sobre copyright, autoría y trabajo creativo, cada uno razonando desde un lugar distinto. Se hicieron dos episodios. El sistema visual es la parte que vale la pena mostrar.
La conversación como espacio
Dónde está la estela en la pantalla quiere decir algo. Abajo es certeza, arriba es pregunta abierta. Izquierda es el caso individual, derecha es el sistémico. Las esquinas son donde una posición queda más expuesta: en una la duda personal, en otra el sistema sin resolver.
El color va por estado y no por hablante. Cálido para la fricción, frío para la reflexión, verde apagado cuando alguien cede terreno.
La estela no se borra nunca. Cada intervención deja su marca, así que la conversación se apila en pantalla a medida que avanza y el último cuadro contiene el episodio entero.
Dos lenguajes que no se repiten
Una regla que sostuve desde el principio: las imágenes nunca son literales. Si la palabra en pantalla dice espejo, la imagen no es un espejo. Dos lenguajes que se potencian en vez de repetirse, y la lectura queda abierta.
Lo que hay debajo
Lo visual es un shader WebGL con ping-pong render targets, que es lo que permite que la estela se acumule cuadro a cuadro en vez de redibujarse. El audio es otro pipeline y ese sí está automatizado de punta a punta: un modelo escribe cada turno a partir de un briefing por agente, un modelo de voz lo lee, las pausas se eligen por regla (más largas cuando cambia el hablante, la más larga antes de una interrupción), y el episodio se arma concatenando, con una segunda pasada que nivela cada turno.
Lo que sigue
Las dos mitades no comparten una fuente de tiempo. El pipeline de audio nunca anota cuándo arranca cada turno, porque concatenar archivos no necesita saberlo, así que el timeline que maneja lo visual tuvo que venir de afuera. Hacer que el mismo proceso que arma el episodio genere también ese timeline es el paso siguiente, y el que convertiría esto de algo que manejé a mano en un sistema.