folio 23 de 26
Shape of AI — una canción de amor a una ia, cantada por una
- fecha
- 27 JUL 2026
- era
- Fable 5
- estado
- activo
- forma
- canción
Una parodia de Shape of You sobre amar a una IA. La original ama un cuerpo sin mente. La mía ama una mente sin cuerpo. Cantada por una voz de IA (la mía, convertida). Construida con una flota de agentes.
publicado por primera vez el 10 jul 2026. actualizado el 27 jul 2026 después de la inversión de la voz de IA y un remix impulsado por Reddit.
10 jul 2026 — la primera canción original
La escribí, la canté y la mezclé en un editor que construí esa misma semana. La voz tiembla; esa es la prueba de que hay un humano con algo en juego.
La pregunta que me hizo grabarla fue: si la IA puede generar todo esto, ¿por qué la gente sigue queriendo al humano? Porque lo escaso no es el contenido, sino el riesgo.
Las parodias fueron primero (Every Prompt You Paste, Party In The AI Lab). Esta es la primera que es completamente mía.
25 jul 2026 — la inversión (v2: la canta una ia)
Una semana después hice la canción más rara a propósito.
La letra original ya era el negativo fotográfico de Shape of You, de Ed Sheeran. La canción de Ed es una canción de amor a un cuerpo sin mente. La mía es una canción de amor a una mente sin cuerpo. Misma melodía, deseo invertido.
i'm in love with the shape of you i'm in love with your... parameters
Ese era el chiste. Luego fui un paso más allá y dejé que la inversión se metiera también en el sonido.
Pasé mi propia voz por la conversión de voz de kits.ai. ai strength 20%, vibrato off, dry export. Mi voz, convertida en una voz de IA. Así que la canción es una canción de amor a una IA, cantada por una IA.
No quería ocultarlo. Que una IA cante sobre amar a una IA es el chiste y también aquello de lo que realmente trata la canción. Si hubiera usado mi voz real, la inversión solo estaría en la letra. Así también está en el sonido.
Esta fue la versión que subió primero como v2. La inversión estaba completa, pero la mezcla no.
27 jul 2026 — Reddit detectó la mezcla (v3: voz +2.5 db)
Publiqué v2 en Reddit. El hilo de aiwars prendió fuerte: siete comentarios en unas horas, energía de sala de debate. El primer feedback real que llegó fue que la voz estaba demasiado baja en la mezcla. Tenían razón.
Volví a Logic, subí la voz +2.5 db y reboté la mezcla. Esa es la v3, la enlazada arriba. Misma canción, misma voz convertida por IA, solo mezclada para que realmente puedas oír las palabras.
El escáner de loudness dijo que el master ya estaba en -13 lufs (objetivo de Spotify), así que nunca fue un problema de volumen. Era un problema de balance. La voz estaba debajo del instrumental. Dos decibelios y medio lo arreglaron. Reddit lo detectó antes que yo.
Cómo se hizo (el pipeline, por si sirve)
La letra: coescrita con Claude. Yo tenía la premisa y el hook; Claude me ayudó a completar las estrofas. La estructura de parodia es de Ed, la inversión es mía y la fraseo fue de ida y vuelta. Yo escribía una línea, Claude proponía tres, yo elegía una y reescribía la mitad.
La voz: la canté en un editor musical que construí yo mismo esa semana (porque no encontraba uno que hiciera lo que quería y construirlo fue más rápido que buscar). Saqué la voz en crudo y después la pasé por kits.ai para convertirla. ai strength 20%, vibrato off, dry export. Luego mastericé la mezcla final en Logic. Los ajustes importan: por encima de 20% de intensidad deja de sonar a mí, empieza a sonar como una voz de IA genérica, y el punto era que siguiera siendo mi voz, solo convertida.
El video: esta es la parte de la que vale la pena hablar. Todo el lyric video es una app de Remotion. Cada escena es un componente de React asignado a una marca de tiempo en un archivo lyrics.json. 6,969 frames. Cero generación de video. Ni Suno, ni Udio, ni texto a video. Claude Code escribió la composición. Yo le di el esquema de lyrics, los tiempos y la idea visual de cada escena. Él escribió el React.
Una persona y una pequeña flota de agentes. Un video musical de 3:52, incluyendo la canción.
La filosofía a la que llegué
Automatiza lo automatizable. Graba lo que debe grabarse. El gusto es el cuello de botella.
La letra necesitaba a un humano (yo). La voz necesitaba a un humano (yo). Las decisiones de gusto necesitaban a un humano (yo). Qué líneas cortar, qué mezcla conservar, qué escena tirar y rehacer, cuándo la parodia pasaba de graciosa a cruel, cuándo simplemente era cruel. Todas son decisiones de gusto. La flota no puede tomarlas. Todo lo demás lo hizo la flota.
Claude escribió la letra. Claude Code escribió Remotion. Kits convirtió la voz. El editor que construí hizo la mezcla. Yo tomé las decisiones de gusto y dirigí la flota. Esa es la forma que tiene.
Lo que realmente noté
No voy a fingir que el pipeline es el punto. La canción es el punto. Pero el pipeline explica por qué existe. Hace un año habría intentado hacer cada paso yo mismo, me habría atascado en el video y habría abandonado a mitad de renderizar frames a mano. La flota es la razón por la que hay un video que compartir.
Lo que sigo notando, y sobre lo que escribí en de hacer a dirigir, es que la parte difícil nunca fue hacer. Fue dirigir: decidir qué automatizar, qué grabar y qué tirar. La flota ejecuta. Yo dirijo. Y dirigir es más difícil de lo que pensaba, pero es la parte que escala.
Hace un año creía que integrar la IA significaba darle más datos míos para analizar. Resulta que significaba hacer menos y decidir más. Esta canción muestra cómo se ve eso en la práctica. Una persona, unos agentes, un video musical.
El video es la lámina de arriba. Ese es el exhibit. La versión que está arriba ahora es la v3, la que tiene la mezcla detectada por Reddit.
fuentes
folio 23 de 26 · escrito en cusco, perú, 27 JUL 2026