🎵 ELYSY | Eliz's Lyrics Synchronizer
Sincronización de letras palabra por palabra con IA — gratuita, de código abierto (MIT) y 100% local.
código).Todo lo que necesitas para letras perfectas estilo karaoke
Sube una canción, pega o importa sus letras y deja que la IA haga la sincronización — luego afina cada palabra a mano. Sin muros de pago, sin nube y sin créditos por canción.
AI Auto-Align
Demucs aísla la voz, WhisperX genera marcas de tiempo palabra por palabra y un comparador las asigna a tus letras exactas — conservando cada línea y palabra original (nunca la versión alterada que la IA "cree" haber oído).
Manual Tap + AI
El modo Manual Tap te permite pulsar la barra espaciadora al inicio de cada línea, revisar los tiempos en la pantalla Line Timing Review y luego refinar las palabras con el botón Refine Words with AI. Ideal para distorsión, spoken word o tarareos.
Precisión por palabra
Al pasar el cursor sobre cualquier palabra aparecen los botones « < 00:23.45 > » para desplazarla ±0.1 s / ±0.3 s, con una vista previa de audio que empieza exactamente en esa palabra.
Undo / Redo
Historial de 50 pasos con Ctrl+Z, Ctrl+Shift+Z / Ctrl+Y y botones en pantalla. También puedes seleccionar varias líneas con Ctrl+clic y moverlas juntas con los botones Shift sel.
Proyectos
Los botones Save, Save As New y Load Existing del encabezado guardan cada canción como una carpeta autónoma (audio + JSON) que puedes mover o respaldar libremente.
Import LRC
El botón Import LRC (junto al cuadro de letras) carga archivos .lrc existentes, estándar o mejorados, para corregirlos, re-sincronizarlos o mejorarlos en lugar de empezar de cero.
5 formatos de exportación
Desde la sección Export del panel derecho: Enhanced LRC, Enhanced SRT (subtítulos palabra por palabra), Standard LRC, SRT (Premiere) y JSON — todos con nombres de archivo distintos para no pisarse.
Local y privado
Todo funciona en tu equipo: el audio y las letras nunca salen de tu computadora. Sin cuentas, sin nube y sin rastreo.
Dos flujos de trabajo, un resultado perfecto
🤖 Modo 1 — AI Auto-Align (el más rápido)
Suelta tu audio
En el panel izquierdo: MP3, WAV, FLAC, OGG o M4A — hasta 100 MB.
Elige el idioma
En el desplegable Select language (Español, English y 8 idiomas más).
Pega o importa las letras
Una frase por línea en el cuadro de texto, o haz clic en Import LRC para cargar un archivo existente.
Haz clic en Auto-Align Lyrics
Espera ~30–90 s en GPU (unos minutos en CPU).
Revisa el resultado
Reproduce la canción: las palabras se resaltan mientras se cantan. Pasa el cursor sobre cualquier palabra para ajustar su tiempo.
Exporta
Elige tu formato en Export.
👆 Modo 2 — Manual Tap + AI (el más preciso)
Sube el audio y pega las letras
Igual que en el flujo anterior.
Cambia al modo Manual Tap
Con el selector de modos del panel izquierdo.
Inicia la grabación
Haz clic en Start Tap Recording.
Marca cada línea
Pulsa la barra espaciadora al inicio de cada línea mientras suena la canción.
Revisa y ajusta las líneas
En la pantalla Line Timing Review, desplaza cualquier línea con « < > » o borra un toque incorrecto con 🗑️.
Refina las palabras con IA
Haz clic en Refine Words with AI: los tiempos de cada palabra se completan dentro de las ventanas que marcaste.
Exporta
Ajusta lo que necesites y exporta el formato que prefieras.
El proceso por dentro
Cuatro etapas convierten el audio y las letras en archivos perfectamente sincronizados:
Demucs — Separación de voces
Una IA de separación de fuentes aísla la voz cantada de los instrumentos, lo que mejora mucho la precisión del reconocimiento.
WhisperX — Alineación forzada
Whisper large-v3 transcribe el audio y wav2vec2 lo alinea a nivel de fonemas para obtener marcas de tiempo palabra por palabra.
Comparador — Mapeo de letras
Una alineación de secuencias asigna las palabras detectadas a tus letras originales: conserva cada línea y palabra, e interpola de forma automática lo que la IA no llegó a escuchar.
Generador — Exportación
Produce Enhanced LRC, Enhanced SRT, Standard LRC, SRT o JSON.
Requisitos del sistema
| Componente | Mínimo | Recomendado |
|---|---|---|
| RAM | 8 GB | 16+ GB |
| GPU | Ninguna (funciona con CPU) | NVIDIA 8+ GB VRAM (RTX 30/40/50) |
| Disco | 8 GB libres | 12 GB libres |
| Python | 3.10+ | 3.11 o 3.12 |
| Sistema operativo | Windows 10/11, macOS, Linux | Windows 11 |
Muévete rápido sin tocar el ratón
| Tecla | Acción |
|---|---|
| Espacio | Reproducir / Pausar — o marcar una línea en el modo Manual Tap |
| ← → | Retroceder / avanzar 3 s |
| ↑ ↓ | Retroceder / avanzar 1 s |
| Enter | Ejecutar Auto-Align |
| Esc | Cancelar el modo de tapping |
| Ctrl+Z | Deshacer |
| Ctrl+Shift+Z / Ctrl+Y | Rehacer |
| Ctrl/Cmd + clic (línea) | Seleccionar varias líneas para moverlas juntas |
| ⏮ | Volver al inicio |
Problemas comunes, resueltos
| Problema | Solución |
|---|---|
| "CUDA not available" | Actualiza los drivers de NVIDIA y vuelve a ejecutar install.bat (usa la versión CUDA 12.8). |
| Demucs va lento o falla | Desactiva la casilla Vocal separation — la alineación también funciona con la mezcla completa. |
| Faltan palabras o salen punteadas | Son estimaciones de la IA — pásales el cursor y ajústalas, o usa el modo Manual Tap. |
| Un coro repetido sale mal sincronizado | El programa lo corrige automáticamente; si no, desplaza esas líneas a mano. |
| Mis ediciones no salen en la exportación | Se sincronizan solas. Si tienes dudas, pulsa Save y vuelve a exportar. |
| El servidor no arranca | ¿El puerto 8765 está ocupado? Ejecuta python backend\app.py --port 8777. |
| Errores de archivos bloqueados al instalar | Cierra el servidor y VS Code, pausa Dropbox/antivirus y vuelve a instalar. |
ELYSY · Licencia MIT · Documentación completa y soporte: gabrielx.com/open-source-mit-ai-tools 🎤
