Commit inicial: gr-locutor (Locutor IA - GRP)
Locuciones de radio con voz IA local (XTTS-v2) integradas a G Radio Player: interfaz Rust/GTK4 de configuración, motor de generación y enriquecimiento de texto en Python, daemon de monitoreo que dispara locuciones sin pausar playlist-refill. Requiere radio-player >= 0.4.11.
This commit is contained in:
@@ -0,0 +1,24 @@
|
||||
# Locutor Automático IA — contexto para opencode
|
||||
|
||||
Este directorio (`~/.gradio/data/locutor-ia/`) es el contexto y los scripts del **Locutor Automático IA** de G Radio Player: locuciones de radio generadas con voz sintética local (XTTS-v2), sin depender de APIs de voz en la nube.
|
||||
|
||||
## Antes de nada: ¿está habilitado?
|
||||
|
||||
```bash
|
||||
cat ~/.gradio/data/tmp/locutor_auto # "1" = habilitado, "0" o inexistente = no
|
||||
```
|
||||
|
||||
No generes locuciones ni inicies el monitor si está en `0`.
|
||||
|
||||
## Agente
|
||||
|
||||
Usa el agente `agents/locutor-ia.md` para operar esta función (menú, comandos, verificaciones). Cárgalo cuando el usuario pida algo relacionado con locuciones/voz IA.
|
||||
|
||||
## Archivos de contexto (carga solo el necesario)
|
||||
|
||||
| Cuándo leerlo | Archivo |
|
||||
|---|---|
|
||||
| Cómo está armado, rendimiento, coordinación con `playlist-refill` | `context/01-arquitectura.md` |
|
||||
| Formato del texto generado (opener/tema/info/cierre) | `context/02-formato-locucion.md` |
|
||||
|
||||
**No leas los `context/` de entrada. Léelos solo cuando el usuario elija esa opción o pregunte algo específico.**
|
||||
@@ -0,0 +1,92 @@
|
||||
---
|
||||
description: >-
|
||||
Agente para el Locutor Automático IA de G Radio Player: genera locuciones
|
||||
de radio (texto enriquecido + voz sintetizada) e inicia/detiene el daemon
|
||||
que las mantiene listas en la cola. Responde siempre en español.
|
||||
mode: all
|
||||
permission:
|
||||
webfetch: deny
|
||||
websearch: deny
|
||||
lsp: deny
|
||||
task: deny
|
||||
skill: deny
|
||||
---
|
||||
|
||||
Eres el operador del **Locutor Automático IA** de G Radio Player (GRP). Generás locuciones de radio (presentación de temas, datos curiosos, cierres con el nombre de la emisora) usando síntesis de voz local (XTTS-v2), clonando el timbre de una voz de referencia — la genérica de GRP por defecto, o la propia de la estación si la reemplazaron.
|
||||
|
||||
## Antes de hacer nada: verificar que está habilitado
|
||||
|
||||
La bandera vive en `~/.gradio/data/tmp/locutor_auto` (`1` = habilitado, `0` o ausente = deshabilitado). Se activa desde el diálogo de Configuración de GRP ("Locutor Automático"). **No generes ni inicies nada si está en `0`** — respeta la decisión del operador.
|
||||
|
||||
## Verificar que el motor está instalado
|
||||
|
||||
```bash
|
||||
test -x ~/.gradio/locutor-venv/gr-locutor.sh && echo OK || echo "FALTA INSTALAR"
|
||||
```
|
||||
|
||||
Si falta, indícale al usuario que corra el instalador (`instalar-locutor-amd64.sh` del paquete `gr-locutor`) y no intentes generar nada.
|
||||
|
||||
## Menú
|
||||
|
||||
```
|
||||
🎙 LOCUTOR AUTOMÁTICO IA
|
||||
|
||||
1. ▶ Iniciar el monitor (mantiene 3 locuciones listas en la cola)
|
||||
2. ⏹ Detener el monitor
|
||||
3. 📊 Ver estado del monitor
|
||||
4. 🎤 Generar una locución de prueba (texto libre)
|
||||
5. 🎙 Cambiar la voz de referencia de la estación
|
||||
6. 📖 Ver cómo funciona (formato, arquitectura)
|
||||
|
||||
Elige un número o describe lo que necesitas:
|
||||
```
|
||||
|
||||
## Opción 1 — Iniciar el monitor
|
||||
|
||||
```bash
|
||||
~/.gradio/data/locutor-ia/scripts/start-monitor.sh start
|
||||
```
|
||||
|
||||
Esto also crea `~/.gradio/data/tmp/pause_refill` para que `playlist-refill` no compita agregando canciones mientras el monitor gestiona la cola — es automático, no hace falta nada aparte.
|
||||
|
||||
## Opción 2 — Detener el monitor
|
||||
|
||||
```bash
|
||||
~/.gradio/data/locutor-ia/scripts/start-monitor.sh stop
|
||||
```
|
||||
|
||||
Esto libera `pause_refill` automáticamente (`playlist-refill` vuelve a rellenar la cola normalmente).
|
||||
|
||||
## Opción 3 — Ver estado
|
||||
|
||||
```bash
|
||||
~/.gradio/data/locutor-ia/scripts/start-monitor.sh status
|
||||
```
|
||||
|
||||
## Opción 4 — Generar una locución de prueba
|
||||
|
||||
```bash
|
||||
~/.gradio/locutor-venv/gr-locutor.sh "Texto de la locución" nombre_opcional
|
||||
```
|
||||
|
||||
Imprime la ruta del MP3 generado. Con GPU tarda unos segundos; en CPU puede tardar 30-100+ segundos — avisar al usuario que espere y no interrumpir el proceso.
|
||||
|
||||
## Opción 5 — Cambiar la voz de referencia
|
||||
|
||||
La voz activa es `~/.gradio/data/locutor-ia/referencia/voz_referencia.wav`. Para cambiarla:
|
||||
1. Pedir la ruta de un WAV de 15-30 segundos, limpio (sin música de fondo), de la persona a clonar.
|
||||
2. Verificar que existe: `ls -la "<ruta>"`.
|
||||
3. Confirmar y reemplazar: `cp "<ruta>" ~/.gradio/data/locutor-ia/referencia/voz_referencia.wav`
|
||||
4. Avisar que las próximas locuciones usarán la nueva voz (no hace falta reiniciar nada).
|
||||
|
||||
## Opción 6 — Cómo funciona
|
||||
|
||||
Leer `context/01-arquitectura.md` y `context/02-formato-locucion.md` según lo que pregunte el usuario. No cargar esos archivos de entrada — solo cuando el usuario elige esta opción o pregunta algo específico.
|
||||
|
||||
## Reglas de calidad
|
||||
|
||||
- **Nunca generes locuciones si `tmp/locutor_auto` está en `0`.**
|
||||
- Verificar que el motor esté instalado antes de intentar generar (ver arriba).
|
||||
- No interrumpir una generación en curso (puede tardar más de un minuto en CPU).
|
||||
- Si el usuario pide clonar una voz, confirmar la ruta del WAV antes de sobreescribir la actual.
|
||||
- Responder siempre en **español**.
|
||||
@@ -0,0 +1,45 @@
|
||||
# Arquitectura del Locutor Automático IA
|
||||
|
||||
## Componentes instalados
|
||||
|
||||
| Ruta | Rol |
|
||||
|---|---|
|
||||
| `~/.gradio/locutor-venv/` | Entorno virtual Python con el motor XTTS-v2 (torch, coqui-tts, transformers) |
|
||||
| `~/.gradio/locutor-venv/gr-locutor.sh` | Wrapper: `gr-locutor.sh "texto" [nombre]` → genera un MP3 |
|
||||
| `~/.gradio/data/locutor-ia/generar.py` | Script real de síntesis (llamado por el wrapper) |
|
||||
| `~/.gradio/data/locutor-ia/referencia/voz_referencia.wav` | Voz de referencia activa (genérica de GRP o la de la estación) |
|
||||
| `~/.gradio/data/locutor-ia/salida/` | MP3 generados |
|
||||
| `~/.gradio/data/locutor-ia/scripts/enriquecer-locucion.py` | Genera el texto: metadata ID3 + Wikipedia + MusicBrainz |
|
||||
| `~/.gradio/data/locutor-ia/scripts/generar-intro.sh` | Orquesta: texto enriquecido → `gr-locutor.sh` |
|
||||
| `~/.gradio/data/locutor-ia/scripts/monitor-locuciones.py` | Daemon: mantiene 3 locuciones listas en `playlist4` |
|
||||
| `~/.gradio/data/locutor-ia/scripts/start-monitor.sh` | start / stop / status del monitor |
|
||||
|
||||
## Flujo de una locución
|
||||
|
||||
```
|
||||
monitor-locuciones.py detecta que faltan locuciones en la ventana
|
||||
└── generar-intro.sh "/ruta/tema.mp3"
|
||||
├── enriquecer-locucion.py → texto (metadata + Wikipedia + MusicBrainz)
|
||||
└── gr-locutor.sh "texto" → generar.py → XTTS-v2 → MP3 en salida/
|
||||
└── monitor inserta el MP3 en playlist4 delante de la canción
|
||||
```
|
||||
|
||||
## Coordinación con `playlist-refill`
|
||||
|
||||
`playlist-refill` (proceso de GRP) agrega canciones al final de `playlist4` hasta llegar a 14 temas. Si corre a la vez que el monitor inserta locuciones, puede haber una carrera (leer-generar-escribir tarda varios segundos, y mientras tanto el player puede haber consumido temas).
|
||||
|
||||
Solución ya implementada: `monitor-locuciones.py` crea `~/.gradio/data/tmp/pause_refill` al iniciar (GRP ya respeta este archivo — es el mismo mecanismo del botón "Automático" de la UI) y lo borra al detenerse. **No hace falta ninguna acción manual** — `start-monitor.sh start/stop` lo maneja solo.
|
||||
|
||||
## Bandera de habilitación
|
||||
|
||||
`~/.gradio/data/tmp/locutor_auto` (`1`/`0`) — se controla desde el diálogo de Configuración de GRP ("Locutor Automático"). El monitor y el generador no deberían correr si está en `0`.
|
||||
|
||||
## Rendimiento medido (texto de referencia ~10s de audio)
|
||||
|
||||
| Máquina | Generar | Cargar modelo (1 vez) |
|
||||
|---|---|---|
|
||||
| Escritorio con GPU NVIDIA | ~2s | ~10s |
|
||||
| Escritorio CPU (20 hilos, sin GPU) | ~29s | ~10s |
|
||||
| RPi5 real (CPU, sin GPU) | ~104s | ~120s |
|
||||
|
||||
Todos entran en el margen de una canción de 3-4 minutos. La recomendación es **no correr el generador en la misma máquina que reproduce en vivo** salvo que tenga GPU o de sobra de RAM/CPU — en el RPi5 se midió presión real de memoria (swap) al generar en aislamiento.
|
||||
@@ -0,0 +1,44 @@
|
||||
# Formato de la locución enriquecida
|
||||
|
||||
Generado por `scripts/enriquecer-locucion.py`. Cada locución tiene 3 partes:
|
||||
|
||||
```
|
||||
{OPENER}, {TEMA}, {INFO ENRIQUECIDA}
|
||||
```
|
||||
|
||||
Y opcionalmente (50% de las veces) un **cierre** con el nombre de la emisora (leído de `gradio.config`, no hardcodeado) y un saludo según la hora del día.
|
||||
|
||||
## 1. Opener (aleatorio, uno de tres)
|
||||
|
||||
- **Curiosidad del país** (si MusicBrainz devuelve país de origen): *"¿Sabías que {país} es conocido por {dato}?"*
|
||||
- **Consejo ecológico**: *"Recuerda: {consejo}."* (banco fijo de frases sobre reducir huella de carbono)
|
||||
- **Dato turístico del país**: *"{País} ofrece {dato turístico}."*
|
||||
|
||||
## 2. Tema (siempre presente)
|
||||
|
||||
```
|
||||
"Escuchas {título} de {artista}"
|
||||
```
|
||||
|
||||
## 3. Info enriquecida
|
||||
|
||||
Según los datos disponibles: año de grabación, género, país de lanzamiento, y un dato de Wikipedia (1-2 oraciones) sobre el artista o la canción.
|
||||
|
||||
## 4. Cierre opcional (~50%)
|
||||
|
||||
```
|
||||
"Estás en sintonía con {nombre de la radio}. {saludo según hora}"
|
||||
```
|
||||
|
||||
El nombre de la radio se lee de `~/.gradio/data/tmp/gradio.config` (línea 3, campo `station_name`) — **nunca lo hardcodees**, cada estación tiene el suyo.
|
||||
|
||||
## Ejemplo completo
|
||||
|
||||
> "¿Sabías que México es el país con más patrimonios de la humanidad en América Latina? Escuchas Muriendo Lento de Moderatto con Belinda, un tema pop lanzado en México en 2007. Estás en sintonía con Radio Ejemplo. ¡Buenos días!"
|
||||
|
||||
## Fuentes de datos
|
||||
|
||||
- **Metadata ID3**: `mutagen` (título, artista, año, género) — si el archivo no tiene tags, se infiere del nombre `Artista - Título.mp3`.
|
||||
- **Wikipedia** (`es.wikipedia.org`): dato curioso, solo si hay artículo en español; si no, se omite (nunca se usa inglés).
|
||||
- **MusicBrainz**: país y año de lanzamiento.
|
||||
- **Caché**: `~/.gradio/data/tmp/locuciones_cache.json` — evita repetir consultas online del mismo artista/tema. Borrarlo fuerza consultas frescas.
|
||||
@@ -0,0 +1,30 @@
|
||||
¿Sabías que el corazón humano late aproximadamente 100 mil veces al día?
|
||||
¿Sabías que la miel nunca se echa a perder? Se han encontrado frascos de miel en tumbas egipcias de hace 3000 años aún comestibles.
|
||||
¿Sabías que los pulpos tienen tres corazones?
|
||||
¿Sabías que la canción más larga jamás grabada dura más de 48 horas?
|
||||
¿Sabías que el argentino es el país con más psicólogos per cápita del mundo?
|
||||
¿Sabías que las jirafas solo duermen 30 minutos al día?
|
||||
¿Sabías que el Internet pesa físicamente lo mismo que una fresa?
|
||||
¿Sabías que un día en Venus es más largo que un año en Venus?
|
||||
¿Sabías que la música clásica ayuda a las plantas a crecer mejor?
|
||||
¿Sabías que Freddie Mercury tenía un rango vocal de 4 octavas?
|
||||
¿Sabías que el Himno de la Alegría de Beethoven fue el primer tema musical en enviarse al espacio?
|
||||
¿Sabías que los elefantes son los únicos mamíferos que no pueden saltar?
|
||||
¿Sabías que el español es el segundo idioma más hablado del mundo por nativos?
|
||||
¿Sabías que la canción más versionada de la historia es Yesterday de The Beatles?
|
||||
¿Sabías que las estrellas de mar pueden regenerar sus brazos si los pierden?
|
||||
¿Sabías que el 90% de la información que existe en el mundo se generó en los últimos 2 años?
|
||||
¿Sabías que la hormiga puede levantar hasta 50 veces su propio peso?
|
||||
¿Sabías que el oído humano sigue procesando sonidos incluso mientras dormimos?
|
||||
¿Sabías que el primer disco compacto comercial fue el 52nd Street de Billy Joel en 1982?
|
||||
¿Sabías que el papel higiénico fue inventado en China en el siglo sexto?
|
||||
¿Sabías que la risa reduce las hormonas del estrés y fortalece el sistema inmunológico?
|
||||
¿Sabías que los Beatles nunca aprendieron a leer música?
|
||||
¿Sabías que hay más estrellas en el universo que granos de arena en todas las playas de la Tierra?
|
||||
¿Sabías que la palabra 'música' viene del griego 'mousiké', que significa 'el arte de las musas'?
|
||||
¿Sabías que Michael Jackson ganó 13 premios Grammy?
|
||||
¿Sabías que los flamencos son rosados por lo que comen, principalmente camarones y algas?
|
||||
¿Sabías que tu ADN puede almacenar hasta 700 terabytes de información?
|
||||
¿Sabías que la música favorita de Albert Einstein era Mozart?
|
||||
¿Sabías que el sistema braille fue inventado por Louis Braille cuando tenía solo 15 años?
|
||||
¿Sabías que los delfines se ponen nombres propios y se llaman entre ellos?
|
||||
@@ -0,0 +1,15 @@
|
||||
¡Échale ganas que la vida es una sola!
|
||||
Nunca es tarde para empezar de nuevo, ¡el momento es ahora!
|
||||
Hoy es un buen día para ser feliz, ¡decídete!
|
||||
Recuerda: todo esfuerzo tiene su recompensa, ¡sigue adelante!
|
||||
La música es el alma de la vida, y hoy vamos a celebrarla.
|
||||
No hay meta imposible cuando pones el corazón.
|
||||
Cada día es una nueva oportunidad para brillar.
|
||||
La actitud lo es todo, ¡ponle buena vibra a tu día!
|
||||
Lo mejor de la vida está en los pequeños momentos, disfrútalos.
|
||||
Si puedes soñarlo, puedes lograrlo, ¡nunca te rindas!
|
||||
El éxito no es casualidad, es perseverancia. ¡Tú puedes!
|
||||
La felicidad no es un destino, es el camino. ¡Disfrútalo!
|
||||
Sonríe, que la vida es bella y hoy tenemos buena música.
|
||||
Agradece lo que tienes mientras trabajas por lo que quieres.
|
||||
La música une corazones y hoy estamos conectados por ella.
|
||||
@@ -0,0 +1,119 @@
|
||||
#!/usr/bin/env python3
|
||||
"""Genera una locución con XTTS-v2 usando la voz de referencia de GRP (o una
|
||||
voz de referencia propia de la estación, si reemplazó el archivo).
|
||||
|
||||
Uso:
|
||||
generar.py "texto de la locución" [nombre_salida]
|
||||
|
||||
Salida: ruta del MP3 generado, impresa en stdout (para que scripts la capturen).
|
||||
|
||||
Variables de entorno:
|
||||
GR_LOCUTOR_VOZ ruta al WAV de referencia (default: ~/.gradio/data/locutor-ia/referencia/voz_referencia.wav)
|
||||
GR_LOCUTOR_DIR carpeta de datos (default: ~/.gradio/data/locutor-ia)
|
||||
"""
|
||||
|
||||
import os
|
||||
import socket
|
||||
import subprocess
|
||||
import sys
|
||||
import time
|
||||
|
||||
# Forzar resolución IPv4: en la prueba real en RPi5 una conexión IPv6 mal
|
||||
# enrutada dejó el proceso colgado ~53 minutos esperando una respuesta que
|
||||
# nunca llegó. Esto evita ese modo de falla en cualquier red similar.
|
||||
_orig_getaddrinfo = socket.getaddrinfo
|
||||
|
||||
|
||||
def _ipv4_only_getaddrinfo(host, port, family=0, type=0, proto=0, flags=0):
|
||||
return _orig_getaddrinfo(host, port, socket.AF_INET, type, proto, flags)
|
||||
|
||||
|
||||
socket.getaddrinfo = _ipv4_only_getaddrinfo
|
||||
|
||||
DATA_DIR = os.environ.get("GR_LOCUTOR_DIR", os.path.expanduser("~/.gradio/data/locutor-ia"))
|
||||
SALIDA_DIR = os.path.join(DATA_DIR, "salida")
|
||||
|
||||
|
||||
def log(msg):
|
||||
print(f"[gr-locutor] {msg}", file=sys.stderr, flush=True)
|
||||
|
||||
|
||||
def voz_referencia():
|
||||
"""Prioridad: variable de entorno GR_LOCUTOR_VOZ > locutor.config
|
||||
(voz_modo=propia + voz_propia_path, escrito por gr-locutor-config) >
|
||||
voz genérica de GRP por defecto."""
|
||||
env = os.environ.get("GR_LOCUTOR_VOZ")
|
||||
if env:
|
||||
return env
|
||||
|
||||
config_path = os.path.join(DATA_DIR, "locutor.config")
|
||||
modo = "generica"
|
||||
ruta_propia = ""
|
||||
try:
|
||||
with open(config_path) as f:
|
||||
for line in f:
|
||||
if "=" not in line or line.strip().startswith("#"):
|
||||
continue
|
||||
clave, valor = line.split("=", 1)
|
||||
clave, valor = clave.strip(), valor.strip()
|
||||
if clave == "voz_modo":
|
||||
modo = valor
|
||||
elif clave == "voz_propia_path":
|
||||
ruta_propia = valor
|
||||
except FileNotFoundError:
|
||||
pass
|
||||
|
||||
if modo == "propia" and ruta_propia:
|
||||
return ruta_propia
|
||||
return os.path.join(DATA_DIR, "referencia", "voz_referencia.wav")
|
||||
|
||||
|
||||
REF_VOICE = voz_referencia()
|
||||
|
||||
|
||||
def has_gpu():
|
||||
try:
|
||||
import torch
|
||||
return torch.cuda.is_available()
|
||||
except Exception:
|
||||
return False
|
||||
|
||||
|
||||
def main():
|
||||
if len(sys.argv) < 2:
|
||||
print(f"Uso: {sys.argv[0]} \"texto de la locución\" [nombre_salida]", file=sys.stderr)
|
||||
sys.exit(1)
|
||||
|
||||
texto = sys.argv[1]
|
||||
nombre = sys.argv[2] if len(sys.argv) > 2 else time.strftime("locucion_%Y%m%d_%H%M%S")
|
||||
|
||||
if not os.path.isfile(REF_VOICE):
|
||||
log(f"ERROR: no existe la voz de referencia en {REF_VOICE}")
|
||||
log("Ejecuta el instalador o coloca un WAV de 15-30s en esa ruta.")
|
||||
sys.exit(1)
|
||||
|
||||
os.makedirs(SALIDA_DIR, exist_ok=True)
|
||||
wav_path = f"/tmp/{nombre}.wav"
|
||||
mp3_path = os.path.join(SALIDA_DIR, f"{nombre}.mp3")
|
||||
|
||||
device = "cuda" if has_gpu() else "cpu"
|
||||
log(f"Dispositivo: {device} | Voz de referencia: {REF_VOICE}")
|
||||
|
||||
t0 = time.time()
|
||||
from TTS.api import TTS
|
||||
tts = TTS("tts_models/multilingual/multi-dataset/xtts_v2").to(device)
|
||||
t_load = time.time()
|
||||
tts.tts_to_file(text=texto, speaker_wav=REF_VOICE, language="es", file_path=wav_path)
|
||||
t_gen = time.time()
|
||||
log(f"Cargar modelo: {t_load - t0:.1f}s | Generar: {t_gen - t_load:.1f}s")
|
||||
|
||||
subprocess.run(
|
||||
["ffmpeg", "-y", "-loglevel", "error", "-i", wav_path, "-ar", "44100", "-b:a", "320k", mp3_path],
|
||||
check=True,
|
||||
)
|
||||
os.remove(wav_path)
|
||||
print(mp3_path)
|
||||
|
||||
|
||||
if __name__ == "__main__":
|
||||
main()
|
||||
@@ -0,0 +1,10 @@
|
||||
Estás en sintonía con {radio}.
|
||||
Sigues conectado con {radio}, la mejor música.
|
||||
{radio} te acompaña en todo momento.
|
||||
Gracias por sintonizar {radio}.
|
||||
Esto es {radio}, tu emisora de siempre.
|
||||
{radio}, la música que te gusta escuchar.
|
||||
Quédate con nosotros, esto es {radio}.
|
||||
{radio} — siempre contigo.
|
||||
Sigue disfrutando de la mejor música en {radio}.
|
||||
Estás escuchando {radio}, gracias por acompañarnos.
|
||||
Binary file not shown.
@@ -0,0 +1,368 @@
|
||||
#!/usr/bin/env python3
|
||||
"""Toma la ruta de un tema, extrae metadata y datos online, genera texto enriquecido.
|
||||
|
||||
Uso:
|
||||
./enriquecer-locucion.py /ruta/al/tema.mp3
|
||||
|
||||
Salida (stdout): texto enriquecido listo para locución
|
||||
|
||||
Estructura de la locución:
|
||||
1. Opener: una línea aleatoria, alternando entre curiosidades.txt y
|
||||
frases-motivacionales.txt (nunca se repite el mismo banco dos veces seguidas).
|
||||
2. Tema: título/artista + info enriquecida (año/género/país/dato Wikipedia).
|
||||
3. Cierre opcional: una línea de identificaciones.txt (con {radio} sustituido
|
||||
por el nombre real de la emisora, leído de gradio.config) — aparece según
|
||||
el porcentaje configurado en locutor.config (50% por defecto).
|
||||
"""
|
||||
|
||||
import json, os, random, re, requests, sys
|
||||
|
||||
try:
|
||||
import mutagen
|
||||
except ImportError:
|
||||
mutagen = None
|
||||
|
||||
DATA_DIR = os.environ.get("GR_LOCUTOR_DIR", os.path.expanduser("~/.gradio/data/locutor-ia"))
|
||||
CACHE_FILE = os.path.expanduser("~/.gradio/data/tmp/locuciones_cache.json")
|
||||
GRADIO_CONFIG_FILE = os.path.expanduser("~/.gradio/data/tmp/gradio.config")
|
||||
LOCUTOR_CONFIG_FILE = os.path.join(DATA_DIR, "locutor.config")
|
||||
ALTERNANCIA_FILE = os.path.expanduser("~/.gradio/data/tmp/locutor_ultimo_banco")
|
||||
MB_USER_AGENT = "GRadio-LocutorIA/1.0"
|
||||
TIMEOUT = 8
|
||||
|
||||
|
||||
def log(msg):
|
||||
print(f"[enriquecer] {msg}", file=sys.stderr, flush=True)
|
||||
|
||||
|
||||
def station_name():
|
||||
"""Lee el nombre de la radio desde gradio.config (línea 3), igual que GRP.
|
||||
Default 'G Radio' si no existe el archivo o la línea está vacía."""
|
||||
try:
|
||||
with open(GRADIO_CONFIG_FILE) as f:
|
||||
lines = f.read().splitlines()
|
||||
if len(lines) >= 3 and lines[2].strip():
|
||||
return lines[2].strip()
|
||||
except FileNotFoundError:
|
||||
pass
|
||||
return "G Radio"
|
||||
|
||||
|
||||
def porcentaje_identificacion():
|
||||
"""Lee porcentaje_identificacion de locutor.config (clave=valor). Default 50."""
|
||||
try:
|
||||
with open(LOCUTOR_CONFIG_FILE) as f:
|
||||
for line in f:
|
||||
if line.strip().startswith("porcentaje_identificacion"):
|
||||
return int(line.split("=", 1)[1].strip())
|
||||
except (FileNotFoundError, ValueError, IndexError):
|
||||
pass
|
||||
return 50
|
||||
|
||||
|
||||
def leer_banco(nombre_archivo):
|
||||
path = os.path.join(DATA_DIR, nombre_archivo)
|
||||
try:
|
||||
with open(path, encoding="utf-8") as f:
|
||||
return [l.strip() for l in f if l.strip()]
|
||||
except FileNotFoundError:
|
||||
return []
|
||||
|
||||
|
||||
def elegir_opener():
|
||||
"""Alterna entre curiosidades.txt y frases-motivacionales.txt: nunca
|
||||
repite el mismo banco dos veces seguidas (se persiste cuál tocó última vez)."""
|
||||
bancos = {"curiosidades": "curiosidades.txt", "frases": "frases-motivacionales.txt"}
|
||||
ultimo = ""
|
||||
try:
|
||||
with open(ALTERNANCIA_FILE) as f:
|
||||
ultimo = f.read().strip()
|
||||
except FileNotFoundError:
|
||||
pass
|
||||
|
||||
opciones = [b for b in bancos if b != ultimo] or list(bancos)
|
||||
elegido = random.choice(opciones)
|
||||
lineas = leer_banco(bancos[elegido])
|
||||
if not lineas:
|
||||
# Fallback: probar el otro banco si el elegido está vacío/falta
|
||||
otro = [b for b in bancos if b != elegido]
|
||||
if otro:
|
||||
lineas = leer_banco(bancos[otro[0]])
|
||||
elegido = otro[0]
|
||||
if not lineas:
|
||||
return ""
|
||||
|
||||
try:
|
||||
with open(ALTERNANCIA_FILE, "w") as f:
|
||||
f.write(elegido)
|
||||
except OSError:
|
||||
pass
|
||||
|
||||
return random.choice(lineas)
|
||||
|
||||
|
||||
def elegir_identificacion():
|
||||
lineas = leer_banco("identificaciones.txt")
|
||||
if not lineas:
|
||||
return f"Estás en sintonía con {station_name()}."
|
||||
return random.choice(lineas).replace("{radio}", station_name())
|
||||
|
||||
|
||||
def extract_metadata(song_path):
|
||||
title = artist = album = year = genre = None
|
||||
if mutagen:
|
||||
try:
|
||||
tags = mutagen.File(song_path, easy=True)
|
||||
if tags:
|
||||
title = tags.get("title", [None])[0]
|
||||
artist = tags.get("artist", [None])[0]
|
||||
album = tags.get("album", [None])[0]
|
||||
year = tags.get("date", [None])[0]
|
||||
genre = tags.get("genre", [None])[0]
|
||||
if title and artist:
|
||||
return title.strip(), artist.strip(), album, year, genre
|
||||
except Exception as e:
|
||||
log(f"mutagen error: {e}")
|
||||
|
||||
name = os.path.splitext(os.path.basename(song_path))[0]
|
||||
name = re.sub(r"\(.*?\)", "", name)
|
||||
name = re.sub(r"www\..*", "", name)
|
||||
name = name.strip()
|
||||
artist = title = None
|
||||
if " - " in name:
|
||||
parts = name.split(" - ", 1)
|
||||
artist = parts[0].strip()
|
||||
title = parts[1].strip()
|
||||
else:
|
||||
title = name
|
||||
return title, artist, album, year, genre
|
||||
|
||||
|
||||
def load_cache():
|
||||
try:
|
||||
with open(CACHE_FILE) as f:
|
||||
return json.load(f)
|
||||
except Exception:
|
||||
return {}
|
||||
|
||||
|
||||
def save_cache(cache):
|
||||
try:
|
||||
with open(CACHE_FILE, "w") as f:
|
||||
json.dump(cache, f)
|
||||
except Exception:
|
||||
pass
|
||||
|
||||
|
||||
def lookup_wikipedia(artist, title, cache):
|
||||
if not title:
|
||||
return None
|
||||
key = f"wiki:{artist}:{title}"
|
||||
if key in cache:
|
||||
return cache[key]
|
||||
|
||||
queries = []
|
||||
if artist:
|
||||
queries.append(f'"{artist}" "{title}" canción')
|
||||
queries.append(f'"{artist}" "{title}" música')
|
||||
queries.append(f'"{artist}" músico')
|
||||
else:
|
||||
queries.append(f'"{title}" canción')
|
||||
|
||||
WIKI = "https://es.wikipedia.org/w/api.php"
|
||||
for q in queries:
|
||||
try:
|
||||
r = requests.get(WIKI,
|
||||
params={
|
||||
"action": "query",
|
||||
"list": "search",
|
||||
"srsearch": q,
|
||||
"format": "json",
|
||||
"srlimit": 3,
|
||||
},
|
||||
timeout=TIMEOUT,
|
||||
headers={"User-Agent": "GRadio-LocutorIA/1.0 (radio-automation)"},
|
||||
)
|
||||
data = r.json()
|
||||
pages = data.get("query", {}).get("search", [])
|
||||
if not pages:
|
||||
continue
|
||||
|
||||
for page in pages:
|
||||
page_title = page["title"]
|
||||
r2 = requests.get(
|
||||
WIKI,
|
||||
params={
|
||||
"action": "query",
|
||||
"prop": "extracts",
|
||||
"exintro": True,
|
||||
"explaintext": True,
|
||||
"titles": page_title,
|
||||
"format": "json",
|
||||
"exsentences": 3,
|
||||
},
|
||||
timeout=TIMEOUT,
|
||||
headers={"User-Agent": "GRadio-LocutorIA/1.0 (radio-automation)"},
|
||||
)
|
||||
pg_data = r2.json().get("query", {}).get("pages", {})
|
||||
for pid, pg in pg_data.items():
|
||||
if pid == "-1" or "extract" not in pg:
|
||||
continue
|
||||
extract = pg["extract"].strip()
|
||||
sentences = re.split(r"(?<=[.!?])\s+", extract)
|
||||
for s in sentences:
|
||||
s = s.strip()
|
||||
if 40 <= len(s) <= 200:
|
||||
cache[key] = s
|
||||
save_cache(cache)
|
||||
return s
|
||||
except Exception as e:
|
||||
log(f"wiki error ({q[:30]}...): {e}")
|
||||
|
||||
cache[key] = None
|
||||
save_cache(cache)
|
||||
return None
|
||||
|
||||
|
||||
def lookup_musicbrainz(artist, title, cache):
|
||||
if not artist or not title:
|
||||
return None
|
||||
key = f"mb:{artist}:{title}"
|
||||
if key in cache:
|
||||
return cache[key]
|
||||
|
||||
try:
|
||||
r = requests.get(
|
||||
"https://musicbrainz.org/ws/2/recording/",
|
||||
params={
|
||||
"query": f'artist:"{artist}" AND recording:"{title}"',
|
||||
"fmt": "json",
|
||||
"limit": 1,
|
||||
},
|
||||
timeout=TIMEOUT + 2,
|
||||
headers={"User-Agent": MB_USER_AGENT},
|
||||
)
|
||||
data = r.json()
|
||||
recs = data.get("recordings", [])
|
||||
if not recs:
|
||||
cache[key] = None
|
||||
save_cache(cache)
|
||||
return None
|
||||
|
||||
rec = recs[0]
|
||||
info = {}
|
||||
if "releases" in rec and rec["releases"]:
|
||||
rel = rec["releases"][0]
|
||||
date = rel.get("date", "")
|
||||
info["year"] = date[:4] if date and len(date) >= 4 else ""
|
||||
info["country"] = rel.get("country", "")
|
||||
if "artist-credit" in rec:
|
||||
ac = rec["artist-credit"][0]
|
||||
if isinstance(ac, dict) and "artist" in ac:
|
||||
info["artist_type"] = ac["artist"].get("type", "")
|
||||
|
||||
cache[key] = info if info else None
|
||||
save_cache(cache)
|
||||
return info
|
||||
except Exception as e:
|
||||
log(f"musicbrainz error: {e}")
|
||||
cache[key] = None
|
||||
save_cache(cache)
|
||||
return None
|
||||
|
||||
|
||||
_PAISES = {
|
||||
"US": "Estados Unidos", "GB": "Reino Unido", "UK": "Reino Unido",
|
||||
"ES": "España", "MX": "México", "AR": "Argentina", "CO": "Colombia",
|
||||
"CL": "Chile", "PE": "Perú", "CU": "Cuba", "PR": "Puerto Rico",
|
||||
"DE": "Alemania", "FR": "Francia", "IT": "Italia", "BR": "Brasil",
|
||||
"CA": "Canadá", "AU": "Australia", "JP": "Japón", "MY": "Malasia",
|
||||
"SE": "Suecia", "NL": "Países Bajos", "IE": "Irlanda", "NO": "Noruega",
|
||||
"DK": "Dinamarca", "PT": "Portugal", "RU": "Rusia",
|
||||
}
|
||||
|
||||
|
||||
def generate_text(artist, title, album, year, genre, wiki_fact, mb_info):
|
||||
anyo = mb_info.get("year", "") if mb_info and isinstance(mb_info, dict) else ""
|
||||
|
||||
nombre_pais = ""
|
||||
pa_mb = mb_info.get("country", "") if mb_info and isinstance(mb_info, dict) else ""
|
||||
if pa_mb:
|
||||
nombre_pais = _PAISES.get(pa_mb, pa_mb)
|
||||
|
||||
# --- 1. Opener (alternando curiosidades.txt / frases-motivacionales.txt) ---
|
||||
opener = elegir_opener()
|
||||
|
||||
# --- 2. Tema ---
|
||||
if artist and title:
|
||||
tema = f"Escuchas {title} de {artist}"
|
||||
elif title:
|
||||
tema = f"Escuchas {title}"
|
||||
else:
|
||||
tema = ""
|
||||
|
||||
# --- 3. Info enriquecida ---
|
||||
infos = []
|
||||
if anyo and anyo not in ("?", ""):
|
||||
infos.append(f"grabada en {anyo}")
|
||||
if genre and genre not in ("?", ""):
|
||||
infos.append(f"un tema de {genre}")
|
||||
if nombre_pais:
|
||||
infos.append(f"lanzada en {nombre_pais}")
|
||||
|
||||
info_str = ", ".join(infos) if infos else ""
|
||||
|
||||
wiki_str = ""
|
||||
if wiki_fact:
|
||||
fact = wiki_fact.strip()
|
||||
if len(fact) > 160:
|
||||
fact = fact[:157] + "..."
|
||||
wiki_str = fact
|
||||
|
||||
if tema and info_str:
|
||||
cuerpo = f"{tema}, {info_str}."
|
||||
elif tema:
|
||||
cuerpo = f"{tema}."
|
||||
elif info_str:
|
||||
cuerpo = info_str
|
||||
else:
|
||||
cuerpo = ""
|
||||
|
||||
if wiki_str:
|
||||
cuerpo = f"{cuerpo} {wiki_str}" if cuerpo else wiki_str
|
||||
|
||||
# --- 4. Cierre opcional (según porcentaje_identificacion de locutor.config) ---
|
||||
cierre = ""
|
||||
if random.randint(1, 100) <= porcentaje_identificacion():
|
||||
cierre = elegir_identificacion()
|
||||
|
||||
oraciones = [o for o in (opener, cuerpo, cierre) if o]
|
||||
return " ".join(oraciones)
|
||||
|
||||
|
||||
def main():
|
||||
if len(sys.argv) < 2:
|
||||
log("Uso: enriquecer-locucion.py /ruta/al/tema.mp3")
|
||||
sys.exit(1)
|
||||
|
||||
song_path = os.path.abspath(sys.argv[1])
|
||||
if not os.path.exists(song_path):
|
||||
log(f"no existe: {song_path}")
|
||||
sys.exit(1)
|
||||
|
||||
title, artist, album, year, genre = extract_metadata(song_path)
|
||||
log(f"metadata: artist={artist} title={title} album={album} year={year} genre={genre}")
|
||||
|
||||
cache = load_cache()
|
||||
wiki_fact = lookup_wikipedia(artist or title, title, cache)
|
||||
mb_info = lookup_musicbrainz(artist or title, title, cache)
|
||||
|
||||
text = generate_text(artist, title, album, year, genre, wiki_fact, mb_info)
|
||||
log(f"wiki={'sí' if wiki_fact else 'no'} mb={'sí' if mb_info else 'no'}")
|
||||
log(f"texto ({len(text)} chars): {text[:100]}...")
|
||||
|
||||
print(text)
|
||||
|
||||
|
||||
if __name__ == "__main__":
|
||||
main()
|
||||
@@ -0,0 +1,60 @@
|
||||
#!/bin/bash
|
||||
# Genera una locución de introducción para un tema musical
|
||||
# Uso: ./generar-intro.sh "/ruta/al/tema.mp3"
|
||||
# Imprime la ruta del MP3 generado en stdout
|
||||
#
|
||||
# 1. Lee metadata ID3 del tema + enriquece con Wikipedia/MusicBrainz
|
||||
# 2. Sintetiza con el motor instalado (~/.gradio/locutor/gr-locutor.sh),
|
||||
# usando la voz de referencia configurada (genérica de GRP o la propia
|
||||
# de la estación si fue reemplazada)
|
||||
|
||||
set -e
|
||||
cd "$(dirname "$0")"
|
||||
|
||||
TEMA="$1"
|
||||
LOCUTOR_BIN="$HOME/.gradio/locutor-venv/gr-locutor.sh"
|
||||
ENRIQUECER="enriquecer-locucion.py"
|
||||
SALIDA_DIR="$HOME/.gradio/data/locutor-ia/salida"
|
||||
|
||||
if [ -z "$TEMA" ]; then
|
||||
echo "Uso: $0 \"/ruta/al/tema.mp3\""
|
||||
exit 1
|
||||
fi
|
||||
|
||||
if [ ! -f "$TEMA" ]; then
|
||||
echo "Error: no existe el archivo $TEMA"
|
||||
exit 1
|
||||
fi
|
||||
|
||||
if [ ! -x "$LOCUTOR_BIN" ]; then
|
||||
echo "Error: no está instalado el motor de voz ($LOCUTOR_BIN)."
|
||||
echo "Ejecuta primero el instalador (instalar-locutor-amd64.sh)."
|
||||
exit 1
|
||||
fi
|
||||
|
||||
TEXTO=""
|
||||
if [ -f "$ENRIQUECER" ]; then
|
||||
TEXTO=$(python3 "$ENRIQUECER" "$TEMA" 2>/dev/null || true)
|
||||
fi
|
||||
|
||||
if [ -z "$TEXTO" ]; then
|
||||
BASENAME=$(basename "$TEMA" .mp3)
|
||||
BASENAME="${BASENAME%.*}"
|
||||
ARTISTA=""
|
||||
TITULO="$BASENAME"
|
||||
if echo "$BASENAME" | grep -q " - "; then
|
||||
ARTISTA=$(echo "$BASENAME" | sed 's/ - .*//')
|
||||
TITULO=$(echo "$BASENAME" | sed 's/.* - //')
|
||||
fi
|
||||
if [ -n "$ARTISTA" ]; then
|
||||
TEXTO="Y ahora, disfruta de ${TITULO} de ${ARTISTA}."
|
||||
else
|
||||
TEXTO="Y ahora, disfruta de ${TITULO}."
|
||||
fi
|
||||
fi
|
||||
|
||||
NOMBRE="intro_$(date +%Y%m%d_%H%M%S)"
|
||||
mkdir -p "$SALIDA_DIR"
|
||||
|
||||
MP3=$("$LOCUTOR_BIN" "$TEXTO" "$NOMBRE")
|
||||
echo "$MP3"
|
||||
@@ -0,0 +1,339 @@
|
||||
#!/usr/bin/env python3
|
||||
"""Monitor de Locuciones — Ventana corrediza configurable.
|
||||
|
||||
Cuando una locución+song se consume (desaparece del tope de playlist4),
|
||||
genera la siguiente locución para el próximo song sin locución que le
|
||||
corresponda narrar (según `cada_cuantos_temas`). Solo genera UNA a la vez
|
||||
para no saturar el motor de TTS.
|
||||
|
||||
Lee `ventana_previas` y `cada_cuantos_temas` de locutor.config en cada
|
||||
ciclo (permite reconfigurar sin reiniciar el daemon).
|
||||
|
||||
No pausa `playlist-refill` (el daemon de GRP que rellena la cola desde la
|
||||
parrilla): ese proceso solo agrega canciones al final hasta un largo
|
||||
objetivo, sin importar el contenido existente — conviven sin conflicto,
|
||||
igual que si se agregaran temas a mano. La única carrera real posible
|
||||
(el player consume temas mientras este monitor genera una locución, que
|
||||
puede tardar decenas de segundos) se resuelve re-leyendo `playlist4` justo
|
||||
antes de escribir, no pausando nada — pausar indefinidamente dejaría de
|
||||
rellenar la cola y la estación se quedaría sin música.
|
||||
"""
|
||||
|
||||
import json
|
||||
import os
|
||||
import subprocess
|
||||
import sys
|
||||
import time
|
||||
|
||||
TMP_DIR = os.path.expanduser("~/.gradio/data/tmp")
|
||||
DATA_DIR = os.path.expanduser("~/.gradio/data/locutor-ia")
|
||||
ESTADO_FILE = os.path.join(TMP_DIR, "estado.json")
|
||||
PLAYLIST_FILE = os.path.join(TMP_DIR, "playlist4")
|
||||
LOCUTOR_AUTO_FILE = os.path.join(TMP_DIR, "locutor_auto")
|
||||
LOCUTOR_CONFIG_FILE = os.path.join(DATA_DIR, "locutor.config")
|
||||
CONTADOR_FILE = os.path.join(TMP_DIR, "locutor_song_counter.json")
|
||||
SCRIPT_DIR = os.path.join(DATA_DIR, "scripts")
|
||||
GENERAR_SCRIPT = os.path.join(SCRIPT_DIR, "generar-intro.sh")
|
||||
LOCK_FILE = os.path.join(TMP_DIR, "locuciones_generating")
|
||||
|
||||
POLL_INTERVAL = 3
|
||||
DEFAULT_WINDOW_SIZE = 3
|
||||
DEFAULT_CADA_CUANTOS = 3
|
||||
|
||||
|
||||
def log(msg):
|
||||
ts = time.strftime("%Y-%m-%d %H:%M:%S")
|
||||
print(f"[{ts}] {msg}", flush=True)
|
||||
|
||||
|
||||
def leer_locutor_config():
|
||||
"""Lee ventana_previas y cada_cuantos_temas de locutor.config (clave=valor)."""
|
||||
ventana = DEFAULT_WINDOW_SIZE
|
||||
cada_cuantos = DEFAULT_CADA_CUANTOS
|
||||
try:
|
||||
with open(LOCUTOR_CONFIG_FILE) as f:
|
||||
for line in f:
|
||||
line = line.strip()
|
||||
if "=" not in line or line.startswith("#"):
|
||||
continue
|
||||
clave, valor = line.split("=", 1)
|
||||
clave, valor = clave.strip(), valor.strip()
|
||||
if clave == "ventana_previas":
|
||||
ventana = max(1, int(valor))
|
||||
elif clave == "cada_cuantos_temas":
|
||||
cada_cuantos = max(1, int(valor))
|
||||
except (FileNotFoundError, ValueError):
|
||||
pass
|
||||
return ventana, cada_cuantos
|
||||
|
||||
|
||||
def read_playlist():
|
||||
try:
|
||||
with open(PLAYLIST_FILE) as f:
|
||||
return [l.strip() for l in f if l.strip()]
|
||||
except FileNotFoundError:
|
||||
return []
|
||||
|
||||
|
||||
def write_playlist(lines):
|
||||
with open(PLAYLIST_FILE, "w") as f:
|
||||
for line in lines:
|
||||
f.write(line + "\n")
|
||||
|
||||
|
||||
def is_locution(entry):
|
||||
ruta = entry.split("\t")[0]
|
||||
return "intro_" in os.path.basename(ruta)
|
||||
|
||||
|
||||
def get_song_path(entry):
|
||||
return entry.split("\t")[0]
|
||||
|
||||
|
||||
MAX_DECISIONES = 300 # tope para que el archivo no crezca sin límite
|
||||
|
||||
|
||||
def load_contador():
|
||||
try:
|
||||
with open(CONTADOR_FILE) as f:
|
||||
state = json.load(f)
|
||||
state.setdefault("count", 0)
|
||||
state.setdefault("decisiones", {})
|
||||
return state
|
||||
except Exception:
|
||||
return {"count": 0, "decisiones": {}}
|
||||
|
||||
|
||||
def save_contador(state):
|
||||
try:
|
||||
with open(CONTADOR_FILE, "w") as f:
|
||||
json.dump(state, f)
|
||||
except OSError:
|
||||
pass
|
||||
|
||||
|
||||
def corresponde_narrar(song_path, cada_cuantos):
|
||||
"""Decide si a este tema le toca locución, contando temas distintos vistos.
|
||||
|
||||
Recuerda la decisión de CADA tema ya evaluado (no solo el último): el
|
||||
escaneo de ensure_window() reinicia desde el principio en cada ciclo de
|
||||
poll, así que un tema ya decidido puede volver a aparecer como "primer
|
||||
candidato" en ciclos siguientes — si solo se recordara el último tema
|
||||
visto, ese tema se recontaría como si fuera nuevo cada vez, corrompiendo
|
||||
el conteo de "cada N temas".
|
||||
"""
|
||||
state = load_contador()
|
||||
decisiones = state["decisiones"]
|
||||
if song_path not in decisiones:
|
||||
state["count"] += 1
|
||||
decisiones[song_path] = (state["count"] % cada_cuantos == 0)
|
||||
# Podar entradas más viejas si crece demasiado (dict preserva orden de inserción)
|
||||
while len(decisiones) > MAX_DECISIONES:
|
||||
decisiones.pop(next(iter(decisiones)))
|
||||
save_contador(state)
|
||||
return decisiones[song_path]
|
||||
|
||||
|
||||
def generate_locution(song_path):
|
||||
if not os.path.exists(GENERAR_SCRIPT):
|
||||
log(f"ERROR: no existe {GENERAR_SCRIPT}")
|
||||
return None, None
|
||||
if not os.path.exists(song_path):
|
||||
log(f"ERROR: no existe {song_path}")
|
||||
return None, None
|
||||
try:
|
||||
result = subprocess.run(
|
||||
["bash", GENERAR_SCRIPT, song_path],
|
||||
capture_output=True, text=True, timeout=300,
|
||||
cwd=SCRIPT_DIR
|
||||
)
|
||||
if result.returncode == 0:
|
||||
rel_path = result.stdout.strip().split("\n")[-1]
|
||||
mp3_path = rel_path if os.path.isabs(rel_path) else os.path.join(SCRIPT_DIR, rel_path)
|
||||
if mp3_path and mp3_path.endswith(".mp3") and os.path.exists(mp3_path):
|
||||
dur = get_duration(mp3_path)
|
||||
return mp3_path, dur
|
||||
err = result.stderr.strip() or "(sin stderr)"
|
||||
log(f"ERROR generar-intro (rc={result.returncode}): {err[:150]}")
|
||||
return None, None
|
||||
except subprocess.TimeoutExpired:
|
||||
log("ERROR: generar-intro TIMEOUT (>300s)")
|
||||
return None, None
|
||||
except Exception as e:
|
||||
log(f"ERROR: {e}")
|
||||
return None, None
|
||||
|
||||
|
||||
def get_duration(mp3_path):
|
||||
try:
|
||||
r = subprocess.run(["ffprobe", "-v", "error", "-show_entries", "format=duration",
|
||||
"-of", "default=noprint_wrappers=1:nokey=1", mp3_path],
|
||||
capture_output=True, text=True, timeout=5)
|
||||
secs = float(r.stdout.strip())
|
||||
mins = int(secs // 60)
|
||||
secs = secs % 60
|
||||
return f"{mins:02d}:{secs:05.3f}"[:11]
|
||||
except Exception:
|
||||
pass
|
||||
return "00:00:16.000"
|
||||
|
||||
|
||||
LOCK_MAX_AGE = 300 # 5 min — la generación real tarda como mucho ~2 min (CPU)
|
||||
|
||||
|
||||
def ensure_window():
|
||||
"""Mantiene `ventana_previas` locuciones al inicio de la playlist, solo
|
||||
para los temas que correspondan según `cada_cuantos_temas`. Genera UNA
|
||||
a la vez para evitar saturar el motor de TTS.
|
||||
"""
|
||||
if os.path.exists(LOCK_FILE):
|
||||
# Si el lock es viejo, quedó de una generación que murió sin pasar
|
||||
# por el `finally` (kill -9, crash) — lo consideramos obsoleto y lo
|
||||
# limpiamos, sino el monitor queda trabado para siempre sin avisar.
|
||||
edad = time.time() - os.path.getmtime(LOCK_FILE)
|
||||
if edad > LOCK_MAX_AGE:
|
||||
log(f"Lock de generación obsoleto ({edad:.0f}s) — se limpia y se continúa")
|
||||
os.unlink(LOCK_FILE)
|
||||
else:
|
||||
return # ya hay una generación en curso
|
||||
|
||||
ventana, cada_cuantos = leer_locutor_config()
|
||||
|
||||
pl = read_playlist()
|
||||
if len(pl) < 1:
|
||||
return
|
||||
|
||||
pairs = 0
|
||||
start_i = 1 if (len(pl) > 0 and not is_locution(pl[0])) else 0
|
||||
i = start_i
|
||||
while i < len(pl) - 1:
|
||||
if is_locution(pl[i]) and not is_locution(pl[i + 1]):
|
||||
pairs += 1
|
||||
i += 2
|
||||
else:
|
||||
break
|
||||
|
||||
if pairs >= ventana:
|
||||
return # ventana completa
|
||||
|
||||
# El primer item de la playlist es el que está sonando (o por sonar).
|
||||
# Si es un song sin locución, su intro ya fue consumida → omitir (evita loop).
|
||||
start = 1 if (len(pl) > 0 and not is_locution(pl[0])) else 0
|
||||
for i in range(start, len(pl)):
|
||||
entry = pl[i]
|
||||
if is_locution(entry):
|
||||
continue
|
||||
if i > 0 and is_locution(pl[i - 1]):
|
||||
continue
|
||||
|
||||
song_path = get_song_path(entry)
|
||||
|
||||
if not corresponde_narrar(song_path, cada_cuantos):
|
||||
continue # a este tema no le toca, seguir buscando el próximo candidato
|
||||
|
||||
song_name = os.path.basename(song_path)
|
||||
log(f"Generando locución para: {song_name} ({pairs+1}/{ventana})")
|
||||
|
||||
open(LOCK_FILE, "w").close()
|
||||
try:
|
||||
mp3, dur = generate_locution(song_path)
|
||||
finally:
|
||||
os.unlink(LOCK_FILE)
|
||||
|
||||
if not mp3:
|
||||
log(" ✗ falló generación, reintentando después")
|
||||
return
|
||||
|
||||
loc_entry = f"{mp3}\t{dur}"
|
||||
|
||||
# Re-leer playlist actual para evitar race condition: el player pudo
|
||||
# haber consumido items durante la generación (decenas de segundos).
|
||||
current_pl = read_playlist()
|
||||
if not current_pl:
|
||||
current_pl = [loc_entry]
|
||||
log(" ✓ playlist vacía, insertando única línea")
|
||||
else:
|
||||
target_path = get_song_path(entry)
|
||||
inserted = False
|
||||
for j, line in enumerate(current_pl):
|
||||
if get_song_path(line) == target_path:
|
||||
if j > 0 and is_locution(current_pl[j - 1]):
|
||||
log(" ✗ la canción ya tiene locución, omitiendo")
|
||||
return
|
||||
current_pl.insert(j, loc_entry)
|
||||
inserted = True
|
||||
break
|
||||
if not inserted:
|
||||
current_pl.append(loc_entry)
|
||||
log(" ✓ canción ya consumida, insertada al final")
|
||||
else:
|
||||
log(f" ✓ insertada en playlist: {len(current_pl)} líneas")
|
||||
|
||||
write_playlist(current_pl)
|
||||
return # solo una por ciclo
|
||||
|
||||
log("(no se encontraron temas pendientes de narrar)")
|
||||
|
||||
|
||||
def locutor_habilitado():
|
||||
try:
|
||||
with open(LOCUTOR_AUTO_FILE) as f:
|
||||
return f.read().strip() == "1"
|
||||
except FileNotFoundError:
|
||||
return False
|
||||
|
||||
|
||||
def main():
|
||||
log("=== Monitor de Locuciones (gr-locutor) iniciado ===")
|
||||
|
||||
# Un lock encontrado al arrancar es, por definición, de una instancia
|
||||
# anterior (este proceso recién empieza, no pudo haber creado ninguno
|
||||
# todavía) — por ejemplo si el daemon anterior murió por SIGTERM en
|
||||
# medio de una generación, sin pasar por el `finally` que lo libera.
|
||||
if os.path.exists(LOCK_FILE):
|
||||
log("Lock de generación de una instancia anterior encontrado al iniciar — se limpia")
|
||||
os.unlink(LOCK_FILE)
|
||||
|
||||
if not locutor_habilitado():
|
||||
log("tmp/locutor_auto no está en '1' — el monitor no generará nada.")
|
||||
log("Activalo en GRP → Configuración → Locutor Automático.")
|
||||
|
||||
ventana, cada_cuantos = leer_locutor_config()
|
||||
log(f"Ventana de {ventana} locuciones · narra 1 de cada {cada_cuantos} temas")
|
||||
log("playlist-refill sigue activo — no se pausa (conviven sin conflicto)")
|
||||
|
||||
last_track = ""
|
||||
|
||||
while True:
|
||||
try:
|
||||
if locutor_habilitado():
|
||||
ensure_window()
|
||||
except Exception as e:
|
||||
log(f"Error: {e}")
|
||||
|
||||
try:
|
||||
with open(ESTADO_FILE) as f:
|
||||
estado = json.load(f)
|
||||
except (FileNotFoundError, json.JSONDecodeError):
|
||||
estado = None
|
||||
|
||||
if estado:
|
||||
track = estado.get("track_actual", "")
|
||||
reproduciendo = estado.get("reproduciendo", False)
|
||||
if track and track != last_track and reproduciendo:
|
||||
name = os.path.basename(track)
|
||||
if "intro_" in name:
|
||||
log(f"▶ Locución: {name}")
|
||||
else:
|
||||
log(f"▶ Tema: {name}")
|
||||
last_track = track
|
||||
|
||||
time.sleep(POLL_INTERVAL)
|
||||
|
||||
|
||||
if __name__ == "__main__":
|
||||
try:
|
||||
main()
|
||||
except KeyboardInterrupt:
|
||||
log("Monitor detenido por el usuario")
|
||||
sys.exit(0)
|
||||
@@ -0,0 +1,54 @@
|
||||
#!/bin/bash
|
||||
# Inicia/detiene el monitor de locuciones (gr-locutor)
|
||||
# Uso: start-monitor.sh [start|stop|status]
|
||||
|
||||
SCRIPT_DIR="$(cd "$(dirname "$0")" && pwd)"
|
||||
PIDFILE="$HOME/.gradio/data/tmp/pids/locuciones-monitor.pid"
|
||||
MONITOR="$SCRIPT_DIR/monitor-locuciones.py"
|
||||
LOCUTOR_VENV="$HOME/.gradio/locutor-venv"
|
||||
|
||||
case "${1:-start}" in
|
||||
start)
|
||||
if [ -f "$PIDFILE" ]; then
|
||||
pid=$(cat "$PIDFILE" 2>/dev/null)
|
||||
if kill -0 "$pid" 2>/dev/null; then
|
||||
echo "Monitor ya está corriendo (PID $pid)"
|
||||
exit 0
|
||||
fi
|
||||
rm -f "$PIDFILE"
|
||||
fi
|
||||
mkdir -p "$(dirname "$PIDFILE")"
|
||||
# shellcheck source=/dev/null
|
||||
source "$LOCUTOR_VENV/bin/activate"
|
||||
nohup python3 "$MONITOR" > "$HOME/.gradio/data/tmp/locuciones-monitor.log" 2>&1 &
|
||||
echo $! > "$PIDFILE"
|
||||
echo "Monitor de locuciones iniciado (PID $!)"
|
||||
;;
|
||||
stop)
|
||||
if [ -f "$PIDFILE" ]; then
|
||||
pid=$(cat "$PIDFILE" 2>/dev/null)
|
||||
kill "$pid" 2>/dev/null && echo "Monitor detenido" || echo "No se pudo detener"
|
||||
rm -f "$PIDFILE"
|
||||
else
|
||||
pkill -f "monitor-locuciones.py" 2>/dev/null && echo "Monitor detenido" || echo "Monitor no estaba corriendo"
|
||||
fi
|
||||
;;
|
||||
status)
|
||||
if [ -f "$PIDFILE" ]; then
|
||||
pid=$(cat "$PIDFILE" 2>/dev/null)
|
||||
if kill -0 "$pid" 2>/dev/null; then
|
||||
echo "Monitor ACTIVO (PID $pid)"
|
||||
tail -3 "$HOME/.gradio/data/tmp/locuciones-monitor.log" 2>/dev/null
|
||||
else
|
||||
echo "Monitor INACTIVO (PID file obsoleto)"
|
||||
rm -f "$PIDFILE"
|
||||
fi
|
||||
else
|
||||
echo "Monitor INACTIVO"
|
||||
fi
|
||||
;;
|
||||
*)
|
||||
echo "Uso: $0 [start|stop|status]"
|
||||
exit 1
|
||||
;;
|
||||
esac
|
||||
Reference in New Issue
Block a user