Files
feadulta/scripts/tts_carta_edge.py
T
rafa 69e849d38e Sync: guardar en el historial el trabajo de las ultimas semanas que solo vivia en el disco
Este repo local tenia origin apuntando al Gitea local (localhost:3000), que Rafa
declaro archivado el 2026-06-28 (commit 962f33a, desarrollo movido a
gitea.feadulta.com). Ese memo nunca llego a este checkout: main quedo congelado
y todo el trabajo real de las ultimas 3+ semanas se fue commiteando solo en la
rama fix/multiidioma-portada-132 (ya fusionada a main sin perdida, commit
2504666), mientras que ademas se acumulaban 78 cambios sin commitear en el
working tree que nunca llegaron a NINGUN historial de git.

Este commit consolida esos cambios sueltos: TTS multi-voz (tts_*.py), scripts
de traduccion (translate_haiku.py, pretranslate_en_haiku.py, sync_translations_to_prod.py),
mu-plugins nuevos desplegados a prod (fea-beta-feedback, fea-cloudflare-realip,
fea-legacy-redirect, fea-gsc-verification, fea-support-campaign, fea-ui, etc.),
scripts de mantenimiento de enlaces/cartas, capturas E2E (tools/e2e/shot_*.cjs)
y documentacion de sesiones recientes.

Excluido deliberadamente (no es codigo versionable): tts-voices/ (3.3GB de
muestras de audio para clonacion de voz, anadido a .gitignore), logs/ (logs de
ejecucion, anadido a .gitignore), y 2 ficheros vacios accidentales + 2 copias
duplicadas sueltas en la raiz que ya existen en su ubicacion correcta.
2026-07-15 20:03:21 -04:00

52 lines
1.7 KiB
Python

#!/usr/bin/env python3
"""Locuta una carta entera con edge-tts (online, gratis). Para comparar con XTTS.
Uso: tts_carta_edge.py <post_id> [voz] [nombre_salida]
voz por defecto: es-ES-XimenaNeural
"""
import html
import json
import os
import re
import subprocess
import sys
from pathlib import Path
EDGE = os.path.expanduser("~/.hermes/hermes-agent/venv/bin/edge-tts")
OUT = Path(__file__).resolve().parent.parent / "wordpress/wp-content/uploads/tts-samples"
CONTAINER = "wordpress-web"
def get_post_text(pid):
subprocess.run(["docker", "exec", CONTAINER, "php", "/tmp/fea_post_io.php", "get", str(pid)],
check=True, capture_output=True)
subprocess.run(["docker", "cp", f"{CONTAINER}:/tmp/fea_es.json", "/tmp/fea_es.json"], check=True)
d = json.load(open("/tmp/fea_es.json"))
raw = d["content"]
raw = re.sub(r"(?i)</p>|<br\s*/?>|</h[1-6]>", "\n", raw)
raw = re.sub(r"<[^>]+>", "", raw)
raw = re.sub(r"\[[^\]]+\]", "", raw)
raw = html.unescape(raw)
paras = [re.sub(r"\s+", " ", p).strip() for p in raw.split("\n")]
return d["title"], [p for p in paras if len(p) > 1]
def main():
pid = int(sys.argv[1])
voice = sys.argv[2] if len(sys.argv) > 2 else "es-ES-XimenaNeural"
name = sys.argv[3] if len(sys.argv) > 3 else f"carta-edge-{pid}"
title, paras = get_post_text(pid)
text = "\n\n".join(paras)
txt_path = "/tmp/carta_text.txt"
open(txt_path, "w").write(text)
print(f"Post #{pid}: «{title}» ({len(text)} car) → {voice}")
OUT.mkdir(parents=True, exist_ok=True)
mp3 = OUT / f"{name}.mp3"
subprocess.run([EDGE, "--voice", voice, "--file", txt_path,
"--write-media", str(mp3)], check=True)
print(f"OK -> {mp3}")
if __name__ == "__main__":
main()