OfflineTTS: kit privado de audio con IA en el navegador para TTS, STT, subtítulos y audiolibros

Fuentes: OfflineTTS: Private AI Audio Toolkit for TTS, STT, Subtitles, and Ebook Audio

OfflineTTS es una plataforma gratuita y centrada en el navegador que reúne en un único kit varias herramientas de audio con IA para creadores, investigadores y usuarios con necesidades de accesibilidad. Su objetivo es evitar depender de servicios en la nube ofreciendo procesamiento local y privado. La plataforma integra cuatro motores locales de síntesis de voz (TTS): Kokoro (54 voces en 9 idiomas), Kitten (8 expresiones, modelo ligero), Piper (síntesis compatible con CPU para audio de larga duración) y Supertonic (voces multilingües con estilos para inglés, español, portugués, francés y coreano). En el apartado de transcripción, emplea Whisper, capaz de reconocer voz en 99 idiomas y exportar resultados en TXT, SRT y VTT, con marcas de tiempo.

La herramienta se organiza en flujos de trabajo concretos: convertir audio o vídeo en texto, generar archivos de subtítulos SRT y VTT listos para Shorts y Reels, producir locuciones para canales sin rostro (incluidos WAV y MP3), y transformar EPUB, PDF y TXT en audio para escucha. Los casos de uso contemplados incluyen creación de contenido, accesibilidad, estudio y revisión de documentos, así como transcripción de entrevistas y reuniones para equipos y proyectos de investigación donde la privacidad es prioritaria.

Frente a alternativas comerciales como ElevenLabs, NaturalReader o Murf, OfflineTTS destaca por ser gratuito, sin límites de uso por caracteres, con modo sin conexión real y un modelo de privacidad basado en el procesamiento en el dispositivo. El motor Whisper y los TTS en inglés pueden funcionar offline tras la descarga inicial del modelo.