Desarrollo de un reproductor web para la ambientación de Aetheryte en FFXIV

Este artículo técnico detalla el proceso de creación de una aplicación web que reproduce fielmente la ambientación sonora de los cristales Aetheryte del videojuego Final Fantasy XIV (FFXIV). El autor, tras seis años utilizando grabaciones de YouTube con limitaciones como bucles no fluidos y alta exi

HERTZ: un estudio de audio vocal que funciona íntegramente en el navegador

HERTZ es una estación de trabajo de audio digital basada en la web, pensada para limpiar y masterizar voces —especialmente de pódcast y palabra hablada— directamente en el navegador, sin enviar ningún archivo a un servidor. Toda la cadena de procesamiento se ejecuta en el equipo del usuario: la desc

Audio-Cassette-Simulation: emula el sonido de cintas de casete con ffmpeg

Audio-Cassette-Simulation es un proyecto de código abierto publicado en GitHub por AARomanov1985 que reproduce digitalmente los perfiles de audio característicos de las cintas de casete. La herramienta, distribuida bajo licencia MIT, emplea scripts de bash junto con ffmpeg (compilado con libmp3lame)

Erm: una herramienta de línea de comandos para eliminar muletillas del habla

Erm es una herramienta de línea de comandos de código abierto diseñada para eliminar disfluencias como “um”, “uh” y “er” de archivos de audio de voz. Desarrollada por Doug Calobrisi y disponible en GitHub, se ejecuta completamente en local, lo que garantiza la privacidad de las grabaciones. La inter

Resonate: análisis espectral de audio en tiempo real y baja latencia

Resonate es un algoritmo de análisis espectral diseñado para extraer información perceptible de señales de audio (y de otro tipo) con baja latencia, mínima huella de memoria y reducido coste computacional. A diferencia de los métodos basados en la transformada de Fourier, Resonate emplea un modelo d

Tanh: Técnicas para una Aproximación Eficiente

Este artículo de Tom Schroeder explora diversas técnicas para aproximar la función tangente hiperbólica (tanh), una función crucial en áreas como redes neuronales y procesamiento de audio. La función tanh mapea cualquier número real a un rango entre -1 y 1, presentando una curva en forma de 'S' que

Tiras LED reactivas: un proyecto más complejo de lo que parece

Este artículo de Scott Lawson narra la desafiante experiencia de crear un sistema de tiras LED reactivas al audio. Lo que parece un proyecto sencillo (controlar el brillo de las tiras LED según la música) resulta ser sorprendentemente complejo debido a las limitaciones inherentes a la cantidad de LE

Podcast mejora rendimiento con Cloudflare y FFmpeg

Este artículo describe cómo el desarrollador Kent C. Dodds movió el procesamiento de audio con FFmpeg fuera de su servidor principal (Fly.io) a Cloudflare para evitar problemas de rendimiento. Inicialmente, Dodds ejecutaba FFmpeg directamente en su servidor para procesar grabaciones de su podcast 'C

Vee 🥑 reinventa el icónico Amen Break

El proyecto "Bubble Sorted Amen Break" de Vee 🥑, disponible en parametricavocado.itch.io, es una herramienta innovadora que manipula y organiza el icónico sample de batería conocido como "Amen Break". Para entender su importancia, primero debemos contextualizar el Amen Break. ¿Qué es el Amen Break?

Claude Code ahora procesa audio con IA

Claude Code, la plataforma de desarrollo de OpenAI, ha integrado un conjunto de 25 herramientas de procesamiento de audio a través de una nueva integración con DeclarAgent. Esta integración, desarrollada por Shiehn y disponible en GitHub, permite a los usuarios realizar tareas como recortar, normali