Una locución grabada en las mejores condiciones sigue sonando incompleta sin un segundo proceso detrás. Ruido de fondo, niveles desiguales entre frases, silencios mal cortados, todo eso se corrige después de la grabación, no durante. Ese proceso se llama postproducción de locuciones y es lo que separa un audio que suena a casero de uno que puede emitirse en televisión, un anuncio o un curso online.

Aquí explicamos en qué consiste, qué pasos sigue y qué herramientas se usan para conseguirlo.

¿Estás buscando un locutor profesional? Contacta con nosotras, tenemos más de 20 años de experiencia en locuciones profesionales.

Qué es la postproducción de locuciones

La postproducción de locuciones es el conjunto de procesos técnicos que se aplican a un audio de voz después de la grabación, para limpiarlo, equilibrarlo y prepararlo para su uso final. Incluye eliminar ruido, ajustar el volumen, aplicar ecualización, sincronizar con vídeo o música cuando corresponde, y entregar el archivo en el formato que pide el cliente.

No es un paso opcional. Una locución sin postproducción puede tener respiraciones audibles, golpes de micrófono o cambios de volumen entre tomas que se notan incluso a oídos no entrenados. La postproducción es la que convierte una grabación técnicamente correcta en un producto listo para publicarse.

En qué consiste el proceso, paso a paso

El proceso varía según el uso final del audio, pero casi siempre pasa por estas fases.

Limpieza y reducción de ruido

Se eliminan ruidos de fondo, zumbidos eléctricos, clics de boca o respiraciones que se han colado durante la grabación. Una herramienta habitual para esto es la puerta de ruido, que corta automáticamente cualquier sonido por debajo de un umbral determinado, útil para silenciar el ruido de sala entre frases. Hay que usarla con cuidado porque un umbral mal ajustado puede comerse el inicio de una palabra suave o una consonante como la «f» o la «s». En una cabina bien tratada acústicamente el ruido de base es mínimo, pero siempre queda algo que limpiar antes del siguiente paso.

Ecualización, compresión y normalización

Son tres ajustes distintos y se suelen confundir entre sí. La ecualización actúa sobre las frecuencias, atenuando o realzando graves, medios o agudos para que la voz suene clara y sin resonancias molestas, por ejemplo quitando cuerpo sobrante en las frecuencias bajas o suavizando una sibilancia excesiva en las eses.

La compresión actúa sobre la dinámica del audio, no sobre las frecuencias. Reduce la diferencia entre las partes más altas y las más bajas de la grabación, subiendo el volumen de lo que suena flojo y conteniendo los picos que suenan demasiado fuerte. El resultado es una voz que se mantiene inteligible de principio a fin, sin frases que se pierdan o que suenen a golpe de volumen. Un ajuste relacionado es la automatización de volumen, que corrige puntualmente sonidos que «se sienten» más fuertes de lo que marcan los medidores, como las oclusivas «p» o «b» al pronunciarse cerca del micrófono.

La normalización es distinta a las dos anteriores. No cambia la forma de la señal, solo ajusta el nivel general del archivo completo para que alcance un volumen de referencia, medido en LUFS. Cada destino final exige un nivel distinto, y entregar un audio fuera de ese rango significa que la plataforma lo va a subir o bajar de volumen por su cuenta, con el riesgo de que suene peor de lo que se entregó.

Niveles LUFS según el destino final

Estos son los niveles de referencia más habituales, aunque conviene confirmarlos con el cliente porque algunas plataformas actualizan sus requisitos.

Destino del audioNivel LUFS objetivoTecho de pico
Vídeo online (YouTube y similares)-14 LUFS-1 dBTP
Podcast (Apple Podcasts, Spotify)-16 LUFS-1,5 dBTP
Música y anuncios en streaming (Spotify, Amazon Music)-14 LUFS-1 dBTP
Radio y TV en Europa (norma EBU R128)-23 LUFS-1 dBTP
Radio y TV en EE. UU. (norma ATSC A/85)-24 LKFS-2 dBTP
Audiolibro (especificación ACX de Audible)entre -23 y -18 LUFS-3 dBTP

 

Sincronización con vídeo o música

Cuando la locución acompaña un vídeo corporativo, un anuncio o un curso e-learning, hay que ajustar el ritmo de la voz a las imágenes o a la música de fondo. Esto implica recortar silencios, alargar o acortar pausas y, en ocasiones, pedir una nueva toma de alguna frase concreta para que encaje con el tiempo disponible.

Empalmes y montaje final

Cuando el audio final se construye a partir de varias tomas, el punto de corte importa. Empalmar dos fragmentos en mitad de una consonante suave, como una «s» o una «z», suele notarse. Cortar en una consonante dura disimula mejor la unión. Los cortes bruscos también se evitan con pequeños fundidos de entrada y salida en cada empalme, en lugar de un corte seco que se percibe como un clic.

Corte y nomenclatura de archivos

Muchos proyectos no se entregan como un único audio. Una audioguía necesita un archivo independiente por cada punto de la visita. Un curso online necesita un archivo por lección o por módulo. En estos casos, después de postproducir el audio completo hay que cortarlo en las piezas que pide el proyecto y nombrar cada archivo siguiendo la estructura que vaya a usar el cliente para importarlos en su sistema, por ejemplo un número de orden, el código del punto de interés o el título exacto de la lección.

Un corte mal hecho o un archivo mal nombrado obliga al cliente a reordenar o renombrar manualmente decenas de pistas, así que esta parte del proceso conviene acordarla con el cliente antes de empezar a grabar, no al final.

Herramientas que se usan para postproducir locuciones

El software más habitual en estudios profesionales es Adobe Audition, Pro Tools e iZotope RX, este último especializado en restauración de audio y reducción de ruido complejo. También se usan plugins específicos para ecualización dinámica, control de sibilancias y masterización, que varían según el estudio y el tipo de proyecto.

En Trágora trabajamos con Pro Tools y con Adobe Audition combinado con Premiere para los proyectos que requieren sincronización con vídeo. Para la limpieza y restauración de audio usamos iZotope, y para la ecualización de precisión, FabFilter Pro-Q.

Cuánto tarda y de qué depende el precio

El tiempo de postproducción depende de la duración del audio, del estado de la grabación original y de si requiere sincronización con vídeo. Un spot de treinta segundos puede postproducirse en pocos minutos. Un curso e-learning de varias horas, o un audiolibro completo, puede llevar días de trabajo.

El precio suele calcularse por minuto de audio final o como parte del paquete cerrado de la locución. Los factores que más lo mueven son la calidad de la grabación de partida, la necesidad de sincronización precisa y el nivel de limpieza que requiera el ruido de fondo.

Por qué la postproducción marca la diferencia frente a una locución amateur

Dos locutores con la misma calidad de voz pueden entregar resultados muy distintos según quién postproduzca el audio. Una locución sin tratamiento profesional suena plana, con ruido de fondo perceptible y cambios de volumen entre frases. La misma grabación, tras un proceso de postproducción cuidado, gana presencia y consistencia de principio a fin.

Para un cliente que va a usar ese audio en un anuncio, una web o un vídeo corporativo, esa diferencia se traduce directamente en cómo percibe la marca quien lo escucha.

Cómo lo hacemos en Trágora

En Trágora contamos con dos editores de audio que se encargan de postproducir todas las locuciones que lo necesitan. Pero el primer paso para que ese proceso funcione no está en la mesa de edición, está antes, en la selección de los locutores que aceptamos en nuestro banco de voces.

Solo admitimos locutores que graban desde un estudio profesional en casa que cumple unos mínimos técnicos exigidos. Si la grabación de partida tiene ruido de fondo, reflejos o una toma mal captada, hay un límite a lo que la postproducción puede arreglar después. Por eso invertimos en filtrar la calidad de origen antes que en depender de corregirla a posteriori.

Preguntas frecuentes sobre postproducción de locuciones

¿La postproducción la hace el propio locutor o un editor de audio distinto?

Depende del estudio. Algunos locutores hacen su propia postproducción básica, sobre todo si trabajan en solitario. En estudios y agencias con volumen de trabajo, suele haber un editor de audio dedicado que se encarga de todos los proyectos, lo que garantiza un estándar de calidad consistente independientemente de quién haya grabado.

¿Cuánto cuesta la postproducción de una locución?

El coste varía según la duración del audio y la complejidad del trabajo requerido. Muchas agencias lo incluyen dentro del precio total de la locución en lugar de facturarlo aparte. Para proyectos con sincronización de vídeo o necesidades técnicas específicas, el coste suele ser más alto que el de una locución simple sin sincronización.

¿Se puede postproducir cualquier grabación, aunque tenga mucho ruido?

Hasta cierto punto. Herramientas como iZotope RX permiten reducir ruidos de fondo considerables, pero hay límites. Una grabación hecha en un espacio sin ningún tratamiento acústico, con eco fuerte o ruido ambiental constante, puede mejorar con postproducción pero rara vez llega a sonar como una grabación hecha en cabina profesional desde el principio.

¿Qué diferencia hay entre ecualización, compresión y normalización?

La ecualización cambia el color del sonido ajustando frecuencias concretas. La compresión cambia la dinámica, acercando los picos y los valles de volumen dentro de la misma grabación. La normalización ajusta el nivel general del archivo completo a un volumen de referencia, sin tocar la forma de la señal. Se aplican en ese orden y resuelven problemas distintos.

¿Qué nivel de LUFS necesita mi proyecto?

Depende de dónde se vaya a publicar. Un vídeo para YouTube busca -14 LUFS, un podcast en Apple o Spotify busca -16 LUFS, y un spot para radio o televisión en Europa tiene que ajustarse a los -23 LUFS que marca la norma EBU R128. Si el proyecto va a distribuirse en varios canales a la vez, lo habitual es entregar una versión masterizada para cada destino.

¿Es necesaria la postproducción si la grabación ya suena bien?

Sí. Incluso una grabación limpia hecha en cabina profesional necesita normalización y un último control de niveles para cumplir el estándar de volumen de la plataforma o medio donde se vaya a publicar. La postproducción no solo corrige errores, también prepara el archivo para su uso final.

¿Cuánto tiempo se tarda en postproducir un audio?

Un audio corto, como un spot publicitario, puede postproducirse en minutos. Un proyecto largo, como un curso e-learning o un audiolibro completo, puede llevar varios días, sobre todo si requiere sincronización precisa con vídeo o segmentación por capítulos.

¿La sincronización con vídeo tiene un coste adicional?

En la mayoría de los casos sí, porque requiere un trabajo de ajuste manual que no aplica a una locución sin vídeo. El coste depende de la duración del vídeo y de la precisión que exija el ajuste, por ejemplo, si hay que encajar la voz con cambios de escena concretos.

¿Puedo pedir cambios después de recibir el audio postproducido?

La mayoría de estudios incluyen una ronda de ajustes dentro del precio, sobre todo si son cambios menores de volumen o de sincronización. Cambios más grandes, como una nueva toma de voz, suelen tener un coste aparte porque implican volver a grabar, no solo reeditar.

Si necesitas postproducir una locución para tu proyecto

La calidad de una locución no depende solo de la voz que la graba. El proceso posterior es el que determina si ese audio está listo para publicarse o si todavía suena a borrador. Si tienes un proyecto que necesita locución con postproducción incluida, cuéntanos qué formato final necesitas y te explicamos cómo lo trabajamos.

PRESUPUESTO DE LOCUCIÓN