Ir al contenido

Configurar OBS Studio para grabar un vídeo en un portátil AMD

Christophe TREMBLAY-GUILLOUX
Christophe TREMBLAY-GUILLOUXIngeniero de sistemas Linux

Los ajustes por defecto de OBS Studio están pensados para la emisión en directo, no para grabar un archivo destinado al montaje. Un caudal limitado, un contenedor mal elegido y un nivel de micrófono demasiado bajo pasan desapercibidos en pantalla, y luego se pagan en el montaje y en la publicación.

Esta nota indica los valores que hay que introducir para grabar un vídeo comentado, con la cara incrustada sobre diapositivas, en un portátil AMD Ryzen con Linux. Cada ajuste está respaldado por una medición sobre el archivo obtenido.

ElementoValor
ProcesadorAMD Ryzen 7 PRO 8840HS, 16 hilos
Tarjeta gráficaRadeon 780M, nombre VAAPI Phoenix3
SistemaUbuntu 24.04
Servidor de audioPipeWire 1.0.5 con la capa pipewire-pulse
OBS Studio32.2.0

1. Formato de grabación y codificador de vídeo

Sección titulada «1. Formato de grabación y codificador de vídeo»

En Settings y luego Output, ponga Output Mode en Advanced y abra la pestaña Recording.

CampoValor
TypeStandard
Recording FormatHybrid MP4 (.mp4)
Video EncoderFFmpeg VAAPI H.264
Audio EncoderFFmpeg AAC
Audio Track1
Rescale Outputdesactivado

El formato híbrido escribe el archivo en fragmentos durante la grabación y lo finaliza como MP4 estándar al detenerla. Obtiene un archivo corriente, legible por cualquier programa de montaje, y sigue protegido si OBS se interrumpe a mitad de toma.

El MP4 fragmentado, en cambio, permanece fragmentado para siempre. Es un formato de difusión, la base de DASH y HLS. Los navegadores lo leen; los programas de montaje lo gestionan de forma mucho más desigual.

Marque una segunda pista de audio solo si graba varias fuentes de sonido y quiere reequilibrarlas por separado en el montaje. Con un único micrófono, las dos pistas serían idénticas.

Resultado esperado: el campo Recording Format muestra Hybrid MP4 (.mp4).

Más abajo en la misma pestaña, en Encoder Settings:

CampoValor
VAAPI DevicePhoenix3
ProfileHigh
LevelAuto
Rate ControlCQP
QP18
Keyframe Interval1 s
Maximum B-frames2

El modo CQP busca una calidad constante y reparte los bits donde la escena los necesita. El modo CBR, propuesto por defecto, es un ajuste de emisión en directo: limita el caudal para caber en un ancho de banda que aquí no le condiciona.

Un QP de 18 produce unos 2.200 kb/s con diapositivas poco animadas, frente a 1.500 kb/s con QP 22. El archivo dobla su peso, lo cual da igual en un intermedio destinado al montaje, y evita acumular pérdidas antes de la recodificación de la plataforma.

El intervalo de fotogramas clave de 1 segundo coloca un fotograma de referencia cada 30 fotogramas a 30 fotogramas por segundo. Sus cortes en el montaje caen con más precisión.

Resultado esperado: el campo Rate Control muestra CQP y el campo QP muestra 18.

En Settings y luego Video:

CampoValor
Base (Canvas) Resolution1920x1080
Output (Scaled) Resolution1920x1080
Common FPS Values30

Ambas resoluciones deben ser idénticas. Cualquier diferencia introduce un reescalado inútil que ablanda el texto de sus diapositivas.

En Settings y luego Audio, sección Global Audio Devices:

CampoValor
Desktop AudioDisabled
Desktop Audio 2Disabled
Mic/Auxiliary Audiosu micrófono

Sección General:

CampoValor
Sample Rate48 kHz
ChannelsMono

Un micrófono de auriculares o un micrófono USB produce una señal mono. Grabada en estéreo, se limita a duplicarse en dos canales idénticos, lo que dobla el peso de la pista sin aportar nada.

Deje el audio del escritorio desactivado mientras no grabe una demostración con sonido. Activo, capta las notificaciones del sistema y todo lo que a una pestaña del navegador se le ocurra reproducir. El día que lo necesite, añada una fuente Audio Output Capture (PulseAudio) en la única escena implicada, en lugar de reactivarlo de forma global.

La ganancia se toma lo antes posible en la cadena, allí donde cuesta menos ruido.

Abra pavucontrol, pestaña Input Devices, y ponga su micrófono al 100 %. En línea de comandos:

sh
pactl get-source-volume @DEFAULT_SOURCE@
pactl set-source-volume @DEFAULT_SOURCE@ 100%

No pase nunca del 100 %. Más allá ya no se trata de ganancia por hardware sino de una amplificación digital, que sube el siseo junto con la voz.

El deslizador de volumen de la fuente en el mezclador de OBS se queda en 0,0 dB. Ese deslizador sirve para dosificar una fuente frente a las demás, no para compensar un nivel de entrada. Usarlo como ganancia le impide saber qué hace cada etapa el día que tenga que diagnosticar un problema.

Hable después con normalidad y lea el vúmetro del mezclador. La escala de OBS es verde hasta -20 dBFS, amarilla de -20 a -9, roja por encima de -9. La saturación solo llega a 0 dBFS, cuando la barra topa con el extremo derecho. Su objetivo es -6 dBFS: está en la zona roja, y es lo normal.

Resultado esperado: la barra entra en rojo sin llegar nunca al extremo derecho.

Clic derecho sobre la fuente del micrófono en el mezclador, y luego Filters. El orden importa, cada filtro recibe la salida del anterior.

OrdenFiltroAjustes
1Noise Gatedesactivado
2Noise SuppressionRNNoise
3Gaina calibrar, ver más abajo
4Upward CompressorRatio 0,5:1, Threshold -16 dB, Attack 10 ms, Release 50 ms, Output Gain 0 dB, Knee Width 10
5LimiterThreshold -3 dB, Release 60 ms

Para ajustar el Gain, desactive temporalmente el compresor y el limitador, ponga la ganancia a 0 dB, hable con normalidad y anote el pico alcanzado. El valor que hay que introducir es entonces -6 menos el pico observado: un pico de -19 dBFS pide +13 dB, un pico de -12 dBFS pide +6 dB.

El compresor hacia arriba eleva los pasajes flojos hacia el umbral. Es una herramienta de regularidad, no de nivel: si tiene que fabricar 7 dB porque falta la ganancia, aplasta la dinámica de su voz. Ajuste primero la ganancia, después la compresión.

El Noise Gate se queda desactivado. Con un micrófono decente RNNoise basta, y una puerta mal ajustada corta los finales de frase.

Resultado esperado: hablando con normalidad, el vúmetro vive entre -12 y -6 dBFS.

Grabe diez segundos hablando con normalidad, y mida después el archivo.

Tipos de imagen, para confirmar que los B-frames están activos y que el intervalo de fotogramas clave es de un segundo:

sh
ffprobe -v error -select_streams v -show_entries frame=pict_type \
-of csv=p=0 grabacion.mp4 | sort | uniq -c

La salida debe contener una línea B. Sin ella, el ajuste no se ha aplicado.

Estructura del contenedor, para confirmar que el formato híbrido ha finalizado el archivo:

sh
ffprobe -v error -show_entries format=format_name -of csv=p=0 grabacion.mp4
mediainfo grabacion.mp4 | grep "Writing application"

La aplicación de escritura debe mostrar OBS Studio, y no Lavf, que delataría el muxer de FFmpeg del formato fragmentado.

Nivel sonoro:

sh
ffmpeg -hide_banner -nostats -i grabacion.mp4 \
-af ebur128=peak=true -f null - 2>&1 | tail -20

En una toma bien calibrada, el pico verdadero se sitúa entre -3 y -1 dBFS y la sonoridad integrada entre -20 y -16 LUFS.

Búsqueda de saturación:

sh
ffmpeg -hide_banner -i grabacion.mp4 \
-af "astats=measure_perchannel=none" -f null - 2>&1 | grep -E "Flat factor|Peak level"

Un factor de planitud a 0 significa que no se ha recortado ninguna serie de muestras.

Resultado esperado: una línea B en los tipos de imagen, OBS Studio como aplicación de escritura y un factor de planitud a 0.

El archivo que produce OBS es un máster destinado al programa de montaje, no un archivo de publicación. Nunca se envía tal cual a una plataforma.

Dos ajustes de los pasos anteriores existen por esa razón. El intervalo de fotogramas clave de un segundo ofrece un punto de entrada cada 30 fotogramas, lo que hace más fluido el desplazamiento por la línea de tiempo y más precisos los cortes. El QP de 18 deja margen: el montaje recodifica, y un máster ya degradado no se recupera.

Tampoco intente alcanzar -14 LUFS en OBS. Es el objetivo de normalización de las plataformas de difusión, y se aplica al archivo final, no a la materia prima. OBS solo debe entregar una señal sana, sin saturación, con algo de margen por debajo de 0 dBFS para que el montaje pueda trabajar.

9. Normalizar el sonido después del montaje

Sección titulada «9. Normalizar el sonido después del montaje»

Su programa de montaje exporta un archivo listo para publicar. Es ese el que se normaliza, y solo ese.

La operación no toca la imagen. Copiando el flujo de vídeo tal cual, solo recodifica el audio y evita una generación de pérdida en el vídeo:

sh
ffmpeg -i montaje.mp4 -af loudnorm=I=-14:TP=-1:LRA=11:print_format=summary -f null -

Este primer comando mide y no escribe nada. Traslade los cuatro valores obtenidos al segundo:

sh
ffmpeg -i montaje.mp4 -c:v copy \
-af loudnorm=I=-14:TP=-1:LRA=11:measured_I=…:measured_TP=…:measured_LRA=…:measured_thresh=… \
-c:a aac -b:a 192k -movflags +faststart publicacion.mp4

El -c:v copy es el punto importante: el vídeo se copia byte a byte, sin recodificación.

Una sola pasada también funciona, sin los parámetros measured_, pero gestiona mal las variaciones de nivel a lo largo del vídeo.

Resultado esperado: la sonoridad integrada medida en publicacion.mp4 se acerca a -14 LUFS y el pico verdadero no supera -1 dBFS.

La ganancia de entrada se mueve sola. El procesamiento WebRTC de los navegadores, que usa toda videollamada en Chrome o Firefox, incorpora un control automático de ganancia que escribe directamente en el volumen del dispositivo. Una videollamada por la mañana puede dejarle el micrófono al 40 % por la tarde. Vuelva a leer pactl get-source-volume @DEFAULT_SOURCE@ antes de cada grabación.

El puntero del ratón se captura por defecto. Una fuente de captura de pantalla reproduce fielmente lo que usted ve, flecha incluida. Queda entonces visible durante todo el vídeo, y se mueve al menor roce del panel táctil. Desmarque Show Cursor en las propiedades de la fuente.

Una webcam capturada por su ventana le encierra en ese tamaño. Si graba la ventana de una aplicación que muestra la cámara en lugar de la cámara misma, OBS solo recibe los píxeles mostrados en pantalla. La imagen se mantiene nítida mientras la incrustación conserve ese tamaño, pero nunca podrá ampliarla ni cambiar el encuadre sin pérdida. Una fuente Video Capture Device (V4L2) recibe el flujo nativo de la cámara. Si allí el 1080p solo se ofrece en MJPEG, elija MJPEG: el formato YUYV suele quedarse en unos pocos fotogramas por segundo por falta de ancho de banda USB.

El codificador por software sigue siendo una alternativa. En esta máquina, x264 con el preajuste veryfast codifica unas siete veces más rápido que el tiempo real con diapositivas poco animadas, y con mejor eficacia de compresión que el codificador por hardware. Solo compensa si busca másteres más compactos, y consume un procesador que probablemente prefiera dejar libre durante la grabación.