Prompts de texto
Escribe lo que quieres en lenguaje corriente: la segunda persona que habla, la lluvia, la línea de bajo. No hay una lista de clases que memorizar ni un conjunto fijo de stems entre los que elegir.
Separación de fuentes de audio por prompt
SAM Audio Lab extrae un sonido concreto de una grabación saturada a partir de un prompt de texto: sin preajustes de stems y sin edición espectral manual. Obtienes el sonido que pediste y, junto a él, la mezcla residual.
Funciona con archivos de audio y con la banda sonora de un vídeo.
Objetivo
Residual
Capacidades
Escribe lo que quieres en lenguaje corriente: la segunda persona que habla, la lluvia, la línea de bajo. No hay una lista de clases que memorizar ni un conjunto fijo de stems entre los que elegir.
Cuando un sonido es más fácil de mostrar que de describir, márcalo en el fotograma donde lo oyes y el modelo toma el objeto que has señalado.
Selecciona un tramo de la línea de tiempo que contenga el sonido. Unos pocos segundos limpios suelen bastar para que el modelo identifique el objetivo.
El texto, una selección visual y un intervalo temporal se suman. Dos pistas débiles suelen resolver un objetivo que ninguna de las dos determina por sí sola.
Un solo modelo para todas las capas
Un único modelo trata la mezcla completa en lugar de una cadena de herramientas especializadas. La misma interfaz de prompt sirve tanto si el objetivo es una voz, un instrumento o un coche que pasa.
Cómo funciona
Nada que instalar y nada que ajustar antes de la primera prueba.
Sube un archivo de audio, o un vídeo cuya banda sonora quieras trabajar. La imagen se trata como una pista más, no como decoración.
Escribe el objetivo, haz clic sobre él en el fotograma o arrastra sobre los segundos en los que suena. Afina el prompt y vuelve a ejecutarlo tantas veces como quieras.
Descarga el objetivo aislado y la mezcla residual como pistas separadas, listas para volver directamente a tu editor.
Dónde se usa
Casi todo el audio que merece la pena salvar se grabó una sola vez, en un sitio que nadie controlaba.
Separa la voz de la persona invitada de la cafetería que suena detrás sin aplastar la sala hasta convertirla en un túnel.
Recupera diálogo aprovechable de una toma en exteriores, o extrae un efecto de una pista mezclada cuando los stems originales ya no existen.
Aísla un instrumento de una grabación para aprender la parte, o siléncialo y toca sobre el resto de la toma.
Saca un pájaro, un motor o una voz de un paisaje sonoro que nunca estuvo realmente en silencio.
Pasa una pista de voz más limpia a la transcripción para que los subtítulos dejen de adivinar las palabras solapadas.
Construye clips de una sola fuente a partir de grabaciones reales y desordenadas en lugar de descartarlas.
Dentro de una ejecución
Separar no es restar. Cada ejecución devuelve el sonido que pediste junto con la mezcla residual de la que salió, así que no se descarta nada y cualquiera de las dos partes puede ser la que te quedes.
Stem objetivo
El sonido solicitado, en su propia pista.
Mezcla residual
Todo lo que el prompt no seleccionó, aún sincronizado.
Original
Intacto, para comparar en A/B con las dos salidas.
Una vista ilustrativa de una ejecución. La interfaz real vive dentro de la herramienta.
Preguntas
Qué hace la separación por prompt y dónde se complica.
En lugar de elegir en un menú fijo de stems —voz, batería, bajo, otros—, describes con palabras el sonido que quieres, o lo señalas, y eso es lo que se separa. El conjunto de objetivos posibles es abierto en vez de estar fijado en las salidas del modelo.
Trae una grabación, describe qué hay que aislar y llévate las dos partes.
Sin cadena de plugins y sin preajustes de stems.