Prompts de texto
Escreva o que quer em linguagem comum — a segunda pessoa a falar, a chuva, a linha de baixo. Não há lista de classes para decorar nem um conjunto fixo de stems entre os quais escolher.
Separação de fontes de áudio por prompt
O SAM Audio Lab retira um som específico de uma gravação carregada a partir de um prompt de texto — sem predefinições de stems e sem edição espectral manual. Recebe o som que pediu e, ao lado, a mistura residual.
Funciona com ficheiros de áudio e com a banda sonora de um vídeo.
Alvo
Residual
Capacidades
Escreva o que quer em linguagem comum — a segunda pessoa a falar, a chuva, a linha de baixo. Não há lista de classes para decorar nem um conjunto fixo de stems entre os quais escolher.
Quando um som é mais fácil de mostrar do que de descrever, marque-o na imagem do vídeo onde o ouve e o modelo fica com o objeto que indicou.
Selecione um trecho da linha temporal que contenha o som. Alguns segundos limpos costumam bastar para o modelo identificar o alvo.
O texto, uma escolha visual e um intervalo temporal somam-se. Duas pistas fracas resolvem quase sempre um alvo que nenhuma delas decide sozinha.
Um único modelo para todas as camadas
Um só modelo trata a mistura inteira em vez de uma cadeia de ferramentas especializadas. A mesma interface de prompt aplica-se quer o alvo seja uma voz, um instrumento ou um carro a passar.
Como funciona
Nada para instalar e nada para configurar antes da primeira tentativa.
Carregue um ficheiro de áudio, ou um vídeo cuja banda sonora queira trabalhar. A imagem é tratada como pista, não como decoração.
Escreva o alvo, clique nele na imagem ou arraste sobre os segundos em que soa. Refine o prompt e volte a correr as vezes que quiser.
Descarregue o alvo isolado e a mistura residual como faixas separadas, prontas a voltar diretamente para o editor.
Onde é usado
Quase todo o áudio que vale a pena salvar foi gravado uma única vez, num sítio que ninguém controlava.
Afaste a voz do convidado do café que se ouve atrás sem achatar a sala até ela soar a túnel.
Recupere diálogo utilizável de uma captação em exteriores, ou retire um efeito de uma faixa misturada quando os stems originais já não existem.
Isole um instrumento de uma gravação para aprender a parte, ou silencie-o e toque por cima do resto da tomada.
Retire uma ave, um motor ou uma voz de uma paisagem sonora que nunca esteve realmente em silêncio.
Entregue uma faixa de fala mais limpa à transcrição para que as legendas deixem de adivinhar palavras sobrepostas.
Construa clipes de fonte única a partir de gravações reais e desarrumadas em vez de as deitar fora.
Dentro de uma execução
Separar não é subtrair. Cada execução devolve o som que pediu juntamente com a mistura residual de onde ele saiu, por isso nada se perde e qualquer um dos lados pode ser o que fica.
Stem do alvo
O som pedido, numa faixa só dele.
Mistura residual
Tudo o que o prompt não selecionou, ainda sincronizado.
Original
Intacto, para comparar em A/B com as duas saídas.
Uma vista ilustrativa de uma execução. A interface de trabalho está na própria ferramenta.
Perguntas
O que a separação por prompt faz, e onde se torna difícil.
Em vez de escolher num menu fixo de stems — voz, bateria, baixo, outros — descreve por palavras o som que quer, ou aponta para ele, e é esse que é separado. O conjunto de alvos possíveis é aberto, em vez de estar fixado nas saídas do modelo.
Traga uma gravação, descreva o que isolar e leve os dois lados consigo.
Sem cadeia de plugins e sem predefinições de stems.