Prompty tekstowe
Napisz zwykłymi słowami, czego szukasz — druga osoba mówiąca, deszcz, linia basu. Nie ma listy klas do zapamiętania ani sztywnego zestawu stemów do wyboru.
Separacja źródeł dźwięku sterowana promptem
SAM Audio Lab wyciąga pojedynczy dźwięk z zatłoczonego nagrania na podstawie zwykłego promptu tekstowego — bez gotowych zestawów stemów i bez ręcznej edycji spektralnej. Dostajesz dźwięk, o który poprosiłeś, a obok niego resztę miksu.
Działa na plikach audio i na ścieżce dźwiękowej wideo.
Cel
Reszta
Możliwości
Napisz zwykłymi słowami, czego szukasz — druga osoba mówiąca, deszcz, linia basu. Nie ma listy klas do zapamiętania ani sztywnego zestawu stemów do wyboru.
Gdy dźwięk łatwiej pokazać niż opisać, zaznacz go na kadrze wideo w miejscu, w którym go słyszysz — model weźmie wskazany obiekt.
Zaznacz fragment osi czasu zawierający dany dźwięk. Kilka czystych sekund zwykle wystarcza, by model rozpoznał cel.
Tekst, wskazanie na obrazie i zakres czasu można łączyć. Dwie słabe wskazówki najczęściej rozstrzygają cel, którego żadna z nich nie rozstrzyga osobno.
Jeden model obsługuje całą mieszaninę zamiast łańcucha wyspecjalizowanych narzędzi. Ten sam sposób promptowania działa, czy celem jest głos, instrument, czy przejeżdżający samochód.
Jak to działa
Nic do instalowania i nic do ustawiania przed pierwszym uruchomieniem.
Wgraj plik audio albo wideo, którego ścieżkę dźwiękową chcesz opracować. Obraz traktowany jest jako wskazówka, nie jako ozdoba.
Wpisz cel, kliknij go na kadrze albo przeciągnij po sekundach, w których brzmi. Prompt możesz doprecyzowywać i uruchamiać ponownie dowolnie wiele razy.
Pobierz wyodrębniony cel i resztę miksu jako osobne ścieżki, gotowe do wstawienia z powrotem do edytora.
Gdzie się przydaje
Większość dźwięku wartego ocalenia zarejestrowano raz, w miejscu, którego nikt nie kontrolował.
Odsuń głos gościa od kawiarni szumiącej w tle, nie spłaszczając pomieszczenia do brzmienia tunelu.
Odzyskaj używalny dialog z ujęcia w plenerze albo wyciągnij efekt ze zmiksowanej ścieżki, gdy oryginalnych stemów już nie ma.
Wyodrębnij jeden instrument z nagrania, by nauczyć się partii, albo wycisz go i zagraj do reszty.
Wyciągnij jednego ptaka, jeden silnik albo jeden głos z pejzażu, który nigdy naprawdę nie był cichy.
Podaj do transkrypcji czystszą ścieżkę mowy, żeby napisy przestały zgadywać nakładające się słowa.
Twórz klipy z jednym źródłem z chaotycznych nagrań z terenu, zamiast je odrzucać.
Wnętrze przebiegu
Separacja to nie odejmowanie. Każdy przebieg zwraca dźwięk wskazany promptem razem z resztą miksu, z której pochodzi — nic nie zostaje wyrzucone, a zatrzymać można dowolną ze stron.
Stem celu
Wskazany dźwięk na osobnej ścieżce.
Reszta miksu
Wszystko, czego prompt nie wybrał, nadal zsynchronizowane.
Oryginał
Nietknięty, do porównania A/B z obydwoma wynikami.
Poglądowy widok przebiegu. Właściwy interfejs znajduje się w samym narzędziu.
FAQ
Co robi separacja sterowana promptem i gdzie robi się trudno.
Zamiast wybierać ze sztywnego menu stemów — wokal, perkusja, bas, reszta — opisujesz słowami dźwięk, którego chcesz, albo go wskazujesz, i to on zostaje wyodrębniony. Zbiór możliwych celów jest otwarty, a nie zaszyty w wyjściach modelu.
Przynieś nagranie, opisz, co wyodrębnić, i zabierz obie strony.
Bez łańcucha wtyczek i bez gotowych zestawów stemów.