Separacja źródeł dźwięku sterowana promptem

Opisz dźwięk. Odbierz go na osobnej ścieżce.

SAM Audio Lab wyciąga pojedynczy dźwięk z zatłoczonego nagrania na podstawie zwykłego promptu tekstowego — bez gotowych zestawów stemów i bez ręcznej edycji spektralnej. Dostajesz dźwięk, o który poprosiłeś, a obok niego resztę miksu.

Działa na plikach audio i na ścieżce dźwiękowej wideo.

Możliwości

Jeden prompt, jeden czysty stem — w mowie, muzyce i codziennych dźwiękach.

Prompty tekstowe

Napisz zwykłymi słowami, czego szukasz — druga osoba mówiąca, deszcz, linia basu. Nie ma listy klas do zapamiętania ani sztywnego zestawu stemów do wyboru.

Prompty przez wskazanie

Gdy dźwięk łatwiej pokazać niż opisać, zaznacz go na kadrze wideo w miejscu, w którym go słyszysz — model weźmie wskazany obiekt.

Prompty czasowe

Zaznacz fragment osi czasu zawierający dany dźwięk. Kilka czystych sekund zwykle wystarcza, by model rozpoznał cel.

Prompty łączone

Tekst, wskazanie na obrazie i zakres czasu można łączyć. Dwie słabe wskazówki najczęściej rozstrzygają cel, którego żadna z nich nie rozstrzyga osobno.

Jeden model do każdej warstwy

Separacja, której nie obchodzi rodzaj dźwięku

Wypróbuj na własnym pliku

Jeden model obsługuje całą mieszaninę zamiast łańcucha wyspecjalizowanych narzędzi. Ten sam sposób promptowania działa, czy celem jest głos, instrument, czy przejeżdżający samochód.

Jak to działa

Trzy kroki, bez konfigurowania sesji

Nic do instalowania i nic do ustawiania przed pierwszym uruchomieniem.

  1. 01

    Przynieś nagranie

    Wgraj plik audio albo wideo, którego ścieżkę dźwiękową chcesz opracować. Obraz traktowany jest jako wskazówka, nie jako ozdoba.

  2. 02

    Powiedz, co wyodrębnić

    Wpisz cel, kliknij go na kadrze albo przeciągnij po sekundach, w których brzmi. Prompt możesz doprecyzowywać i uruchamiać ponownie dowolnie wiele razy.

  3. 03

    Zabierz obie strony

    Pobierz wyodrębniony cel i resztę miksu jako osobne ścieżki, gotowe do wstawienia z powrotem do edytora.

Gdzie się przydaje

Nagrania, których nie da się zarejestrować po raz drugi

Większość dźwięku wartego ocalenia zarejestrowano raz, w miejscu, którego nikt nie kontrolował.

Czyszczenie podcastów i wywiadów

Odsuń głos gościa od kawiarni szumiącej w tle, nie spłaszczając pomieszczenia do brzmienia tunelu.

Postprodukcja filmu i wideo

Odzyskaj używalny dialog z ujęcia w plenerze albo wyciągnij efekt ze zmiksowanej ścieżki, gdy oryginalnych stemów już nie ma.

Nauka i ćwiczenie muzyki

Wyodrębnij jeden instrument z nagrania, by nauczyć się partii, albo wycisz go i zagraj do reszty.

Nagrania terenowe i przyrodnicze

Wyciągnij jednego ptaka, jeden silnik albo jeden głos z pejzażu, który nigdy naprawdę nie był cichy.

Napisy i dostępność

Podaj do transkrypcji czystszą ścieżkę mowy, żeby napisy przestały zgadywać nakładające się słowa.

Przygotowanie zbiorów danych

Twórz klipy z jednym źródłem z chaotycznych nagrań z terenu, zamiast je odrzucać.

Wnętrze przebiegu

Cel i cała reszta, obok siebie

Separacja to nie odejmowanie. Każdy przebieg zwraca dźwięk wskazany promptem razem z resztą miksu, z której pochodzi — nic nie zostaje wyrzucone, a zatrzymać można dowolną ze stron.

Promptsaksofon, nie publiczność

Stem celu

Wskazany dźwięk na osobnej ścieżce.

Reszta miksu

Wszystko, czego prompt nie wybrał, nadal zsynchronizowane.

Oryginał

Nietknięty, do porównania A/B z obydwoma wynikami.

Poglądowy widok przebiegu. Właściwy interfejs znajduje się w samym narzędziu.

FAQ

Pytania, które padają najpierw

Co robi separacja sterowana promptem i gdzie robi się trudno.

Zamiast wybierać ze sztywnego menu stemów — wokal, perkusja, bas, reszta — opisujesz słowami dźwięk, którego chcesz, albo go wskazujesz, i to on zostaje wyodrębniony. Zbiór możliwych celów jest otwarty, a nie zaszyty w wyjściach modelu.

Umieść potrzebny dźwięk na osobnej ścieżce

Przynieś nagranie, opisz, co wyodrębnić, i zabierz obie strony.

Rozdziel nagranie

Bez łańcucha wtyczek i bez gotowych zestawów stemów.