← Blog

Z YouTube na karaoke: proměňte jakoukoli píseň v doprovodnou stopu

2026-08-04

Na YouTube žádné tlačítko „karaoke verze" není. Pokud si chcete zazpívat na konkrétní skladbu — takovou, ke které nikdy nevyšel oficiální instrumentál, cover verzi, nebo cizojazyčnou píseň, o které karaoke automat v sousedství nikdy neslyšel — doprovodnou stopu si musíte vyrobit sami.

Dobrá zpráva je, že dnes jde o práci na dva kroky, zabere zhruba pět minut a nic nestojí. První krok je získat píseň jako zvukový soubor. Druhý krok je prohnat tento soubor modelem umělé inteligence, který oddělí zpěv od všeho ostatního.

Rychlá odpověď

  1. Zkopírujte odkaz YouTube na požadovanou píseň.
  2. Převeďte ji na MP3 ve 320 kbps pomocí OnlyMP3.tools. Datový tok tu hraje mnohem větší roli než při běžném poslechu — viz níže.
  3. Nahrajte toto MP3 do nástroje pro AI separaci zpěvu, například SongToKaraoke, který skladbu rozdělí na zpěv a instrumentál.
  4. Stáhněte si instrumentální stopu. To je váš karaoke podklad.

Tím celý postup končí. Zbytek návodu vysvětluje, proč na každém kroku záleží, které písně se oddělují čistě a co dělat, když výsledek zní špatně.

Proč nestačí „ztlumit zpěv"

Starý trik na výrobu karaoke se jmenoval rušení středového kanálu. Hlavní vokál je téměř vždy namíchán přesně do středu, tedy se stejným signálem v levém i pravém kanálu. Odečtěte jeden kanál od druhého a všechno dokonale vystředěné se vyruší — včetně hlasu.

Funguje to tak napůl a právě proto existovaly bezplatné „vocal removery" dávno před nástupem AI. Má to ale dvě fatální vady:

  • Zmizí i všechno ostatní ze středu. Kopák, virbl a basa bývají také téměř vždy uprostřed. Se zpěvákem přijdete o celou rytmickou sekci.
  • Dozvuk zůstane. Ocas reverbu vokálu je stereo, nikoli vystředěný, takže vám zbude přízračná ozvěna zpěvu bez zpěvu. Zní to strašidelně.

Moderní AI separace pracuje na úplně jiném principu. Modely jako Demucs se učily na desítkách tisíc písní, ke kterým byly dostupné izolované stopy, takže se naučily, jak lidský hlas zní, a ne kde sedí ve stereo poli. Vokál vytáhnou podle jeho akustického otisku a bicí, basu i nástroje nechají nedotčené.

Praktický rozdíl je propastný. Rušení středu vám dá tenkou dutou stopu bez bicích. AI separace vám dá něco, co zní jako skutečný instrumentál.

Krok 1: Získejte píseň jako MP3

Vložte odkaz YouTube na OnlyMP3.tools, vyberte datový tok a stáhněte.

Zvolte 320 kbps. Při běžném poslechu většina lidí rozdíl mezi 192 a 320 neslyší a normálně říkáme, ať si vyberete podle účelu. Separace zpěvu je výjimka a tady je důvod.

Komprese MP3 funguje tak, že zahazuje zvukovou informaci, o které kodér předpokládá, že si jí vědomě nevšimnete. Při nižších datových tocích zahazuje víc — zejména ve vysokých frekvencích a v tichých pasážích, kde je jeden zvuk maskován hlasitějším. A přesně tyto oblasti používá separační model k rozlišení hlasu od kytary. Podat mu soubor ve 128 kbps znamená žádat ho, aby rekonstruoval vokál z dat, která byla záměrně zahozena.

Artefakty se projeví jako vodnatý, vlnící se charakter instrumentálu, nejlépe slyšitelný na činelech a ocasech dozvuku. Ze stejného důvodu se neretušuje fotka, která už byla pětkrát uložena jako nekvalitní JPEG.

Kompletní rozbor toho, co která úroveň datového toku stojí, najdete v průvodci datovými toky OnlyMP3.

Ještě jedna důležitá věc: kvalita zdrojového videa je strop, který nezvýšíte. Pokud někdo píseň nahrál z nekvalitního ripu, požadavek na 320 kbps vám dá jen velký soubor se špatným zvukem. Dávejte přednost oficiálním kanálům interpretů nebo oficiálním kanálům „Artist - Topic" — ty obvykle vycházejí z masteru vydavatelství.

Krok 2: Oddělte zpěv

Nahrajte MP3 do nástroje pro AI separaci. SongToKaraoke je postavený přesně na tento účel: nahrajete píseň a dostanete zpět instrumentál bez zpěvu, který si stáhnete a můžete na něj zpívat. Existují i univerzální rozdělovače stop, pokud chcete bicí a basu jako samostatné soubory, ale na karaoke stačí rozdělení na dvě části.

Zpracování obvykle trvá od třiceti sekund po několik minut podle délky skladby. Model běží na serveru, takže pomalý telefon není problém.

Zpět dostanete instrumentální stopu: stejná píseň, stejné tempo, stejná tónina, stejná aranž, jen bez hlavního vokálu.

Které písně se oddělují čistě

Výsledky se velmi liší podle žánru a stylu produkce. Je to největší faktor toho, jestli budete s výsledkem spokojení.

Typ skladbyObvyklý výsledekProč
Moderní pop, hip-hop, EDMVynikajícíČistá vícestopá produkce, zřetelně oddělený vokál, spousta podobných trénovacích dat
Rock a metalDobrýVokál se odděluje dobře; silně zkreslené kytary občas model zmatou
Akustický písničkářDobrý až průměrnýHlas a akustická kytara sdílejí frekvenční rozsah, takže něco prosákne
Jazz a soul s dechyPrůměrnýSaxofon a trubka se překrývají s lidským hlasovým rozsahem
Sborová hudba, opera, hodně a cappellaŠpatnýKdyž je „nástrojem" také hlas, není co oddělovat
Živé nahrávky, bootlegyŠpatnýHluk publika a přeslechy sálu kontaminují každou stopu
Staré mono nahrávky (před rokem 1965)Průměrný až špatnýVšechno je naskládané v jednom kanálu, k tomu silná pásková komprese

Obecné pravidlo: čím oddělenější byl vokál v původní nahrávce, tím lépe ho model dostane zpátky ven. Studiový popový track nahraný v izolovaných kabinách se oddělí nádherně. Živý jazz z roku 1958 nahraný dvěma mikrofony ne.

Jak „dobrý" výsledek doopravdy zní

Ani čistá separace není totéž co oficiálně vydaný instrumentál. Počítejte s tím, že:

  • V hutných pasážích se občas objeví duchové vokálu, hlavně na držených tónech.
  • Činely budou lehce změkčené. Vysoké frekvence jsou místem, kde se vokál a činely překrývají nejvíc, takže model občas ubere víc, než by měl.
  • Doprovodné vokály mohou i nemusí přežít. Většina modelů považuje harmonie a zdvojené hlasy za „vokál" a odstraní je spolu s hlavním. Pokud refrén stojí na navrstvených harmoniích, může instrumentál působit prázdně.

Pro zpívání doma, na oslavě nebo pro cvičení na ničem z toho nezáleží. U nahrávaného výkonu, který chcete zveřejnit, si nejdřív celou stopu pozorně poslechněte.

Běžné využití

  • Domácí karaoke pro písně, které žádná karaoke služba nelicencuje — cizojazyčné skladby, nezávislá vydání, méně známé albové kusy.
  • Hlasový trénink. Zpěváci zkoušejí na skutečné aranži v původním tempu místo klavírního výtahu.
  • Konkurzy a covery. Podklad z originální nahrávky zní mnohem lépe než MIDI napodobenina.
  • Výuka hudby. Pustíte instrumentál v hodině a jediný hlas v místnosti je hlas studenta.
  • Tanec a choreografie, kde vokál ruší při počítání dob.

Řešení potíží

V instrumentálu je pořád slyšet slabý zpěv. Obvykle jde o problém s kvalitou zdroje. Stáhněte píseň znovu ve 320 kbps z nejlepšího dostupného nahrání a zkuste to znovu. Pokud jde o hutný živý mix nebo skladbu nabitou harmoniemi, možná je tohle maximum.

Instrumentál zní tence nebo „pod vodou". Klasický artefakt vstupu s nízkým datovým tokem. Zkontrolujte, v jakém datovém toku jste stahovali. Pokud to bylo 128 nebo 192, zopakujte to ve 320.

Bicí zmizely spolu s vokálem. To je podpis rušení středového kanálu, ne AI separace. Některé bezplatné weby na „odstranění zpěvu" dodnes používají starou metodu odečítání. Použijte nástroj, který dělá skutečnou separaci stop.

Nahrávání selže nebo vyprší časový limit. Velmi dlouhé soubory (DJ sety, nahrávky celých koncertů, hodinové mixy) mohou překročit limity zpracování. Nejdřív si vystřihněte píseň, o kterou vám jde.

Stáhne se .html místo zvuku. Váš konvertor vám podstrčil reklamní přesměrování místo souboru. To je varovný signál — přečtěte si našeho průvodce tím, na co se dívat u konvertoru.

Poznámka k autorským právům

Vytvoření instrumentální verze pro soukromé cvičení nebo domácí karaoke se ve většině jurisdikcí obvykle považuje za osobní užití. Zveřejnit takový instrumentál, prodávat ho nebo použít jako hudbu k monetizovanému obsahu je jiná věc — skladba i zvukový záznam zůstávají chráněné bez ohledu na to, co jste ze souboru odstranili.

Pokud váš karaoke večer zůstane v obývacím pokoji, je vše v pořádku. Pokud skončí na monetizovaném kanálu, zjistěte si podmínky licencování.

Časté dotazy

Musím něco instalovat? Ne. Oba kroky běží v prohlížeči. Stažení MP3 probíhá na OnlyMP3.tools, separace na serverech separační služby.

Funguje to na telefonu? Ano, oba kroky jsou webové. Jediná komplikace je práce se soubory v iOS — MP3 přistane v aplikaci Soubory ve složce Stažené a odtud ho nahrajete.

Zůstane karaoke podklad ve stejné tónině? Ano. Separace nemění výšku ani tempo. Pokud potřebujete jinou tóninu, je to samostatný krok transpozice až po získání instrumentálu.

Můžu místo toho dostat jen vokál? Ano — stejný proces vytvoří obě stopy. Izolovaný vokál („a cappella") je druhá polovina téhož rozdělení, hodí se na remixy nebo ke studiu toho, co přesně zpěvák dělá.

Proč můj výsledek zní hůř než oficiální instrumentál? Protože oficiální instrumentál je skutečný vícestopý mix bez vokální stopy. Separace je rekonstrukce — odhaduje, co tam bylo. Rozdíl se v posledních letech ohromně zmenšil, ale nezmizel.

Je 320 kbps opravdu nutné? Pro tento postup ano, mnohem víc než pro běžný poslech. Kvalita separace je přímo omezena tím, kolik původního zvuku přežilo kompresi.

Závěr

Dva kroky: získat čisté MP3 a pak z něj vytáhnout vokál. Datový tok zvolený v prvním kroku určuje strop pro krok druhý — to je jediná neintuitivní část celého postupu. Stahujte ve 320 kbps, i kdybyste se normálně spokojili s méně.

Začněte tím, že si píseň stáhnete na OnlyMP3.tools, a pak ji prožeňte přes SongToKaraoke, abyste získali doprovodnou stopu.