Togliere la voce da una canzone

Togli la voce da qualsiasi canzone e tieni la base strumentale — gratis, senza registrazione, senza caricare niente. Il modello di IA gira nel tuo browser, quindi il brano non lascia mai il tuo dispositivo. Una canzone di quattro minuti richiede circa un minuto.

Trascina qui una canzone

MP3, WAV, FLAC, OGG, M4A — vanno bene anche i video

Come funziona la separazione

Trascini una canzone e lo strumento la divide in due tracce: la base strumentale e la voce. Dietro c'è una rete neurale che legge lo spettrogramma e decide, per ogni frequenza in ogni istante, quanta parte di quel suono appartiene a una voce. Nulla viene tagliato per banda come farebbe un filtro karaoke: una voce nello stesso registro della chitarra viene separata da essa, ed è esattamente per questo che serve un modello e non un equalizzatore.

Il brano resta sul tuo dispositivo

Il modello viene scaricato nel browser la prima volta — 78 MB, una sola volta, poi resta sul dispositivo. Il brano non viene inviato da nessuna parte. Puoi verificarlo nella scheda Rete del browser: nessun caricamento. Tutti gli altri strumenti gratuiti mandano il file a un server, ed è per questo che devono limitarti per dimensione e per brani al giorno.

Creare una base karaoke

La base che esce è la versione karaoke del brano: accompagnamento intatto e voce principale rimossa. È il punto di partenza per cantarci sopra, per esercitarsi con uno strumento insieme alla band originale, o per mettere musica sotto un video senza che una voce si sovrapponga alla narrazione. Entrambe le tracce tornano della durata originale e sincronizzate.

Dove fatica, e perché

Separare non è sottrarre, è stimare. Un riverbero denso sulla voce per il modello è già musica e in parte resta nella base. I cori e i campioni vocali se ne vanno insieme alla voce principale, perché sono voci. E le sibilanti stanno sopra la banda analizzata dal modello, quindi qualcosa rimane. Un master denso e molto alto si separa peggio di un arrangiamento asciutto.

Se invece ti serve la voce

Le due tracce nascono dallo stesso passaggio, quindi l'a cappella è lì accanto alla base e puoi scaricare entrambe. Se è il canto che cerchi, la pagina di separazione della voce è lo stesso strumento con l'a cappella al primo posto.

Apri il separatore di voce

Dividere in quattro tracce

Due tracce bastano per il karaoke e per gran parte del lavoro di remix. Quando serve la batteria da sola, o una linea di basso senza il resto della band, lo Stem Splitter usa un modello a quattro uscite: voce, batteria, basso e tutto il resto. Scarica di più e impiega di più — 157 MB e circa tre minuti e mezzo per una canzone di quattro minuti.

Apri lo Stem Splitter
Gira nel browser
Nessun caricamento, nessuna coda, nessun server — circa un minuto per quattro minuti di musica.
Non viene caricato nulla
Il brano non lascia il tuo dispositivo. Verificabile nella scheda Rete: nessuna richiesta in uscita.
Gratis, senza account
Nessuna registrazione, nessun watermark, nessun limite giornaliero. Base e voce, per intero.

Domande frequenti

Sì. Nessun account, nessun watermark, nessun limite per brano. Lo strumento gira sul tuo dispositivo, quindi non c'è un costo server per canzone da ribaltare — ed è esattamente per questo che i servizi che elaborano lato server devono limitarti e questo no.

No. Il modello di IA viene scaricato nel browser e la separazione avviene lì. Puoi confermarlo: apri la scheda Rete, elabora un brano e vedrai il download del modello la prima volta e nulla in uscita dopo.

Circa un minuto per una canzone di quattro minuti su un portatile normale, più 78 MB di modello scaricati una sola volta alla prima visita. Poi resta in cache e rimane solo il tempo di calcolo. Usa un thread del processore e non serve una scheda grafica.

Abbastanza per karaoke, studio e gran parte dei remix; non abbastanza da passare per una base ufficiale. Aspettati una traccia di voce nei passaggi pieni, un po' di sibilanti nella base e code di riverbero che restano.

Dieci minuti per file. È meno dell'ora concessa dagli altri strumenti, e il motivo è la memoria, non una regola: la separazione deve tenere l'intera canzone non compressa nella scheda, più una copia per traccia — circa 125 MB al minuto.

Spleeter, il modello di separazione pubblicato da Deezer con licenza MIT, convertito in ONNX ed eseguito con onnxruntime nel browser. La licenza conta: i modelli di ricerca più forti sono pubblicati solo per uso scientifico o con condizioni non commerciali.