Vous pouvez supprimer les voix d'une chanson sur Aihangsoft en une exécution : téléversez la piste, appuyez sur Séparer les voix, et téléchargez deux fichiers MP3, l'un avec la voix isolée et l'autre avec l'instrumental. Aucune installation ni compte n'est nécessaire, mais un invité obtient une seule exécution gratuite par jour, plafonnée à 30 secondes d'audio.
Deux choses décident si cet outil vous convient. Premièrement, c'est un outil Cloud AI, donc votre audio est téléversé vers notre serveur et transmis à Volcengine AI MediaKit au lieu d'être traité dans le navigateur. Deuxièmement, une exécution gratuite est petite et lente : 30 secondes d'audio coûtent 5 crédits, un compte gratuit obtient 5 crédits par jour, et même un clip de 5 secondes prend environ 105 secondes car le service ajoute environ 100 secondes de surcharge fixe. Les sections ci-dessous couvrent ce que vous obtenez, ce que cela coûte, et les cas où un autre outil est la meilleure réponse.
La plupart des gens arrivent avec l'un de deux travaux : une bande son pour le karaoké, ou une voix propre pour un remix, un échantillon ou une transcription. Les deux sont possibles sans rien installer. Ce qui est facile à manquer, c'est que deux sorties sont toute l'histoire : pas de pistes supplémentaires, pas d'intensité de séparation à régler, et aucun moyen de faire tenir une chanson complète de trois minutes dans l'allocation gratuite.
Suppression des voix
Divise une piste en un a cappella et un instrumental sous forme de deux fichiers MP3 téléchargeables. Un outil Cloud AI, donc votre audio est téléversé pour traitement.
Ce que vous obtenez : deux pistes MP3
Chaque exécution réussie renvoie exactement deux fichiers, pas un court aperçu ni un lien qui disparaît avec la page.
| Sortie | Ce que contient le fichier | À quoi les gens l'utilisent |
|---|---|---|
| Voix (a cappella) | La ligne vocale, avec les instruments largement retirés | Remix, échantillonnage, vérification des paroles, transcription |
| Instrumental (bande son) | Batterie, basse, guitares, claviers et tout le reste | Karaoké, répétition, enregistrements de reprises |
Chaque fichier a son propre lecteur et bouton de téléchargement, vous pouvez donc en prendre un ou les deux. Les noms proviennent de votre téléversement, donc song.mp3 revient comme song-vocals.mp3 et song-instrumental.mp3.
Les résultats sont temporaires : 30 minutes pour un invité, 2 heures pour un compte gratuit et 24 heures avec Pro. Enregistrez les fichiers avant de fermer l'onglet, car après cette fenêtre il n'y a plus de nouveau téléchargement ultérieur et le seul moyen de revenir est une autre exécution.
C'est un outil cloud, donc votre audio est téléversé
Aihangsoft compte 28 outils qui s'exécutent entièrement dans votre navigateur : un fichier est lu dans la mémoire de la page, traité là, et renvoyé sous forme de téléchargement, sans rien transmettre. Celui-ci n'en fait pas partie. La séparation des voix nécessite un modèle trop volumineux pour s'exécuter dans un onglet de navigateur, donc votre piste est téléversée vers notre serveur, transmise à Volcengine AI MediaKit, et les deux résultats sont réécrits pour que vous les récupériez.
| Les 45 outils dans le navigateur | Cette suppression des voix | |
|---|---|---|
| Où va votre audio | Reste sur votre appareil | Téléversé vers notre serveur |
| Ce qui le traite | Votre navigateur, via Canvas et WebAssembly | Volcengine AI MediaKit, un service d'IA cloud |
| Combien de temps les résultats sont conservés | Pas stocké du tout | 30 minutes en tant qu'invité, 2 heures en gratuit, 24 heures avec Pro |
| Compte | Jamais nécessaire | Non requis, mais la connexion augmente l'allocation quotidienne et la limite de longueur |
| Fonctionne hors ligne | Oui, après le premier chargement | Non |
Considérez cela comme une fenêtre de conservation plutôt qu'une promesse sur les journaux ou les sauvegardes. Ne téléversez pas un master non publié, un mémo vocal privé ni un entretien confidentiel, ou quoi que ce soit que vous n'enverriez pas par e-mail à un inconnu. Une chanson que vous avez achetée, une démo enregistrée par votre propre groupe, ou un clip que vous avez capturé vous-même sont un compromis raisonnable.
Comment supprimer les voix d'une chanson en trois étapes
- Ajoutez votre piste. Déposez un fichier audio ou vidéo, un à la fois, jusqu'à 30 MB. La durée est d'abord lue dans le navigateur, donc un clip plus long que ce que votre formule autorise est signalé et le bouton désactivé avant tout téléversement.
- Appuyez sur Séparer les voix. Il n'y a rien à configurer, donc aucun mauvais réglage à choisir. La page téléverse le fichier, soumet la tâche, puis interroge toutes les 3 secondes en affichant le temps d'attente.
- Téléchargez les deux pistes. Lorsque l'exécution se termine, les voix et l'instrumental apparaissent avec leurs propres lecteurs et boutons de téléchargement. Enregistrez celui dont vous avez besoin avant la fermeture de la fenêtre de conservation.
Rien ici n'est destructif et votre fichier original reste intact. Ce que vous ne pouvez pas faire, c'est changer d'avis en cours de route : il n'y a aucun bouton d'annulation ni moyen de mettre en pause une tâche en cours.
Quels formats audio et vidéo vous pouvez téléverser
Le téléversement accepte à la fois l'audio et la vidéo, et la vidéo est convertie en audio à l'entrée plutôt que de vous demander d'extraire le son vous-même d'abord.
| Type d'entrée | Formats | Ce qui se passe |
|---|---|---|
| Audio | MP3, WAV, M4A, AAC, FLAC, OGG | Séparé directement |
| Vidéo | MP4, MOV, AVI, MKV, WebM, M4V, MPEG | La piste audio est extraite, puis séparée |
La seule limite de téléversement est de 30 MB par fichier, qu'un MP3 normal n'atteint pas avant environ la marque des 30 minutes, donc la longueur est presque toujours ce qui vous arrête plutôt que la taille. Les deux sorties sont en MP3 quel que soit ce qui est entré.
La limite de 30 secondes et ce que coûte une exécution
La longueur est mesurée sur le serveur avec ffprobe plutôt que confiée au navigateur, donc la durée réelle du fichier décide si une exécution est acceptée. Rien dans la page ne peut la changer.
| Formule | Clip le plus long en une exécution | Ce que coûte un clip de 30 secondes | Allocation | Résultats conservés pendant |
|---|---|---|---|---|
| Invité | 30 secondes | Votre seule exécution gratuite de la journée | 1 exécution par jour par connexion | 30 minutes |
| Compte gratuit | 30 secondes | 5 crédits | 5 crédits par jour | 2 heures |
| Pro | 600 secondes (10 minutes) | 5 crédits | 1500 crédits par mois | 24 heures |
La facturation fonctionne par tranches de 30 secondes : le coût est de 5 crédits pour chaque tranche de 30 secondes entamée, donc un clip de 30 secondes coûte 5, un clip de 31 secondes en coûte 10, et une piste de 10 minutes en coûte 100. Pour un compte gratuit, cela signifie que 5 crédits par jour achètent exactement une exécution de 30 secondes, sans possibilité d'acheter une demi-exécution ni de reporter les secondes inutilisées au lendemain.
Un détail équitable : les crédits ne sont déduits que lorsqu'un résultat est réellement produit. Un fichier refusé comme trop long, ou une tâche qui échoue sur le service, vous coûte du temps mais rien d'autre, et fermer la page en cours d'exécution ne dépense pas votre allocation.
Quand votre chanson est plus longue que la limite
Une chanson de trois minutes ne tient pas dans une exécution de 30 secondes, et aucun réglage ne change cela. La voie praticable est de réduire d'abord la chanson.
- Rognez la section dont vous avez besoin. Le rogneur audio s'exécute entièrement dans le navigateur, donc rien n'est téléversé pendant que vous réduisez la piste aux 30 secondes dont vous avez besoin.
- Séparez cette section. Téléversez le clip rogné et téléchargez les deux pistes dès que l'exécution se termine.
- Répétez pour d'autres sections si vous en avez besoin. Chaque passe est une exécution distincte coûtant encore 5 crédits par tranche de 30 secondes entamée, et assembler les morceaux dans un éditeur est votre travail, car les jointures dépendent de l'endroit où vous coupez.
Pourquoi même un court clip prend environ deux minutes
L'attente n'est pas votre connexion. Le service supporte un coût de démarrage fixe d'environ 100 secondes avant tout traitement audio, plus un peu plus pour l'audio lui-même. Dans nos propres mesures, un clip de 5 secondes se termine en environ 105 secondes et un clip de 25 secondes en environ 125 secondes, donc un clip de 30 secondes se situe à l'extrémité lente de la même bande de deux minutes plutôt que d'être nettement pire.
La page interroge la tâche toutes les 3 secondes et affiche le temps écoulé, donc une barre de progression qui bouge à peine est attendue, pas le signe que quelque chose a cassé. Rafraîchir ne l'accélère pas : un rechargement perd la référence de la tâche et le résultat ne peut plus être collecté, laissez donc l'onglet ouvert et laissez-le finir.
Comment fonctionne réellement la séparation IA
La piste est envoyée à Volcengine AI MediaKit, qui exécute un modèle entraîné de séparation de sources sur le mix. Le modèle estime deux signaux, les parties qui ressemblent à une voix humaine et tout le reste, et écrit chacun sous forme d'un MP3. Parce que c'est une prédiction plutôt qu'un filtre, il fonctionne aussi sur des pistes jamais sorties en instrumental et sur des enregistrements mono où l'annulation du canal central échoue.
La même propriété explique pourquoi le résultat n'est pas chirurgicalement propre. La séparation est une estimation, donc les mixes denses, les longues traînes de réverbération et les voix distordues sont les cas les plus difficiles, et de petites traces de l'autre côté peuvent survivre dans chaque fichier. Il n'y a aucun curseur d'intensité pour compenser, donc si la première tentative sonne brute, essayez une source plus propre plutôt que de chercher un réglage qui n'existe pas.
À quoi servent les deux pistes
| Tâche | Piste dont vous avez besoin | Pourquoi |
|---|---|---|
| Karaoké ou répétition de groupe | Instrumental | Une bande son sans chercher une sortie officielle qui n'existe peut-être pas |
| Remix, mashup ou échantillon | Voix | Un a cappella propre s'insère directement dans un éditeur comme un MP3 normal |
| Paroles ou transcription | Voix | La musique de fond est la raison la plus courante pour laquelle la transcription automatique se trompe |
L'outil ne peut toutefois pas accorder de droits : le droit d'auteur sur l'enregistrement et la composition reste à ses propriétaires, donc ce que vous pouvez publier ou monétiser dépend de votre licence et des règles de la plateforme sous laquelle vous publiez.
Ce que cet outil ne peut pas faire
- Il téléverse votre audio. C'est un outil cloud, donc le fichier quitte votre appareil et est traité par un service d'IA tiers.
- 30 secondes est un plafond strict pour les invités et les comptes gratuits, appliqué sur le serveur à partir de la durée réelle, donc un clip plus long est refusé plutôt que rogné pour vous.
- L'allocation gratuite est d'au plus une exécution par jour. Un invité obtient une seule exécution, et un compte gratuit obtient 5 crédits, soit exactement une exécution de 30 secondes.
- C'est lent. Environ 100 secondes de surcharge fixe plus un peu plus par seconde d'audio, donc quelques minutes sont normales même pour quelques secondes de son.
- Deux pistes seulement. Il n'y a pas de séparation batterie, basse, piano ou guitare. La séparation multipiste de pistes est une autre catégorie d'outil.
- Aucun paramètre réglable : aucune intensité de séparation, aucun choix des parties à conserver, et aucun moyen de corriger un mauvais résultat sinon changer la source et dépenser une autre exécution.
- Un fichier par exécution, pas de traitement par lots, donc un dossier de pistes doit être traité une à la fois.
- Aucune réparation manuelle : aucun pinceau pour effacer les débordements et aucune édition de forme d'onde, seulement les deux fichiers finis.
- Les résultats expirent. 30 minutes, 2 heures ou 24 heures selon votre formule, sans nouveau téléchargement ultérieur.