Puedes eliminar la voz de una canción en Aihangsoft en una sola ejecución: sube la pista, pulsa Separar la voz y descarga dos archivos MP3, uno con la voz aislada y otro con el instrumental. No se necesitan instalación ni cuenta, pero un invitado obtiene una sola ejecución gratuita al día, limitada a 30 segundos de audio.
Dos cosas deciden si esta herramienta te conviene. Primero, es una herramienta Cloud AI, así que tu audio se sube a nuestro servidor y se reenvía a Volcengine AI MediaKit en lugar de procesarse en el navegador. Segundo, una ejecución gratuita es pequeña y lenta: 30 segundos de audio cuestan 5 créditos, una cuenta gratuita obtiene 5 créditos al día, y hasta un clip de 5 segundos tarda unos 105 segundos porque el servicio añade unos 100 segundos de sobrecarga fija. Las secciones siguientes cubren qué obtienes, cuánto cuesta y los casos en que otra herramienta es la mejor respuesta.
La mayoría de la gente llega con uno de dos trabajos: una pista de acompañamiento para karaoke, o una voz limpia para un remix, una muestra o una transcripción. Ambos son posibles sin instalar nada. Lo que es fácil pasar por alto es que dos salidas es toda la historia: ni pistas extra, ni una intensidad de separación que ajustar, ni forma de encajar una canción completa de tres minutos en la asignación gratuita.
Eliminador de voz
Divide una pista en un acapela y un instrumental como dos archivos MP3 descargables. Una herramienta Cloud AI, así que tu audio se sube para procesarlo.
Qué obtienes: dos pistas MP3
Cada ejecución correcta devuelve exactamente dos archivos, no una vista previa corta ni un enlace que desaparece con la página.
| Salida | Qué hay en el archivo | Para qué lo usa la gente |
|---|---|---|
| Voz (acapela) | La línea vocal, con los instrumentos en gran parte eliminados | Remixes, muestreo, comprobación de letras, transcripción |
| Instrumental (pista de acompañamiento) | Batería, bajo, guitarras, teclados y todo lo demás | Karaoke, ensayo, grabaciones de versiones |
Cada archivo tiene su propio reproductor y botón de descarga, así que puedes llevarte uno o ambos. Los nombres provienen de tu subida, así que song.mp3 vuelve como song-vocals.mp3 y song-instrumental.mp3.
Los resultados son temporales: 30 minutos para un invitado, 2 horas para una cuenta gratuita y 24 horas en Pro. Guarda los archivos antes de cerrar la pestaña, porque después de esa ventana no hay nueva descarga posterior y la única forma de volver es otra ejecución.
Esta es una herramienta en la nube, así que tu audio se sube
Aihangsoft tiene 28 herramientas que funcionan por completo en tu navegador: un archivo se lee en la memoria de la página, se procesa ahí y se te devuelve como descarga, sin transmitir nada. Esta no es una de ellas. La separación de voz necesita un modelo demasiado grande para ejecutarse en una pestaña del navegador, así que tu pista se sube a nuestro servidor, se reenvía a Volcengine AI MediaKit y los dos resultados se escriben de vuelta para que los recojas.
| Las 45 herramientas del navegador | Este eliminador de voz | |
|---|---|---|
| Adónde va tu audio | Se queda en tu dispositivo | Subido a nuestro servidor |
| Qué lo procesa | Tu navegador, usando Canvas y WebAssembly | Volcengine AI MediaKit, un servicio de IA en la nube |
| Cuánto tiempo se conservan los resultados | No se almacena en absoluto | 30 minutos como invitado, 2 horas gratis, 24 horas en Pro |
| Cuenta | Nunca es necesario | No es obligatorio, pero iniciar sesión sube la asignación diaria y el límite de duración |
| Funciona sin conexión | Sí, después de la primera carga | No |
Trata eso como una ventana de retención y no como una promesa sobre registros o copias de seguridad. No subas un máster sin publicar, una nota de voz privada ni una entrevista confidencial, ni nada que no enviarías por correo a un desconocido. Una canción que compraste, una maqueta que grabó tu propia banda o un clip que capturaste tú mismo son un intercambio razonable.
Cómo eliminar la voz de una canción en tres pasos
- Añade tu pista. Suelta un archivo de audio o vídeo, de uno en uno, de hasta 30 MB. La duración se lee primero en el navegador, así que un clip más largo de lo que permite tu plan se marca y el botón se desactiva antes de subir nada.
- Pulsa Separar la voz. No hay nada que configurar, así que no hay ningún ajuste equivocado que elegir. La página sube el archivo, envía la tarea y luego consulta cada 3 segundos mientras imprime cuánto has esperado.
- Descarga ambas pistas. Cuando la ejecución se completa, la voz y el instrumental aparecen con sus propios reproductores y botones de descarga. Guarda el que necesites antes de que se cierre la ventana de retención.
Nada de esto es destructivo y tu archivo original queda intacto. Lo que no puedes hacer es cambiar de opinión a mitad: no hay botón de cancelar ni forma de pausar una tarea en curso.
Qué formatos de audio y vídeo puedes subir
La subida acepta tanto audio como vídeo, y el vídeo se convierte a audio de entrada en lugar de pedirte que extraigas el sonido tú mismo primero.
| Tipo de entrada | Formatos | Qué ocurre |
|---|---|---|
| Audio | MP3, WAV, M4A, AAC, FLAC, OGG | Separado directamente |
| Vídeo | MP4, MOV, AVI, MKV, WebM, M4V, MPEG | Se extrae la pista de audio y luego se separa |
El único límite de subida es de 30 MB por archivo, que un MP3 normal no alcanza hasta aproximadamente el minuto 30, así que casi siempre lo que te detiene es la duración, no el tamaño. Ambas salidas son MP3 independientemente de lo que entrara.
El límite de 30 segundos y lo que cuesta una ejecución
La duración se mide en el servidor con ffprobe en lugar de confiar en el navegador, así que la duración real del archivo decide si se acepta una ejecución. Nada en la página puede cambiarlo.
| Plan | Clip más largo en una ejecución | Lo que cuesta un clip de 30 segundos | Asignación | Resultados conservados durante |
|---|---|---|---|---|
| Invitado | 30 segundos | Tu única ejecución gratuita del día | 1 ejecución al día por conexión | 30 minutos |
| Cuenta gratuita | 30 segundos | 5 créditos | 5 créditos por día | 2 horas |
| Pro | 600 segundos (10 minutos) | 5 créditos | 1500 créditos al mes | 24 horas |
La facturación funciona en pasos de 30 segundos: el coste es de 5 créditos por cada 30 segundos iniciados, así que un clip de 30 segundos cuesta 5, un clip de 31 segundos cuesta 10 y una pista de 10 minutos cuesta 100. Para una cuenta gratuita eso significa que 5 créditos al día compran exactamente una ejecución de 30 segundos, sin forma de comprar media ejecución ni de pasar los segundos no usados al día siguiente.
Un detalle justo: los créditos solo se descuentan cuando se produce realmente un resultado. Un archivo rechazado por demasiado largo, o una tarea que falla en el servicio, te cuesta tiempo pero nada más, y cerrar la página a mitad de la ejecución no gasta tu asignación.
Cuando tu canción es más larga que el límite
Una canción de tres minutos no cabe en una ejecución de 30 segundos, y no hay ningún ajuste que cambie eso. La vía viable es cortar la canción primero.
- Recorta la sección que necesitas. El recortador de audio funciona por completo en el navegador, así que no se sube nada mientras reduces la pista a los 30 segundos que necesitas.
- Separa esa sección. Sube el clip recortado y descarga ambas pistas en cuanto termine la ejecución.
- Repite para otras secciones si las necesitas. Cada pasada es una ejecución aparte que cuesta otros 5 créditos por cada 30 segundos iniciados, y unir las piezas en un editor es cosa tuya, porque las uniones dependen de dónde cortes.
Por qué incluso un clip corto tarda unos dos minutos
La espera no es tu conexión. El servicio tiene un coste de arranque fijo de unos 100 segundos antes de procesar ningún audio, más un poco más por el propio audio. En nuestras propias mediciones, un clip de 5 segundos se completa en unos 105 segundos y uno de 25 segundos en unos 125 segundos, así que un clip de 30 segundos se sitúa en el extremo lento de la misma banda de dos minutos en lugar de ser dramáticamente peor.
La página consulta la tarea cada 3 segundos y muestra el tiempo transcurrido, así que una barra de progreso que apenas se mueve es lo esperado, no una señal de que algo se rompió. Refrescar no lo acelera: una recarga pierde la referencia de la tarea y el resultado ya no se puede recoger, así que deja la pestaña abierta y déjala terminar.
Cómo funciona realmente la separación con IA
La pista se envía a Volcengine AI MediaKit, que ejecuta un modelo entrenado de separación de fuentes sobre la mezcla. El modelo estima dos señales, las partes que suenan como una voz humana y todo lo demás, y escribe cada una como MP3. Como es una predicción y no un filtro, también funciona con pistas que nunca se publicaron como instrumentales y con grabaciones mono en las que falla la cancelación del canal central.
Esa misma propiedad explica por qué el resultado no es quirúrgicamente limpio. La separación es una estimación, así que las mezclas densas, las reverberaciones largas y las voces distorsionadas son los casos más difíciles, y pequeños rastros del otro lado pueden sobrevivir en cada archivo. No hay control deslizante de intensidad que lo compense, así que si el primer intento suena tosco, prueba con una fuente más limpia en lugar de buscar un ajuste que no existe.
Para qué se usan las dos pistas
| Tarea | Pista que necesitas | Por qué |
|---|---|---|
| Karaoke o ensayo de banda | Instrumental | Una pista de acompañamiento sin buscar una publicación oficial que puede que no exista |
| Remix, mashup o muestra | Voz | Un acapela limpio entra directamente en un editor como un MP3 normal |
| Letras o transcripción | Voz | La música de fondo es la razón más común de que la transcripción automática salga mal |
La herramienta no puede conceder derechos, sin embargo: los derechos de autor de la grabación y de la composición siguen siendo de sus propietarios, así que lo que puedes publicar o monetizar depende de tu licencia y de las reglas de la plataforma en la que publiques.
Lo que esta herramienta no puede hacer
- Sube tu audio. Esta es una herramienta en la nube, así que el archivo sale de tu dispositivo y lo procesa un servicio de IA de terceros.
- 30 segundos es un techo estricto para invitados y cuentas gratuitas, aplicado en el servidor a partir de la duración real, así que un clip más largo se rechaza en lugar de recortarse por ti.
- La asignación gratuita es de una ejecución al día como máximo. Un invitado obtiene una sola ejecución, y una cuenta gratuita obtiene 5 créditos, que es exactamente una ejecución de 30 segundos.
- Es lento. Unos 100 segundos de sobrecarga fija más un poco más por cada segundo de audio, así que un par de minutos es normal incluso para unos pocos segundos de sonido.
- Solo dos pistas. No hay división de batería, bajo, piano o guitarra. La separación multipista de pistas es una clase distinta de herramienta.
- Sin parámetros ajustables: sin intensidad de separación, sin elección de partes que conservar, y sin forma de arreglar un mal resultado salvo cambiar la fuente y gastar otra ejecución.
- Un archivo por ejecución, sin lotes, así que una carpeta de pistas tiene que procesarse de una en una.
- Sin reparación manual: sin pincel para eliminar el sangrado y sin edición de forma de onda, solo los dos archivos terminados.
- Los resultados caducan. 30 minutos, 2 horas o 24 horas según tu plan, sin nueva descarga posterior.