Cómo eliminar la voz de una canción (gratis, dos pistas MP3)

Puedes eliminar la voz de una canción en Aihangsoft en una sola ejecución: sube la pista, pulsa Separar la voz y descarga dos archivos MP3, uno con la voz aislada y otro con el instrumental. No se necesitan instalación ni cuenta, pero un invitado obtiene una sola ejecución gratuita al día, limitada a 30 segundos de audio.

Dos cosas deciden si esta herramienta te conviene. Primero, es una herramienta Cloud AI, así que tu audio se sube a nuestro servidor y se reenvía a Volcengine AI MediaKit en lugar de procesarse en el navegador. Segundo, una ejecución gratuita es pequeña y lenta: 30 segundos de audio cuestan 5 créditos, una cuenta gratuita obtiene 5 créditos al día, y hasta un clip de 5 segundos tarda unos 105 segundos porque el servicio añade unos 100 segundos de sobrecarga fija. Las secciones siguientes cubren qué obtienes, cuánto cuesta y los casos en que otra herramienta es la mejor respuesta.

La mayoría de la gente llega con uno de dos trabajos: una pista de acompañamiento para karaoke, o una voz limpia para un remix, una muestra o una transcripción. Ambos son posibles sin instalar nada. Lo que es fácil pasar por alto es que dos salidas es toda la historia: ni pistas extra, ni una intensidad de separación que ajustar, ni forma de encajar una canción completa de tres minutos en la asignación gratuita.

Eliminador de voz

Divide una pista en un acapela y un instrumental como dos archivos MP3 descargables. Una herramienta Cloud AI, así que tu audio se sube para procesarlo.

Abrir el eliminador de voz

Qué obtienes: dos pistas MP3

Cada ejecución correcta devuelve exactamente dos archivos, no una vista previa corta ni un enlace que desaparece con la página.

SalidaQué hay en el archivoPara qué lo usa la gente
Voz (acapela)La línea vocal, con los instrumentos en gran parte eliminadosRemixes, muestreo, comprobación de letras, transcripción
Instrumental (pista de acompañamiento)Batería, bajo, guitarras, teclados y todo lo demásKaraoke, ensayo, grabaciones de versiones

Cada archivo tiene su propio reproductor y botón de descarga, así que puedes llevarte uno o ambos. Los nombres provienen de tu subida, así que song.mp3 vuelve como song-vocals.mp3 y song-instrumental.mp3.

Los resultados son temporales: 30 minutos para un invitado, 2 horas para una cuenta gratuita y 24 horas en Pro. Guarda los archivos antes de cerrar la pestaña, porque después de esa ventana no hay nueva descarga posterior y la única forma de volver es otra ejecución.

Esta es una herramienta en la nube, así que tu audio se sube

Aihangsoft tiene 28 herramientas que funcionan por completo en tu navegador: un archivo se lee en la memoria de la página, se procesa ahí y se te devuelve como descarga, sin transmitir nada. Esta no es una de ellas. La separación de voz necesita un modelo demasiado grande para ejecutarse en una pestaña del navegador, así que tu pista se sube a nuestro servidor, se reenvía a Volcengine AI MediaKit y los dos resultados se escriben de vuelta para que los recojas.

Las 45 herramientas del navegadorEste eliminador de voz
Adónde va tu audioSe queda en tu dispositivoSubido a nuestro servidor
Qué lo procesaTu navegador, usando Canvas y WebAssemblyVolcengine AI MediaKit, un servicio de IA en la nube
Cuánto tiempo se conservan los resultadosNo se almacena en absoluto30 minutos como invitado, 2 horas gratis, 24 horas en Pro
CuentaNunca es necesarioNo es obligatorio, pero iniciar sesión sube la asignación diaria y el límite de duración
Funciona sin conexiónSí, después de la primera cargaNo

Trata eso como una ventana de retención y no como una promesa sobre registros o copias de seguridad. No subas un máster sin publicar, una nota de voz privada ni una entrevista confidencial, ni nada que no enviarías por correo a un desconocido. Una canción que compraste, una maqueta que grabó tu propia banda o un clip que capturaste tú mismo son un intercambio razonable.

Cómo eliminar la voz de una canción en tres pasos

  1. Añade tu pista. Suelta un archivo de audio o vídeo, de uno en uno, de hasta 30 MB. La duración se lee primero en el navegador, así que un clip más largo de lo que permite tu plan se marca y el botón se desactiva antes de subir nada.
  2. Pulsa Separar la voz. No hay nada que configurar, así que no hay ningún ajuste equivocado que elegir. La página sube el archivo, envía la tarea y luego consulta cada 3 segundos mientras imprime cuánto has esperado.
  3. Descarga ambas pistas. Cuando la ejecución se completa, la voz y el instrumental aparecen con sus propios reproductores y botones de descarga. Guarda el que necesites antes de que se cierre la ventana de retención.

Nada de esto es destructivo y tu archivo original queda intacto. Lo que no puedes hacer es cambiar de opinión a mitad: no hay botón de cancelar ni forma de pausar una tarea en curso.

Qué formatos de audio y vídeo puedes subir

La subida acepta tanto audio como vídeo, y el vídeo se convierte a audio de entrada en lugar de pedirte que extraigas el sonido tú mismo primero.

Tipo de entradaFormatosQué ocurre
AudioMP3, WAV, M4A, AAC, FLAC, OGGSeparado directamente
VídeoMP4, MOV, AVI, MKV, WebM, M4V, MPEGSe extrae la pista de audio y luego se separa

El único límite de subida es de 30 MB por archivo, que un MP3 normal no alcanza hasta aproximadamente el minuto 30, así que casi siempre lo que te detiene es la duración, no el tamaño. Ambas salidas son MP3 independientemente de lo que entrara.

El límite de 30 segundos y lo que cuesta una ejecución

La duración se mide en el servidor con ffprobe en lugar de confiar en el navegador, así que la duración real del archivo decide si se acepta una ejecución. Nada en la página puede cambiarlo.

PlanClip más largo en una ejecuciónLo que cuesta un clip de 30 segundosAsignaciónResultados conservados durante
Invitado30 segundosTu única ejecución gratuita del día1 ejecución al día por conexión30 minutos
Cuenta gratuita30 segundos5 créditos5 créditos por día2 horas
Pro600 segundos (10 minutos)5 créditos1500 créditos al mes24 horas

La facturación funciona en pasos de 30 segundos: el coste es de 5 créditos por cada 30 segundos iniciados, así que un clip de 30 segundos cuesta 5, un clip de 31 segundos cuesta 10 y una pista de 10 minutos cuesta 100. Para una cuenta gratuita eso significa que 5 créditos al día compran exactamente una ejecución de 30 segundos, sin forma de comprar media ejecución ni de pasar los segundos no usados al día siguiente.

Un detalle justo: los créditos solo se descuentan cuando se produce realmente un resultado. Un archivo rechazado por demasiado largo, o una tarea que falla en el servicio, te cuesta tiempo pero nada más, y cerrar la página a mitad de la ejecución no gasta tu asignación.

Cuando tu canción es más larga que el límite

Una canción de tres minutos no cabe en una ejecución de 30 segundos, y no hay ningún ajuste que cambie eso. La vía viable es cortar la canción primero.

  1. Recorta la sección que necesitas. El recortador de audio funciona por completo en el navegador, así que no se sube nada mientras reduces la pista a los 30 segundos que necesitas.
  2. Separa esa sección. Sube el clip recortado y descarga ambas pistas en cuanto termine la ejecución.
  3. Repite para otras secciones si las necesitas. Cada pasada es una ejecución aparte que cuesta otros 5 créditos por cada 30 segundos iniciados, y unir las piezas en un editor es cosa tuya, porque las uniones dependen de dónde cortes.

Por qué incluso un clip corto tarda unos dos minutos

La espera no es tu conexión. El servicio tiene un coste de arranque fijo de unos 100 segundos antes de procesar ningún audio, más un poco más por el propio audio. En nuestras propias mediciones, un clip de 5 segundos se completa en unos 105 segundos y uno de 25 segundos en unos 125 segundos, así que un clip de 30 segundos se sitúa en el extremo lento de la misma banda de dos minutos en lugar de ser dramáticamente peor.

La página consulta la tarea cada 3 segundos y muestra el tiempo transcurrido, así que una barra de progreso que apenas se mueve es lo esperado, no una señal de que algo se rompió. Refrescar no lo acelera: una recarga pierde la referencia de la tarea y el resultado ya no se puede recoger, así que deja la pestaña abierta y déjala terminar.

Cómo funciona realmente la separación con IA

La pista se envía a Volcengine AI MediaKit, que ejecuta un modelo entrenado de separación de fuentes sobre la mezcla. El modelo estima dos señales, las partes que suenan como una voz humana y todo lo demás, y escribe cada una como MP3. Como es una predicción y no un filtro, también funciona con pistas que nunca se publicaron como instrumentales y con grabaciones mono en las que falla la cancelación del canal central.

Esa misma propiedad explica por qué el resultado no es quirúrgicamente limpio. La separación es una estimación, así que las mezclas densas, las reverberaciones largas y las voces distorsionadas son los casos más difíciles, y pequeños rastros del otro lado pueden sobrevivir en cada archivo. No hay control deslizante de intensidad que lo compense, así que si el primer intento suena tosco, prueba con una fuente más limpia en lugar de buscar un ajuste que no existe.

Para qué se usan las dos pistas

TareaPista que necesitasPor qué
Karaoke o ensayo de bandaInstrumentalUna pista de acompañamiento sin buscar una publicación oficial que puede que no exista
Remix, mashup o muestraVozUn acapela limpio entra directamente en un editor como un MP3 normal
Letras o transcripciónVozLa música de fondo es la razón más común de que la transcripción automática salga mal

La herramienta no puede conceder derechos, sin embargo: los derechos de autor de la grabación y de la composición siguen siendo de sus propietarios, así que lo que puedes publicar o monetizar depende de tu licencia y de las reglas de la plataforma en la que publiques.

Lo que esta herramienta no puede hacer

  • Sube tu audio. Esta es una herramienta en la nube, así que el archivo sale de tu dispositivo y lo procesa un servicio de IA de terceros.
  • 30 segundos es un techo estricto para invitados y cuentas gratuitas, aplicado en el servidor a partir de la duración real, así que un clip más largo se rechaza en lugar de recortarse por ti.
  • La asignación gratuita es de una ejecución al día como máximo. Un invitado obtiene una sola ejecución, y una cuenta gratuita obtiene 5 créditos, que es exactamente una ejecución de 30 segundos.
  • Es lento. Unos 100 segundos de sobrecarga fija más un poco más por cada segundo de audio, así que un par de minutos es normal incluso para unos pocos segundos de sonido.
  • Solo dos pistas. No hay división de batería, bajo, piano o guitarra. La separación multipista de pistas es una clase distinta de herramienta.
  • Sin parámetros ajustables: sin intensidad de separación, sin elección de partes que conservar, y sin forma de arreglar un mal resultado salvo cambiar la fuente y gastar otra ejecución.
  • Un archivo por ejecución, sin lotes, así que una carpeta de pistas tiene que procesarse de una en una.
  • Sin reparación manual: sin pincel para eliminar el sangrado y sin edición de forma de onda, solo los dos archivos terminados.
  • Los resultados caducan. 30 minutos, 2 horas o 24 horas según tu plan, sin nueva descarga posterior.

Preguntas frecuentes

Sube la pista al Eliminador de voz, pulsa Separar la voz y espera a que termine la ejecución. La herramienta devuelve dos archivos MP3, uno con la voz aislada y otro con el instrumental, y cada uno tiene su propio reproductor y botón de descarga en el panel de resultados. No hay nada que configurar, lo que también significa que no hay ningún ajuste que puedas equivocar. Como invitado obtienes una ejecución gratuita al día de hasta 30 segundos de audio, y una cuenta gratuita obtiene 5 créditos al día, que es exactamente una ejecución de 30 segundos. Cualquier cosa más larga tiene que recortarse primero, porque el servidor mide la duración real del archivo y rechaza un clip más largo antes de empezar el procesamiento. Iniciar sesión sube tanto la asignación diaria como el límite de duración, hasta 10 minutos en Pro.
Sí. Esta es una herramienta Cloud AI, así que tu audio se sube a nuestro servidor, se reenvía a Volcengine AI MediaKit para la separación y los dos resultados se guardan en nuestro servidor para que puedas descargarlos. Eso es lo contrario de las 45 herramientas del navegador de Aihangsoft, que nunca transmiten un archivo. Los resultados se eliminan automáticamente tras una ventana fijada: 30 minutos para un invitado, 2 horas para una cuenta gratuita y 24 horas para Pro. Trata eso como una ventana de retención y no como una promesa sobre registros o copias de seguridad, y usa la herramienta como cualquier conversor online. No subas un máster sin publicar, una nota de voz privada, una entrevista confidencial ni nada que no enviarías por correo a un desconocido. Una pista que posees o un clip que hiciste tú mismo son un intercambio razonable.
Un invitado y una cuenta gratuita pueden procesar hasta 30 segundos en una ejecución, y Pro puede procesar hasta 10 minutos. Una ejecución cuesta 5 créditos por cada 30 segundos iniciados, así que un clip de 30 segundos cuesta 5 créditos, un clip de 31 segundos cuesta 10 y una pista de 10 minutos cuesta 100. Un invitado obtiene una ejecución gratuita al día, y una cuenta gratuita obtiene 5 créditos al día, que es exactamente una ejecución de 30 segundos diaria. Los créditos solo se descuentan cuando se produce realmente un resultado, así que un archivo rechazado o una tarea fallida no cuesta nada. El límite no es una sugerencia: el servidor lee la duración real con ffprobe y rechaza un clip más largo antes de procesarlo, así que recorta la pista primero en lugar de esperar que quepa. Pro sube ese techo a 10 minutos, lo que basta para separar una canción completa en una sola pasada.
No. La salida son dos pistas, voz e instrumental, y ninguna más. El archivo instrumental contiene batería, bajo, guitarras, teclados y todo lo demás mezclado, porque eso es lo que predice el modelo: las partes que suenan como una voz humana y el resto. No hay opción de solo batería, solo bajo o solo piano, ni modo de cuatro o seis pistas, ni forma de pedirlo en los ajustes. Si tu trabajo necesita pistas individuales de instrumentos, esta es la clase equivocada de herramienta y necesitas software dedicado de separación de pistas o una fuente multipista. Para karaoke, un remix, una muestra o una transcripción más limpia, las dos pistas que produce esta herramienta son normalmente justo lo que el trabajo necesita. Si necesitas pistas de instrumentos, busca un servicio de separación dedicado que ofrezca un modelo de cuatro o seis pistas, y espera un proceso más lento y pesado.
Puedes subir audio MP3, WAV, M4A, AAC, FLAC y OGG, o un archivo de vídeo en MP4, MOV, AVI, MKV, WebM, M4V o MPEG. La entrada de vídeo se acepta porque la pista de audio se extrae antes de la separación, así que un videoclip musical o un clip en directo funciona sin que tengas que extraer el sonido primero. Un archivo por ejecución, de hasta 30 MB, y ambas salidas son MP3 independientemente de lo que entrara. El techo de 30 MB rara vez es el problema, ya que un MP3 normal solo lo alcanza alrededor del minuto 30; el límite de duración aprieta primero. Si tu origen está en otro contenedor, conviértelo a MP3 o WAV con el convertidor de audio, o extrae el audio de un vídeo con vídeo a MP3 y luego sube el resultado. Ambos convertidores funcionan por completo en tu navegador, así que no se sube nada hasta que llegas al eliminador de voz.

Divide tu canción en voz e instrumental

Dos archivos MP3 de una ejecución. No se necesita cuenta para probar un clip corto.

Abrir el Eliminador de voz