Quitar la voz de una canción
Pide a fal-ai/sam-audio/separate que separe la voz u otro sonido distinguible del resto de la mezcla. Las mezclas densas pueden dejar filtraciones o artefactos; revisa ambas pistas.
Cómo funciona
Carga una canción
Sube una pista compatible. WAV o FLAC evitan añadir otra compresión con pérdida; la separación sigue dependiendo de la mezcla.
Elige qué aislar
Selecciona "voz" o describe un sonido distinguible, como batería, bajo, guitarra o habla. El modelo intentará separarlo del resto.
Descarga ambas pistas
Escucha cada pista en la página y descarga las que quieras. El acceso desde el espacio de trabajo a los objetos cifrados del servidor caduca según tu plan. Los objetos caducados se ponen en cola para su limpieza automática y se reintenta la eliminación si falla.
Detalles
¿Obtengo tanto la voz como el instrumental?
Un trabajo correcto devuelve el sonido solicitado como una pista y el resto como otra. Puede haber filtración o artefactos, especialmente en mezclas densas o muy procesadas.
¿Puedo aislar sonidos distintos de la voz?
Puedes pedir sonidos como batería, bajo, guitarra, habla o canto de pájaros. El modelo intenta la separación, pero el resultado depende de que el sonido se distinga en la mezcla.
¿Qué calidad puedo esperar?
La calidad varía con la mezcla, la compresión de origen y la descripción. Los arreglos densos, los efectos y las frecuencias solapadas pueden causar filtración o artefactos.
¿Cuánto cuesta?
La separación de pistas cuesta 3 créditos por minuto de audio. La cuenta gratuita incluye 6 créditos de audio con IA al mes para probarla sin tarjeta, y los planes Pro incluyen 300 créditos mensuales.
Rutas relacionadas
Quitar el ruido de fondo
Usa fal-ai/elevenlabs/audio-isolation para destacar la voz y atenuar otros sonidos en un trabajo de servidor. El resultado puede contener ruido o artefactos.
Editor de audio online
La edición y la exportación básicas se ejecutan en el navegador. Las funciones opcionales de IA y transcripción solo suben el audio renderizado cuando eliges una acción de servidor.
Amplificar los graves
Da más graves a cualquier pista con un realce de +6 dB a 100 Hz. La exportación usa loudnorm de FFmpeg con un objetivo de sonoridad integrada de −14 LUFS y un techo de pico real de −1,5 dBTP. Ese techo reduce el riesgo de saturación; la codificación con pérdida y la reproducción posterior aún pueden alterar los picos.