Transcrever áudio em texto
Crie um rascunho com fal-ai/whisper, marcações por palavra, exportação em TXT, SRT e VTT e detecção automática do idioma. A precisão varia com nomes, sotaques, ruído e falas sobrepostas.
Como funciona
Adicione seu áudio
Envie um MP3, uma nota de voz, uma entrevista ou qualquer gravação. O idioma falado é detectado sozinho, você não precisa escolher.
Transcreva com o Whisper
fal-ai/whisper gera um rascunho com marcações por palavra, ao custo de 1 crédito por minuto de áudio.
Exporte TXT, SRT ou VTT
Baixe texto puro para leitura ou legendas com tempo para vídeo. O acesso do workspace aos objetos criptografados do servidor expira conforme o plano. Objetos expirados entram na fila de limpeza automática, e a exclusão é repetida se falhar.
Detalhes
Qual é a precisão da transcrição?
fal-ai/whisper detecta o idioma e gera marcações por palavra. A precisão varia conforme idioma, nomes, sotaques, ruído e falas sobrepostas. Trate o resultado como rascunho e revise antes de citar ou publicar.
Quais formatos posso exportar?
Texto puro (TXT) para uma leitura limpa, ou legendas com tempo em SRT e VTT para vídeo. As marcações de tempo por palavra também são capturadas, então as legendas encaixam com precisão, sem defasagem nas linhas longas.
Meu áudio fica privado?
A transcrição envia o áudio por TLS para um job em segundo plano no servidor, e a FileMorf não usa seu áudio para treinar modelos. A FileMorf solicita à fal.ai que sua cópia privada da mídia gerada expire depois de uma hora e desativa o armazenamento da carga da solicitação; o acesso à entrada criptografada da tarefa e à cópia do resultado da FileMorf segue o prazo do workspace (7 dias em contas gratuitas e, no máximo, 30 dias em planos pagos), seguido de limpeza automática com novas tentativas.
Quanto custa?
A transcrição custa 1 crédito por minuto de áudio. A conta grátis inclui 6 créditos de áudio com IA por mês — suficiente para uma gravação curta, sem cartão — e os planos Pro adicionam uma cota mensal maior.
Rotas relacionadas
Colocar legenda em vídeo
Crie um rascunho de legendas com fal-ai/whisper, revise no vídeo e baixe SRT/VTT ou escolha a gravação opcional no servidor.
Editor de áudio online
A edição e a exportação principais rodam no navegador. Recursos opcionais de IA e transcrição só enviam o áudio renderizado quando você escolhe uma ação no servidor.
Remover o ruído de fundo
Use fal-ai/elevenlabs/audio-isolation para destacar a voz e atenuar outros sons em um job no servidor. O resultado pode manter ruído ou artefatos.