Por ShinobiTools Team · Última atualização: 1º de outubro de 2026
Envie um áudio ou um vídeo abaixo e Apenas voz mantém a voz humana e atenua o som ao redor. Testamos em latidos de cachorros e cantos de pássaros. Funciona também no áudio de um vídeo, permitindo que você isole a voz de um vídeo sem precisar de um editor. Sem necessidade de cadastro, sem marca d'água, 10 arquivos por dia. Uma coisa que não faz de forma confiável: identificar uma pessoa específica em meio a várias pessoas falando ao mesmo tempo.
Apenas voz mantém a voz humana e reduz o som de latidos e cantos de pássaros. Duas pessoas falando ao mesmo tempo? Nenhum ajuste aqui separa as duas vozes de forma confiável: o modo de voz pode perder ou trocar a voz, então tente Limpeza padrão e ouça o resultado.
Vídeo (MP4, MOV, MKV, WEBM) ou áudio (MP3, WAV, M4A, FLAC, OGG), com até 45 minutos e 1 GB. O vídeo é retornado com o mesmo formato, mas com o áudio limpo; a imagem é copiada, não reprocessada. Você também recebe o arquivo MP3 com o áudio limpo e um arquivo WAV sem perdas.
Sem marca d'água, sem necessidade de cadastro, 10 arquivos por dia. Arquivos de até 45 minutos são gratuitos. Um plano pago permite arquivos mais longos e um número maior de arquivos por dia.
A cada 10 dB, o som parece aproximadamente metade do volume anterior. Esses números são provenientes de um pequeno conjunto de gravações de teste, nas quais sabíamos exatamente como era a voz original; eles não são alcançados em todas as gravações.
Faça o upload do arquivo MP4, MOV, MKV ou WEBM como está. Você receberá o mesmo vídeo de volta, com a voz preservada e o áudio de fundo removido, e a imagem será copiada sem alterações. Os arquivos MP3 e WAV limpos estarão disponíveis para download, caso você queira usar a voz em um editor.
Se "vozes de fundo" significa uma segunda pessoa falando claramente perto do microfone, esse é o único caso em que o Voice falha. Uma segunda voz também é fala. Em nossos testes com duas pessoas falando ao mesmo tempo, a segunda voz foi atenuada em apenas cerca de 7 dB em média, e em duas de quatro gravações de teste, a voz foi perdida ou trocada. Esperamos o mesmo com uma TV ou rádio com pessoas falando. Portanto, não prometemos remover vozes de fundo de um vídeo.
Nenhuma configuração aqui separa de forma confiável duas vozes. Para uma gravação com duas pessoas falando ao mesmo tempo, tente: Limpeza padrão e ouça o resultado. Precisa saber quem disse o quê? O ScribeGrab identifica os oradores. em uma transcrição.
| Seu áudio | Escolha |
|---|---|
| Uma pessoa, com um cachorro ou pássaros atrás dela. | Apenas voz |
| Duas ou mais pessoas falando ao mesmo tempo. | Limpeza padrão e ouça o resultado. |
| Apenas um zumbido constante, chiado ou o som de uma ventoinha. | Limpeza padrão |
| Cantando sobre a música | nem: use O extrator de vocais do StemGrab |
Se o Voice only não puder ser executado naquele momento, seu arquivo será processado com outra ferramenta de limpeza e o resultado indicará isso. Principalmente ruído e chiado? melhorador de voz e remova o ruído de fundo do vídeo as páginas explicam as configurações padrão.
| Comprimento por arquivo | Arquivos por dia | Apenas voz | |
|---|---|---|---|
| Gratuito, sem necessidade de cadastro. | 45 minutos | 10 | sim |
| Passe mensal gratuito (por e-mail) | 2 horas. | 25 | sim |
| Passe ShinobiTools | 3 horas | 50 | sim |
Nenhum selo d'água em nenhum dos planos. Seu arquivo será excluído logo após o processamento e o resultado será apagado em até 45 minutos.
Arraste o arquivo para a ferramenta nesta página, selecionando apenas a opção de voz, e baixe o resultado. É gratuito para 10 arquivos por dia, com duração máxima de 45 minutos cada, sem necessidade de cadastro e sem marca d'água.
Sim. Faça o upload do vídeo e você receberá o mesmo vídeo de volta, com a voz preservada e o áudio de fundo removido. A imagem é copiada exatamente como está, sem ser reprocessada.
Apenas parcialmente. Ele atenua os sons que não são a voz humana, como latidos e cantos de pássaros. Uma segunda pessoa falando claramente também é uma forma de fala: o modo "apenas voz" pode manter essa voz, ou atenuar ou substituir a sua.
Não funciona de forma confiável. Com duas pessoas falando ao mesmo tempo, o volume da segunda voz diminuiu em apenas cerca de 7 dB em média em nossos testes, e em duas das quatro gravações de teste, a voz foi perdida ou substituída. Nenhum ajuste aqui separa as duas vozes de forma confiável.
Ele foi projetado para preservar a voz. Em nossos testes, com áudio limpo, as palavras permaneceram as mesmas e o nível variou em cerca de 1 dB no máximo.
Essas configurações removem o ruído, mas são projetadas para preservar qualquer som que se assemelhe a uma voz, de modo que um latido ou o canto dos pássaros possam permanecer parcialmente audíveis. A opção "Somente voz" preserva apenas a voz humana e atenua o restante. A limpeza padrão é a mesma limpeza automática que encontramos em nossas outras páginas.
Não, ele foi desenvolvido para processar a fala, não música. Para extrair a parte vocal de uma música, use o extrator de vocais do StemGrab.
O arquivo enviado é excluído imediatamente após o processamento, e o arquivo limpo é apagado em até 45 minutos. Veja. privacidade.