Pré-processamento de áudio para transcrição Whisper

Executa o pipeline de redução de ruído e normalização de volume em arquivos de áudio usando Python (bibliotecas como Silero, noisereduce, numpy e scipy) para otimizar a entrada para modelos de reconhecimento de voz como o Whisper.

ECNU-ICALK Updated 559 repo stars

File contents

ECNU-ICALK/AutoSkill/tree/main/SkillBank/ConvSkill/Portuguese/pré-processamento-de-áudio-para-transcrição-whisper commit 630f699005

Frequently asked questions

npx skillmds@latest add ecnu-icalk/pr-processamento-de-udio-para-transcri-o-whisper