Publicada em 17 de setembro de 2025, uma ferramenta de linha de comando em Python transcreve áudio e vídeo longos por meio de uma API de reconhecimento de fala.
Em 17 de setembro de 2025, foi apresentada uma ferramenta de linha de comando em Python para uma API de reconhecimento de fala. Ela transcreve áudio e vídeo longos, divide o conteúdo com detecção de atividade de voz (VAD), faz chamadas paralelas, aceita vários formatos de mídia e realiza reamostragem automática.
O anúncio descreve o escopo e os recursos, mas não apresenta métricas de desempenho. Para confirmar detalhes e compatibilidade, consulte a documentação e o projeto original; teste com arquivos representativos antes de adotar a ferramenta e verifique a transcrição contra o áudio.