Microsoft apresenta o modelo de fala MAI-Transcribe-2
Anunciado em 3 de setembro de 2026, o MAI-Transcribe-2 é um modelo de transcrição com 2,0% de AA-WER, velocidade informada de cerca de 411 vezes o tempo real e suporte a 60 idiomas.
Em 3 de setembro de 2026, a Microsoft anunciou o MAI-Transcribe-2, modelo de reconhecimento de fala que, segundo a publicação, registra 2,0% de AA-WER e processa áudio a cerca de 411 vezes o tempo real. O modelo oferece suporte a 60 idiomas, diarização de falantes, marcações de tempo por palavra e estilos de transcrição clean ou verbatim.
A publicação sugere que engenheiros comparem precisão, velocidade e preço informados ao avaliar serviços de reconhecimento de fala. Consulte o anúncio original da Microsoft para verificar as especificações e suas condições; resultados e custos podem depender do cenário de uso. Se usar IA para analisar materiais da avaliação, evite inserir dados pessoais ou conteúdo confidencial sem aplicar a política de proteção da organização.