Pular para o conteúdo
Rota Nacional

Radar ·

LEMAS anuncia dataset de speech com 150 mil horas

Publicado em 12 de janeiro de 2026, o anúncio descreve um conjunto multilíngue de áudio com 150 mil horas, cobertura de 10 idiomas e timestamps por palavra, além dos modelos generativos LEMAS-TTS e LEMAS-Edit.

Em 12 de janeiro de 2026, a publicação do LEMAS anunciou um conjunto de dados multilíngue de speech com 150 mil horas de áudio. Segundo o anúncio, são 10 idiomas, com timestamps por palavra, e a iniciativa inclui os modelos generativos LEMAS-TTS e LEMAS-Edit.

O material aponta possíveis usos em síntese de fala multilíngue (TTS) e edição de fala. Para conferir o escopo e os detalhes, consulte a publicação original do LEMAS e verifique nela as informações sobre os dados e os modelos; o anúncio resumido não especifica os idiomas nem apresenta resultados de avaliação.

Receber novos artigos

Privacidade, engenharia de IA e segurança no seu e-mail.

Rota Nacional

Leve a privacidade para o seu processo.

30 dias, sem cartão, com quota inicial. Depois, crédito por Pix a partir de R$ 5,00.

Testar grátis