Publicado em 12 de janeiro de 2026, o anúncio descreve um conjunto multilíngue de áudio com 150 mil horas, cobertura de 10 idiomas e timestamps por palavra, além dos modelos generativos LEMAS-TTS e LEMAS-Edit.
Em 12 de janeiro de 2026, a publicação do LEMAS anunciou um conjunto de dados multilíngue de speech com 150 mil horas de áudio. Segundo o anúncio, são 10 idiomas, com timestamps por palavra, e a iniciativa inclui os modelos generativos LEMAS-TTS e LEMAS-Edit.
O material aponta possíveis usos em síntese de fala multilíngue (TTS) e edição de fala. Para conferir o escopo e os detalhes, consulte a publicação original do LEMAS e verifique nela as informações sobre os dados e os modelos; o anúncio resumido não especifica os idiomas nem apresenta resultados de avaliação.