Anunciados em 8 de agosto de 2024, os modelos de síntese de fala foram treinados com 45 mil horas de áudio e permitem controlar características da voz por prompts de texto.
Em 8 de agosto de 2024, foi anunciado o lançamento do Parler-TTS Mini e Large v1, modelos open-source de conversão de texto em fala treinados com 45 mil horas de fala. Segundo o anúncio, prompts de texto podem controlar características como gênero, ruído de fundo, velocidade, pitch e reverberação.
O material informa que pesos, dados de treinamento e receitas estão disponíveis para engenheiros avaliarem modelos de TTS controláveis. Para verificar os detalhes, consulte o anúncio original e os materiais disponibilizados, conferindo o escopo e as condições de uso antes de testar. Se usar IA para estudar ou aplicar o material, não envie dados pessoais ou conteúdo confidencial sem antes verificar as políticas e proteções da ferramenta escolhida.