Publicação de 13 de janeiro de 2026 apresenta o Pocket TTS, modelo de síntese de fala com 100 milhões de parâmetros, descrito como capaz de rodar em laptop sem GPU e oferecer clonagem de voz.
Em publicação datada de 13 de janeiro de 2026, a Kyutai Labs apresentou o Pocket TTS, um modelo de text-to-speech com 100 milhões de parâmetros. Segundo o post, ele oferece clonagem de voz e pode rodar em um laptop sem GPU; a publicação o descreve como open-source.
O anúncio aponta uma opção de TTS self-hosted para avaliação por engenheiros, mas não traz, no material fornecido, resultados de benchmarks ou detalhes de desempenho. Para verificar as afirmações e as condições de uso, consulte a publicação original e os materiais técnicos do projeto. Se usar IA para estudá-los, aplique a política da organização a dados pessoais ou confidenciais antes do processamento.