Hy4 Preview reduzido a 214 GB com quantização de 1,25 bit
Publicação da Tencent afirma que a quantização Sherry reduz o Hy4 Preview de 1,5 TB para 214 GB, usando 1,25 bit por peso, e descreve execução em GPUs distribuídas por várias máquinas.
Em publicação datada de 1º de setembro de 2026, a Tencent afirma que a quantização Sherry reduz o Hy4 Preview de 1,5 TB para 214 GB, com 1,25 bit por peso. O texto também descreve a execução do modelo em GPUs distribuídas por várias máquinas. Esses dados são relevantes para quem investiga inferência com menor demanda de memória e configurações distribuídas de GPUs.
Para avaliar o resultado, consulte a publicação original e confira nela as condições, os números e o contexto técnico apresentados; não presuma que a redução de tamanho, por si só, assegure desempenho ou qualidade específicos. Se usar IA para estudar ou aplicar o material, evite inserir dados pessoais ou documentos internos sem autorização e verifique a política da organização.