BITCOS reduz pesos ternários a 1,485 bits por peso
Publicado em 20 de setembro de 2026, o relato sobre o método BITCOS, da Intel, informa armazenamento exato de pesos ternários a 1,485 bits por peso e ganhos de throughput de decode de até 18% em CPU e 27% em GPU.
O relato sobre o BITCOS, método da Intel para LLMs ternários, afirma que pesos zero permitem armazenar os pesos exatos a 1,485 bits por peso. Segundo o texto, os testes registraram até 18% mais throughput de decode em CPU e 27% em GPU. Os ganhos podem interessar a quem busca servir modelos ternários sob limites de memória e computação.
A publicação está datada de 20 de setembro de 2026. Para avaliar o resultado, consulte o post original e verifique como foram definidos os modelos, hardware, métricas e condições de comparação; esses detalhes não constam no resumo disponível. Se usar IA para estudar ou aplicar a técnica, não envie dados pessoais ou informações internas sem necessidade e confira as respostas com a fonte técnica original.