Publicação de 12 de outubro de 2025 descreve uma técnica que alterna entre raciocínio latente e explícito e relata ganhos de eficiência em tokens em modelos Qwen3-8B.
Uma publicação de 12 de outubro de 2025 descreve o SwiReasoning, método que usa entropia preditiva para alternar entre raciocínio latente, com soft embeddings, e Chain-of-Thought explícito. Segundo o texto, a alternância acionada pela confiança alcançou ganho máximo de 6,78× na eficiência de tokens e ganho médio de 56–79% em modelos Qwen3-8B. A abordagem pode interessar a engenheiros que buscam reduzir o custo de tokens de raciocínio.
Esses números são resultados relatados pela publicação, não uma garantia para outros modelos ou tarefas. Para avaliar a afirmação, consulte o trabalho original e confira como define eficiência, quais configurações e tarefas foram testadas e como apresenta os resultados. Se usar IA para estudar ou aplicar o material, evite enviar dados pessoais ou documentos internos sem autorização; verifique também as políticas da organização.