Em publicação de 29 de setembro de 2025, a Thinky Machines destaca escolhas de configuração de LoRA para fine-tuning em reinforcement learning, incluindo taxas de aprendizado 10 vezes maiores e LoRA em todas as camadas.
Uma publicação da Thinky Machines, datada de 29 de setembro de 2025, descreve receitas de LoRA para fine-tuning em reinforcement learning. Entre as escolhas destacadas estão usar taxas de aprendizado 10 vezes maiores e aplicar LoRA em todas as camadas. O texto afirma que LoRA com rank 1 pode igualar o desempenho de full fine-tuning quando bem configurado.
O post apresenta opções que engenheiros podem avaliar em fine-tuning de RL; não fornece, neste resumo, detalhes de experimentos ou resultados além dessas afirmações. Para verificar o escopo, a configuração e as evidências, consulte a publicação original da Thinky Machines e confira os métodos e resultados apresentados nela.