Pular para o conteúdo
Rota Nacional

Radar ·

Receitas de LoRA para fine-tuning em RL

Em publicação de 29 de setembro de 2025, a Thinky Machines destaca escolhas de configuração de LoRA para fine-tuning em reinforcement learning, incluindo taxas de aprendizado 10 vezes maiores e LoRA em todas as camadas.

Uma publicação da Thinky Machines, datada de 29 de setembro de 2025, descreve receitas de LoRA para fine-tuning em reinforcement learning. Entre as escolhas destacadas estão usar taxas de aprendizado 10 vezes maiores e aplicar LoRA em todas as camadas. O texto afirma que LoRA com rank 1 pode igualar o desempenho de full fine-tuning quando bem configurado.

O post apresenta opções que engenheiros podem avaliar em fine-tuning de RL; não fornece, neste resumo, detalhes de experimentos ou resultados além dessas afirmações. Para verificar o escopo, a configuração e as evidências, consulte a publicação original da Thinky Machines e confira os métodos e resultados apresentados nela.

Receber novos artigos

Privacidade, engenharia de IA e segurança no seu e-mail.

Rota Nacional

Leve a privacidade para o seu processo.

30 dias, sem cartão, com quota inicial. Depois, crédito por Pix a partir de R$ 5,00.

Testar grátis