Pular para o conteúdo
Rota Nacional

Radar ·

UserRL treina agentes com usuários simulados

Publicado em 8 de outubro de 2025, o relato da Salesforce apresenta o UserRL, framework para treinar agentes com ambientes padronizados e usuários simulados.

Em publicação de 8 de outubro de 2025, a Salesforce apresenta o UserRL, um framework que combina ambientes gym padronizados e usuários simulados para treinar modelos agentic. O relato destaca resultados sobre cold starts com SFT, recompensas por trajetória e treinamento escalável com usuários simulados.

Segundo a publicação, essas escolhas de treinamento podem orientar o desenvolvimento de agentes para interações multi-turn. Consulte o texto original da Salesforce para conferir o escopo e os resultados completos; ao usar IA para estudá-lo, evite enviar dados pessoais ou informações internas sem autorização.

Receber novos artigos

Privacidade, engenharia de IA e segurança no seu e-mail.

Rota Nacional

Leve a privacidade para o seu processo.

30 dias, sem cartão, com quota inicial. Depois, crédito por Pix a partir de R$ 5,00.

Testar grátis