Publicado em 8 de outubro de 2025, o relato da Salesforce apresenta o UserRL, framework para treinar agentes com ambientes padronizados e usuários simulados.
Em publicação de 8 de outubro de 2025, a Salesforce apresenta o UserRL, um framework que combina ambientes gym padronizados e usuários simulados para treinar modelos agentic. O relato destaca resultados sobre cold starts com SFT, recompensas por trajetória e treinamento escalável com usuários simulados.
Segundo a publicação, essas escolhas de treinamento podem orientar o desenvolvimento de agentes para interações multi-turn. Consulte o texto original da Salesforce para conferir o escopo e os resultados completos; ao usar IA para estudá-lo, evite enviar dados pessoais ou informações internas sem autorização.