Publicado em 11 de julho de 2026, o paper examina quatro designs para verificar recompensas de agentes de código e conclui que não há uma solução única.
Publicado em 11 de julho de 2026, o paper “O desafio de verificação das recompensas de agentes de código” analisa como verificar soluções geradas por agentes. Seu argumento central é que conferir essas soluções com confiabilidade se tornou mais difícil do que gerá-las. O trabalho examina quatro designs de verificação de recompensas e não identifica uma solução única.
O paper também destaca que sinais de recompensa podem divergir da intenção humana e que avaliações de agentes exigem verificação robusta. Para conferir o relato, consulte o paper original e compare seus métodos e conclusões com este resumo; não há detalhes sobre os quatro designs no material apresentado aqui. Se usar IA para estudar o tema, evite inserir código, dados ou informações internas da organização sem autorização.