Publicado em 28 de setembro de 2026, o conjunto apresenta 200 ambientes para estudar aprendizado por reforço em tarefas desafiadoras, abertas e de longo horizonte.
Em 28 de setembro de 2026, a FrontierSmith publicou 200 problemas abertos para estudar aprendizado por reforço (RL) em tarefas desafiadoras. Segundo a descrição, um sistema usa IA para sintetizar problemas de programação abertos em escala; os problemas oferecem ambientes para engenheiros investigarem tarefas abertas de longo horizonte.
Para conferir o escopo e os detalhes, consulte a página do projeto no GitHub e compare a descrição com os problemas publicados. Se usar IA para estudar ou adaptar o material, não envie código, dados ou documentos internos sem antes aplicar a política de proteção da sua organização.