MemoHarness adapta harnesses com execuções anteriores
Publicado em 17 de julho de 2026, o MemoHarness adapta seis dimensões do harness de agentes e recupera aprendizados de casos semelhantes. Em um benchmark de agentes de shell, marcou 0,806, ante 0,722 do melhor baseline com harness fixo.
O MemoHarness modifica seis dimensões do harness de um agente e recupera aprendizados de execuções anteriores que sejam semelhantes ao caso novo. A proposta explora o uso das próprias execuções para aprimorar camadas de controle de agentes, sem rótulos no momento do teste nem busca adicional.
No benchmark de agentes de shell informado pela fonte, o método alcançou 0,806, enquanto o baseline mais forte com harness fixo marcou 0,722. Para conferir o resultado e entender o escopo da comparação, consulte o material original do MemoHarness e verifique como o benchmark define a métrica, os casos avaliados e o baseline.