Publicado em 23 de setembro de 2025, o relato sobre o LIMI afirma que 78 demonstrações selecionadas alcançaram 73,5% no AgencyBench, acima de modelos treinados com 10 mil amostras.
O post sobre o LIMI, publicado em 23 de setembro de 2025, descreve um estudo de curadoria de dados para a autonomia de agentes. Segundo o relato, o sistema usa 78 demonstrações selecionadas e obtém 73,5% no benchmark AgencyBench, superando modelos treinados com 10 mil amostras. O texto sustenta que a seleção estratégica dos dados, e não apenas sua escala, pode impulsionar a autonomia. Os números apresentados levantam uma hipótese testável, mas não bastam, por si só, para estabelecer uma conclusão geral sobre treinamento de agentes.
Para avaliar o resultado, consulte a publicação original e verifique como foram escolhidas as demonstrações, quais modelos e condições de comparação foram usados e como o desempenho foi medido. A afirmação disponível não detalha esses procedimentos; não a trate como prova de que conjuntos menores sempre são melhores. Se usar IA para estudar ou reproduzir o trabalho, evite inserir dados internos ou confidenciais sem autorização e aplique as políticas de proteção da sua organização.