OCR para documentos longos: modelo processa mais de 40 páginas
Publicado em 23 de junho de 2026, o relato apresenta um modelo de OCR open source que processa documentos com mais de 40 páginas em uma passagem e informa resultados nos benchmarks OmniDocBench v1.5 e v1.6.
Publicado em 23 de junho de 2026, o relato descreve um modelo open source de OCR que usa Reference Sliding Window Attention para processar documentos com mais de 40 páginas em uma única passagem. Segundo a publicação, o modelo tem 3 bilhões de parâmetros no total, dos quais 500 milhões são ativados, e apresenta resultados no OmniDocBench v1.5 e v1.6. A abordagem é voltada a OCR de documentos longos com tamanho constante de KV Cache.
Para verificar os detalhes, consulte a publicação original e inspecione a implementação, a descrição do método e os resultados reportados nos benchmarks. Se usar IA para estudar ou aplicar essa abordagem com documentos da organização, siga a política interna de dados: na Rota Nacional, a detecção de dados pessoais e a política configurada ocorrem antes da execução do modelo; metadados de uso ficam no painel, enquanto prompts e respostas brutos são mantidos no arquivo de auditoria criptografado.