Pular para o conteúdo
Rota Nacional

Radar ·

OCR para documentos longos: modelo processa mais de 40 páginas

Publicado em 23 de junho de 2026, o relato apresenta um modelo de OCR open source que processa documentos com mais de 40 páginas em uma passagem e informa resultados nos benchmarks OmniDocBench v1.5 e v1.6.

Publicado em 23 de junho de 2026, o relato descreve um modelo open source de OCR que usa Reference Sliding Window Attention para processar documentos com mais de 40 páginas em uma única passagem. Segundo a publicação, o modelo tem 3 bilhões de parâmetros no total, dos quais 500 milhões são ativados, e apresenta resultados no OmniDocBench v1.5 e v1.6. A abordagem é voltada a OCR de documentos longos com tamanho constante de KV Cache.

Para verificar os detalhes, consulte a publicação original e inspecione a implementação, a descrição do método e os resultados reportados nos benchmarks. Se usar IA para estudar ou aplicar essa abordagem com documentos da organização, siga a política interna de dados: na Rota Nacional, a detecção de dados pessoais e a política configurada ocorrem antes da execução do modelo; metadados de uso ficam no painel, enquanto prompts e respostas brutos são mantidos no arquivo de auditoria criptografado.

Receber novos artigos

Privacidade, engenharia de IA e segurança no seu e-mail.

Rota Nacional

Leve a privacidade para o seu processo.

30 dias, sem cartão, com quota inicial. Depois, crédito por Pix a partir de R$ 5,00.

Testar grátis