Publicado em 22 de outubro de 2025, o post apresenta um modelo de OCR para PDFs e digitalizações, com tabelas, equações e escrita manual. A abordagem combina dados sintéticos e testes unitários como recompensas verificáveis.
Em 22 de outubro de 2025, um post apresentou o olmOCR 2, modelo destinado a converter PDFs e digitalizações em texto limpo. Segundo a publicação, ele oferece suporte a tabelas, equações e escrita manual, e usa dados sintéticos e testes unitários como recompensas verificáveis.
O relato pode interessar a equipes que avaliam OCR para documentos complexos e maneiras de verificar resultados. Para confirmar o escopo e os achados, consulte a publicação original e confira nela os detalhes técnicos; o texto disponível não informa métricas de desempenho.