Publicado em 3 de fevereiro de 2026, o anúncio descreve um modelo multimodal de OCR de 0,9B, com arquitetura GLM-V e licença MIT. A autora afirma que ele lidera o OmniDocBench v1.5, com pontuação de 94,62.
O anúncio, publicado em 3 de fevereiro de 2026, apresenta o GLM-OCR como um modelo multimodal de OCR de 0,9B, baseado na arquitetura GLM-V e disponibilizado sob licença MIT. A autora afirma que o modelo ocupa o primeiro lugar no OmniDocBench v1.5, com pontuação de 94,62.
Engenheiros que avaliam OCR podem consultar a página do modelo e comparar a afirmação com os resultados e critérios do benchmark original. Se usarem IA para estudar ou aplicar o material, evitem enviar documentos confidenciais sem autorização e adotem controles apropriados para os dados da organização.