Publicado em 26 de dezembro de 2025, o resumo apresenta o VL-JEPA, modelo que prevê embeddings contínuos do texto-alvo em vez de gerar tokens autorregressivamente.
Publicado em 26 de dezembro de 2025, o resumo descreve o VL-JEPA, um modelo de visão e linguagem baseado em JEPA. Em vez de gerar texto token a token de forma autorregressiva, ele prevê embeddings contínuos do texto-alvo.
Segundo o artigo, essa escolha busca priorizar a semântica relevante para a tarefa e reduzir a sensibilidade a variações de formulação. Para conferir escopo, método e resultados, consulte o artigo original e verifique nele as evidências e limitações; o resumo não informa métricas nem detalhes experimentais.