Em 22 de agosto de 2024, a AI21 Labs anunciou dois modelos MoE com arquitetura Mamba e Joint Attention, janela de contexto de 256K, quantização ExpertInt8, modo JSON, ferramentas e integração com Transformers.
Em 22 de agosto de 2024, a AI21 Labs anunciou os modelos MoE Jamba 1.5 Mini e Jamba 1.5 Large. Segundo a publicação, eles combinam Mamba e Joint Attention e oferecem uma janela de contexto de 256K. O texto também menciona quantização ExpertInt8, modo JSON, uso de ferramentas e integração com Transformers.
Esses dados são relevantes para engenheiros que avaliam opções de inferência de LLMs, mas não substituem testes próprios de desempenho e adequação. Para confirmar o escopo e os detalhes, consulte o anúncio original da AI21 Labs e compare as especificações e instruções de integração ali publicadas com a documentação técnica dos modelos.