Publicado em 23 de junho de 2026, o índice combina três benchmarks para comparar modelos nativos de Speech-to-Speech em raciocínio em fala, dinâmica conversacional e desempenho agêntico.
Em 23 de junho de 2026, a Artificial Analysis apresentou um índice de modelos nativos de Speech-to-Speech. A avaliação combina Big Bench Audio, um subconjunto do Full Duplex Bench e τ-Voice, atribuindo pesos iguais aos três conjuntos. Para entrar no índice, um modelo precisa ter resultados válidos em todos eles.
O benchmark foi concebido para ajudar engenheiros a comparar raciocínio em fala, dinâmica conversacional e desempenho agêntico. A descrição disponível informa o escopo e o critério de inclusão, mas não apresenta pontuações ou resultados específicos. Consulte a publicação original da Artificial Analysis para verificar os dados, a metodologia e eventuais atualizações antes de usar o índice numa decisão técnica.