Em resultados do MLPerf Inference v6.1, a Crusoe reportou 5,75 milhões de tokens por segundo em gpt-oss-120b usando 512 GPUs AMD Instinct MI355X.
A Crusoe relata resultados do MLPerf Inference v6.1 em um cluster com 512 GPUs AMD Instinct MI355X: 5,75 milhões de tokens por segundo no teste com gpt-oss-120b. A empresa também informou escalabilidade linear sem InfiniBand.
Os números servem como referência para comparar throughput e escalabilidade de clusters de inferência, mas não garantem desempenho equivalente em outras cargas ou configurações. Ao usar IA para estudar ou aplicar esses resultados, evite inserir dados pessoais ou informações internas sem necessidade; confira também as políticas de tratamento de dados da ferramenta utilizada.