Mercury 2.5: o LLM que processa 770 tokens por segundo e muda o jogo de velocidade
O Mercury 2.5, da Inception Labs, acaba de registrar 770 tokens por segundo nos benchmarks da Artificial Analysis - um número que coloca esse modelo numa categoria diferente em termos de velocidade. Descubra como funciona esse LLM baseado em difusão e quando faz sentido usa-lo.