A Nvidia Enterprise anunciou que sua plataforma de inferência de inteligência artificial (AI), recentemente ampliada com GPUs Nvidia A30 e A10 para servidores convencionais, atingiu um desempenho recorde em todas as categorias na versão mais atual do MLPerf, referência do setor que mede o desempenho de AI em várias cargas de trabalho.
CONTEÚDO RELACIONADO – Volvo Cars vai usar Nvidia Drive Orin em seus próximos carros autônomos
Avaliadas pela primeira vez no MLPerf, as GPUs A30 e A10 proporcionam alto desempenho e baixo consumo de energia, oferecendo às empresas opções convencionais para diversas cargas de trabalho de inferência de AI, treinamento, gráficos e computação empresarial tradicional. A expectativa é de que as GPUs venham integradas aos servidores mais avançados dos fornecedores Hewlett Packard Enterprise, Inspur e Lenovo a partir do próximo trimestre.
A fabricante aponta que conquistou esses resultados graças à plataforma de AI da empresa, com várias GPUs e softwares de AI, como o TensorRT e o Servidor de Inferência Nvidia Triton.
A Nvidia também quebrou outro recorde com produtos que têm o recurso GPU Multi-Instância (MIG — Multi-Instance GPU) da arquitetura Nvidia Ampere. Ela executou, simultaneamente, todos os sete testes off-line do MLPerf em uma única GPU com sete instâncias da MIG. A configuração mostrou um desempenho quase idêntico ao de uma única instância da MIG.
A A30 e a A10 devem vir integradas aos servidores a partir do próximo semestre, inclusive em Nvidia-Certified Systems que passam por testes rigorosos para garantir alto desempenho em várias cargas de trabalho. O Nvidia Triton e o Nvidia TensorRT estão disponíveis no catálogo de softwares do NGC da fabricante.
Participe das comunidades IPNews no Facebook, LinkedIn e Twitter.

