Negócios

Oracle implementa GPUs da AMD para projetos de IA na sua nuvem

Online cloud data storage rack concept. Cloudscape digital online server for global network business. Web database backup computer private infrastructure technology

A Oracle e a AMD anunciaram no início do mês passado que as GPUs AMD Instinct MI355X estarão disponíveis na Oracle Cloud Infrastructure (OCI) para oferecer aos clientes mais opções de infraestrutura. Segundo a empresa de nuvem, o custo-benefício da parceria será até duas vezes melhor para treinamento de inteligência artificial (IA) em larga escala e cargas de trabalho de inferência em comparação à geração anterior.

CONTEÚDO RELACIONADO: Mesmo com repatriação de dados, migração em nuvem deve atingir US$ 806 bi em 2029

A Oracle oferecerá clusters de IA em zettascale acelerados pelos mais recentes processadores AMD Instinct com até 131.072 GPUs MI355X para possibilitar que os clientes criem, treinem e infiram IA em escala. Segundo ela, isso é o suficiente para dar suporte a novas aplicações de IA que exigem conjuntos de dados maiores e mais complexos. O AMD Instinct MI355X oferece quase o triplo de poder de computação e um aumento de 50% na memória de alta largura de banda do que a geração anterior, completa a companhia.

“A AMD e a Oracle compartilham um histórico de fornecer aos clientes soluções abertas para acomodar alto desempenho, eficiência e maior flexibilidade de design de sistema”, disse Forrest Norrod, vice-presidente executivo e gerente geral do Data Center Solutions Business Group da AMD. “A última geração de GPUs AMD Instinct e NICs Pollara na OCI ajudará a dar suporte a novos casos de uso em inferência, ajuste fino e treinamento, oferecendo mais opções aos clientes à medida que a adoção da IA cresce”, explica Norrod.

Infraestrutura criada para a IA

As instâncias com tecnologia AMD Instinct MI355X na Oracle Cloud Infrastructure foram desenvolvidas para oferecer desempenho superior, alta flexibilidade em nuvem e compatibilidade com software de código aberto. Elas atendem especialmente aos clientes que operam modelos de linguagem de larga escala e cargas de trabalho intensivas de inteligência artificial.

Com até 2,8 vezes mais taxa de transferência em relação à geração anterior, essas GPUs permitem resultados mais rápidos e a execução de modelos mais robustos, com menor latência. Seu design com 288 gigabytes de memória HBM3 e até oito terabytes por segundo de largura de banda garante que mesmo os maiores modelos possam ser processados inteiramente em memória, acelerando tanto o treinamento quanto a inferência.

O suporte ao novo padrão FP4 de 4 bits também permite a implementação mais econômica de modelos modernos de IA generativa, com eficiência e velocidade elevadas. Todo esse poder computacional está integrado a um novo cluster com arquitetura densa e sistema de resfriamento a líquido, capaz de atingir até 125 quilowatts por rack, com 64 GPUs de 1.400 watts cada — configuração ideal para cargas exigentes.

A estrutura foi projetada para atender à produção em larga escala, com otimização para aplicações baseadas em agentes, resposta rápida e alto volume de tokens por segundo. Complementando o conjunto, um nó principal robusto com CPUs AMD Turin de alta frequência e até três terabytes de memória permite orquestração de tarefas e processamento de dados com alto desempenho.

Além disso, a pilha de software aberta AMD ROCm proporciona aos desenvolvedores liberdade para adaptar seus projetos sem amarrações a fornecedores específicos. Por fim, a Oracle será a primeira nuvem a integrar as novas NICs AMD Pollara às suas redes de backend, viabilizando conectividade de baixa latência com suporte a RoCE avançado e padrões abertos do Ultra Ethernet Consortium, para entregar máxima eficiência em redes de alto desempenho.

Participe das comunidades IPNews no Instagram, Facebook, LinkedIn e X (Twitter).

Newsletter

Inscreva-se para receber nossa newsletter semanal
com as principais notícias em primeira mão.


    Deixe um comentário

    O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *