NVIDIA anuncia produção completa dos racks Groq 3 LPX para implantação na Nebius

iconChaincatcher
Compartilhar
AI summary iconResumo
O diretor sênior da NVIDIA, Dion Harris, confirmou na segunda-feira que os racks Groq 3 LPX estão em produção total para a Nebius, um novo provedor de nuvem. O deploy segue o acordo de licenciamento de US$ 20 bilhões da NVIDIA com a Groq em dezembro de 2025. Novas listagens de tokens de provedores de nuvem podem refletir infraestrutura aprimorada. O Groq 3 LPX, lançado em março, possui 500 MB de SRAM por chip e processa 3.400 tokens por segundo. Chips de baixa latência ajudam provedores de nuvem a atingir usuários sensíveis à latência. Dados de inflação podem influenciar tendências de investimento em data centers. Jonathan Ross, fundador da Groq, agora lidera a arquitetura de software na NVIDIA. A empresa planeja destinar um quarto de seu espaço em data centers para chips Groq.

ChainCatcher relata que, na segunda-feira, o diretor sênior da NVIDIA, Dion Harris, anunciou que os racks Groq 3 LPX entraram na fase de produção em massa total e serão implantados nos data centers do novo provedor de nuvem Nebius, com lançamento previsto para o final deste ano. Esse movimento marca a comercialização oficial da tecnologia adquirida pela NVIDIA após o acordo de licenciamento tecnológico de aproximadamente US$ 20 bilhões firmado com a Groq em dezembro do ano passado. Vários funcionários-chave da Groq já se juntaram à NVIDIA, com o fundador Jonathan Ross assumindo o cargo de arquiteto-chefe de software da NVIDIA. A NVIDIA está acelerando a produção de chips Groq e entregando produtos aos clientes, destacando a importância da inferência de baixa latência. O Groq 3 LPX, lançado em março deste ano, é um acelerador de inferência para a plataforma Vera Rubin, cuja arquitetura integra 500 MB de SRAM de alta velocidade diretamente no chip para reduzir gargalos de memória. Cada rack LPX pode integrar 256 chips Groq 3, e a NVIDIA citou testes de referência indicando capacidade de processamento de 3.400 tokens por segundo; o chip é fabricado pela Samsung. Harris afirmou que os chips de baixa latência não substituem as GPUs, mas sim utilizam o processador adequado para cada etapa da carga de trabalho, permitindo que provedores de nuvem ofereçam planos premium com preços mais altos para usuários sensíveis à latência. O CEO da NVIDIA, Jensen Huang, planeja alocar cerca de um quarto do espaço dos data centers voltados para aplicações de programação para chips Groq, enquanto o restante utilizará sistemas Vera Rubin, com expectativa de que as vendas acumuladas dos Blackwell e Vera Rubin atinjam US$ 1 trilhão até 2027.

Aviso legal: as informações nesta página podem ter sido obtidas de terceiros e não refletem necessariamente os pontos de vista ou opiniões da KuCoin. Este conteúdo é fornecido apenas para fins informativos gerais, sem qualquer representação ou garantia de qualquer tipo, nem deve ser interpretado como aconselhamento financeiro ou de investimento. A KuCoin não é responsável por quaisquer erros ou omissões, ou por quaisquer resultados do uso destas informações. Os investimentos em ativos digitais podem ser arriscados. Avalie cuidadosamente os riscos de um produto e a sua tolerância ao risco com base nas suas próprias circunstâncias financeiras. Para mais informações, consulte nossos termos de uso e divulgação de risco.