Nvidia lança rack Groq 3 LPX para acelerar IA
A Nvidia anunciou nesta segunda-feira (24) que seu rack Groq 3 LPX está em produção plena, marcando a comercialização da tecnologia adquirida na maior compra da história da empresa.
Os sistemas devem entrar em operação ainda em 2026.
O rack será implantado junto com processadores centrais Vera e processadores gráficos Rubin na nuvem da empresa Nebius , conforme informou o diretor sênior da Nvidia, Dion Harris , em entrevista a jornalistas.
Inferência de baixa latência O avanço reforça a importância crescente da inferência de baixa latência, recurso necessário para tornar os agentes de inteligência artificial (IA) mais responsivos, especialmente em aplicações de codificação.
A Nvidia afirma que provedores de nuvem conseguem cobrar mais pelos tokens gerados nesse tipo de processamento.
“Para quem presta serviço de tokens, isso abre a possibilidade de oferecer níveis premium de serviço para os usuários e clientes que exigem os acordos mais sensíveis à latência”, diz Harris.
A compra dos ativos da startup de chips Groq por US$ 20 bilhões, em dezembro de 2025, foi a maior aquisição da Nvidia até hoje.
A arquitetura Groq inclui 500 megabytes de memória estática de acesso aleatório (SRAM) no próprio die do chip para reduzir gargalos relacionados à memória.
Os chips são fabricados pela Samsung , enquanto a Taiwan Semiconductor Manufacturing produz as unidades de processamento gráfico (GPUs) da Nvidia.
Desempenho dos chips Groq Cada rack LPX reúne 256 chips Groq 3 individuais.
Segundo benchmark da Artificial Analysis , o rack Groq 3 LPX entrega 3.400 tokens por segundo.
O segmento de baixa latência é disputado.
A Advanced Micro Devices anunciou, no início de 2026, a integração de seus sistemas em escala de rack com chips da Cerebras , empresa que abriu recentemente o capital na bolsa, também com foco em inferência de baixa latência.
O modo Ultrafast da OpenAI , recém-lançado, promete 750 tokens por segundo e é descrito pela empresa como “alimentado pela Cerebras”.
Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em itforum.com.br — o conteúdo pertence a IT Forum.