segunda-feira, 24 de agosto de 2026 📬 Resumo no TelegramPortaisSobre🌓
🇧🇷 BR ▾
ÚLTIMAS
Orlandinho e Matos ficam juntos no top 20 pela primeira vez Samuel Eto'o sai em defesa de Infantino após críticas: 'Não fez nada de errado' Cartão verde debate a 24ª rodada do Brasileirão e dos jogos de ida das quartas da Copa do Brasil Palmeiras vende Allan ao Manchester City por mais de R$ 220 milhões Flavio Latif: Há muitos indícios de que Allan deixará o Palmeiras F1 - Gasly alerta Racing Bulls após "corrida arruinada" na Holanda: "Tenho boa memória" Quem é Rafael Câmara, piloto brasileiro que fará teste na Haas e busca a F1 Fils gruda no top 10 com o título, Zverev volta a ser o vice-líder Moraes vence primeira etapa do Sertões 2026 Durinho aponta Do Bronx e Diego Lopes como principais expoentes do jiu-jitsu no MMA Orlandinho e Matos ficam juntos no top 20 pela primeira vez Samuel Eto'o sai em defesa de Infantino após críticas: 'Não fez nada de errado' Cartão verde debate a 24ª rodada do Brasileirão e dos jogos de ida das quartas da Copa do Brasil Palmeiras vende Allan ao Manchester City por mais de R$ 220 milhões Flavio Latif: Há muitos indícios de que Allan deixará o Palmeiras F1 - Gasly alerta Racing Bulls após "corrida arruinada" na Holanda: "Tenho boa memória" Quem é Rafael Câmara, piloto brasileiro que fará teste na Haas e busca a F1 Fils gruda no top 10 com o título, Zverev volta a ser o vice-líder Moraes vence primeira etapa do Sertões 2026 Durinho aponta Do Bronx e Diego Lopes como principais expoentes do jiu-jitsu no MMA
Tecnologia

Nvidia lança rack Groq 3 LPX para acelerar IA

IT Forum ·
Nvidia lança rack Groq 3 LPX para acelerar IA

A Nvidia anunciou nesta segunda-feira (24) que seu rack Groq 3 LPX está em produção plena, marcando a comercialização da tecnologia adquirida na maior compra da história da empresa.

Os sistemas devem entrar em operação ainda em 2026.

O rack será implantado junto com processadores centrais Vera e processadores gráficos Rubin na nuvem da empresa Nebius , conforme informou o diretor sênior da Nvidia, Dion Harris , em entrevista a jornalistas.

Inferência de baixa latência O avanço reforça a importância crescente da inferência de baixa latência, recurso necessário para tornar os agentes de inteligência artificial (IA) mais responsivos, especialmente em aplicações de codificação.

A Nvidia afirma que provedores de nuvem conseguem cobrar mais pelos tokens gerados nesse tipo de processamento.

“Para quem presta serviço de tokens, isso abre a possibilidade de oferecer níveis premium de serviço para os usuários e clientes que exigem os acordos mais sensíveis à latência”, diz Harris.

A compra dos ativos da startup de chips Groq por US$ 20 bilhões, em dezembro de 2025, foi a maior aquisição da Nvidia até hoje.

A arquitetura Groq inclui 500 megabytes de memória estática de acesso aleatório (SRAM) no próprio die do chip para reduzir gargalos relacionados à memória.

Os chips são fabricados pela Samsung , enquanto a Taiwan Semiconductor Manufacturing produz as unidades de processamento gráfico (GPUs) da Nvidia.

Desempenho dos chips Groq Cada rack LPX reúne 256 chips Groq 3 individuais.

Segundo benchmark da Artificial Analysis , o rack Groq 3 LPX entrega 3.400 tokens por segundo.

O segmento de baixa latência é disputado.

A Advanced Micro Devices anunciou, no início de 2026, a integração de seus sistemas em escala de rack com chips da Cerebras , empresa que abriu recentemente o capital na bolsa, também com foco em inferência de baixa latência.

O modo Ultrafast da OpenAI , recém-lançado, promete 750 tokens por segundo e é descrito pela empresa como “alimentado pela Cerebras”.

Ler a notícia completa no IT Forum ›

Resumo agregado pelo 5News a partir do feed público do veículo. A matéria completa, com todo o contexto, está em itforum.com.br — o conteúdo pertence a IT Forum.

Mais de IT Forum

Ver tudo ›

Mais em Tecnologia

Ver tudo ›