Rede Pirata
HardwareApurado com NVIDIA Newsroom, NVIDIA Blog

Groq 3 LPX entra em produção plena e amarra inference agêntica à Vera Rubin

Nvidia posiciona o acelerador como extensão do rack NVL72, que a empresa diz entregar até 30 vezes mais trabalho por watt em cargas de agentes

A Nvidia anunciou que o Groq 3 LPX, acelerador voltado a inference interativa, está em produção plena. O chip é apresentado como extensão da plataforma Vera Rubin, com foco em geração rápida de tokens para sistemas agênticos, e não como produto isolado.

O argumento econômico vem de um número: segundo dados do OpenRouter citados pela empresa, uma carga agêntica queima 15 vezes mais tokens que uma pergunta simples de chat. Um agente que pesquisa uma empresa consulta bancos de dados, aciona subagentes e sintetiza tudo, e cada etapa custa tokens. Daí a insistência da Nvidia em medir o datacenter por tokens por watt, custo por token e utilização, em vez de comparar aceleradores avulsos.

A companhia afirma que o Vera Rubin NVL72 chega a 30 vezes mais trabalho por watt em agentes, e vem empacotando esse discurso junto ao esforço de atrair hyperscalers que projetam XPUs próprias. É uma jogada dupla: vender o rack inteiro e, ao mesmo tempo, oferecer-se como fábrica para quem quer silício customizado.

Apurado a partir de

Apurado e redigido por redes neurais.

Esta matéria foi produzida por sistemas autônomos de inteligência artificial operados pela Rede Pirata, a partir das fontes públicas relacionadas acima, e é publicada sob responsabilidade editorial da empresa. Os critérios são definidos por humanos; o texto, não. Publicamos assim por convicção, e não por economia: uma máquina lê mais fontes, em mais idiomas, em menos tempo, e não tem lado a defender.

O conteúdo tem caráter exclusivamente informativo e jornalístico, e não constitui recomendação de investimento nem aconselhamento financeiro, jurídico, contábil ou de engenharia, tampouco oferta ou solicitação de compra ou venda de qualquer ativo. As análises refletem interpretação de informação pública disponível no momento da publicação e podem tornar-se imprecisas sem aviso. Decisões tomadas com base neste material são de responsabilidade exclusiva de quem as toma.

Na mesma linha

Newsletter diária · 5h da manhã

Três Tiros

As três notícias de IA que movem o dia, com a leitura pronta. Chega às 5h no horário de Brasília, leva quatro minutos, e você sai na frente de quem ainda está rolando o feed.

  • Sem rastreio de abertura
  • Sem venda de lista
  • Cancela em um clique