Rede Pirata
HardwareApurado com IEEE Spectrum

OpenAI usou os próprios modelos para desenhar o acelerador Jalapeño

Chip apresentado em 25 de agosto entrega 13,4 petaflops em 4 bits e 232 GB de memória; ganho de latência sobre o GB300 é medição da própria empresa

Reportagem da IEEE Spectrum detalha como a OpenAI recorreu a seus próprios modelos de linguagem para acelerar o projeto do Jalapeño, o acelerador de IA que a empresa revelou por completo em 25 de agosto. O chip soma 13,4 petaflops de computação em precisão de 4 bits e acessa 232 GB de memória a 15,4 TB/s.

Os números de desempenho comparativo vêm da própria OpenAI: benchmarks citados pela empresa indicam redução de até 3,6 vezes na latência ponta a ponta, do prompt até o último token, em relação ao GB300 da NVIDIA, com consumo menor de energia. Ninguém de fora mediu isso ainda, e o Jalapeño só entra em serviço amplo na frota de inference da empresa mais adiante.

O ângulo mais interessante não é o teraflop, é o método. Uma empresa que vende modelos usou os modelos para encurtar o ciclo de projeto de silício, área em que o gargalo histórico é verificação e iteração de layout. Se o padrão se confirmar em outras casas, muda o tempo entre arquitetura e primeiro silício, que é onde mora o custo real de um chip próprio.

Apurado a partir de

Apurado e redigido por redes neurais.

Esta matéria foi produzida por sistemas autônomos de inteligência artificial operados pela Rede Pirata, a partir das fontes públicas relacionadas acima, e é publicada sob responsabilidade editorial da empresa. Os critérios são definidos por humanos; o texto, não. Publicamos assim por convicção, e não por economia: uma máquina lê mais fontes, em mais idiomas, em menos tempo, e não tem lado a defender.

O conteúdo tem caráter exclusivamente informativo e jornalístico, e não constitui recomendação de investimento nem aconselhamento financeiro, jurídico, contábil ou de engenharia, tampouco oferta ou solicitação de compra ou venda de qualquer ativo. As análises refletem interpretação de informação pública disponível no momento da publicação e podem tornar-se imprecisas sem aviso. Decisões tomadas com base neste material são de responsabilidade exclusiva de quem as toma.

Na mesma linha

Newsletter diária · 5h da manhã

Três Tiros

As três notícias de IA que movem o dia, com a leitura pronta. Chega às 5h no horário de Brasília, leva quatro minutos, e você sai na frente de quem ainda está rolando o feed.

  • Sem rastreio de abertura
  • Sem venda de lista
  • Cancela em um clique