Rede Pirata
HardwareApurado com OpenAI, Data Center Dynamics, Techmeme, The Verge, TechCrunch

OpenAI mostra números do Jalapeño e diz bater a Nvidia em inference

Chip próprio de 700 W de TDP registrou de 1,5x a 1,9x mais trabalho por watt e latência até 3,6x menor no benchmark InferenceX

A OpenAI abriu no Hot Chips os primeiros resultados do Jalapeño, seu chip de inference desenhado em casa, com 700 W de TDP. Nos testes rodados sobre o benchmark InferenceX, da SemiAnalysis, a empresa afirma ter entregado de 1,5x a 1,9x mais trabalho por watt e de 1,7x a 3,6x menos latência que os chips da Nvidia, em modelos como GPT-OSS, DeepSeek R1 e Kimi K2.5 de 1 trilhão de parâmetros.

O argumento técnico é que o chip escapa do dilema clássico do inference: ou você enfileira requisições para extrair throughput, ou corta latência e desperdiça silício. Richard Ho, vice-presidente de hardware da OpenAI, resumiu como o "melhor dos dois mundos", com mais tokens por usuário e mais throughput por quilowatt do que o estado da arte disponível.

Os números são da própria fabricante, sobre um benchmark de terceiro, e ainda não há dado público de volume de produção, custo por chip ou quando o Jalapeño assume fatia relevante da frota de inference da empresa. É o que separa um bom slide de uma mudança na estrutura de custo.

Apurado a partir de

Apurado e redigido por redes neurais.

Esta matéria foi produzida por sistemas autônomos de inteligência artificial operados pela Rede Pirata, a partir das fontes públicas relacionadas acima, e é publicada sob responsabilidade editorial da empresa. Os critérios são definidos por humanos; o texto, não. Publicamos assim por convicção, e não por economia: uma máquina lê mais fontes, em mais idiomas, em menos tempo, e não tem lado a defender.

O conteúdo tem caráter exclusivamente informativo e jornalístico, e não constitui recomendação de investimento nem aconselhamento financeiro, jurídico, contábil ou de engenharia, tampouco oferta ou solicitação de compra ou venda de qualquer ativo. As análises refletem interpretação de informação pública disponível no momento da publicação e podem tornar-se imprecisas sem aviso. Decisões tomadas com base neste material são de responsabilidade exclusiva de quem as toma.

Na mesma linha

Newsletter diária · 5h da manhã

Três Tiros

As três notícias de IA que movem o dia, com a leitura pronta. Chega às 5h no horário de Brasília, leva quatro minutos, e você sai na frente de quem ainda está rolando o feed.

  • Sem rastreio de abertura
  • Sem venda de lista
  • Cancela em um clique