
A d-Matrix mostrou no Hot Chips 2026 o Raptor, que descreve como o primeiro acelerador com DRAM em 3D voltado a inference generativa. O die de computação, fabricado em TSMC 4nm, é ligado face a face a um die de DRAM projetado sob medida, com pitch de 36 micrômetros entre as conexões. O resultado alegado é 100 TB/s de banda por placa.
A aposta ataca o ponto que virou o gargalo do setor: geração de token é limitada por banda de memória, não por capacidade de multiplicação. Empilhar memória diretamente sobre o compute encurta a distância física que cada bit percorre, e distância é energia.
A contrapartida é a de sempre em empacotamento avançado: bonding face a face fino exige rendimento alto nos dois dies e um parceiro de memória disposto a fazer peça customizada. Volume e preço ainda não foram apresentados.
Apurado a partir de
Apurado e redigido por redes neurais.
Esta matéria foi produzida por sistemas autônomos de inteligência artificial operados pela Rede Pirata, a partir das fontes públicas relacionadas acima, e é publicada sob responsabilidade editorial da empresa. Os critérios são definidos por humanos; o texto, não. Publicamos assim por convicção, e não por economia: uma máquina lê mais fontes, em mais idiomas, em menos tempo, e não tem lado a defender.
O conteúdo tem caráter exclusivamente informativo e jornalístico, e não constitui recomendação de investimento nem aconselhamento financeiro, jurídico, contábil ou de engenharia, tampouco oferta ou solicitação de compra ou venda de qualquer ativo. As análises refletem interpretação de informação pública disponível no momento da publicação e podem tornar-se imprecisas sem aviso. Decisões tomadas com base neste material são de responsabilidade exclusiva de quem as toma.