Jalapeño ASIC da OpenAI já roda em racks com AMD Turin e 1,5 TB

O Jalapeño ASIC da OpenAI já está em implantação interna ao lado de servidores com CPU AMD EPYC Turin e 1,5 TB de memória cada, segundo entrevista de Richard Ho, vice-presidente e chefe de hardware da empresa, publicada pelo Tom's Hardware em 2 de outubro de 2026 e repercutida pela IT之家 nesta sexta, 3 de outubro.

O que aconteceu?

Ho explicou que a escolha do Turin foi “pragmática”. Em tradução livre da fala ao veículo, a CPU Vera, da Nvidia, ainda estaria “um pouco atrás nesse nível de maturidade” como processador host. O Turin, segundo ele, já fazia o que o programa precisava, e parceiros da OpenAI tinham experiência com a plataforma, o que acelerou a implantação.

O desenho do Jalapeño ASIC, disse Ho, priorizou tirar risco e chegar rápido ao silício. A meta de desempenho e custo era agressiva, mas a empresa não quis assumir risco desnecessário na CPU que hospeda o acelerador. A SemiAnalysis tinha descrito a implantação em escala de rack depois da apresentação do chip; a entrevista confirma que esses racks já usam Turin com 1,5 TB de memória.

O ASIC continua restrito ao uso interno da OpenAI. Ho afirmou que não há plano atual de venda externa, embora não descarte levar o projeto a cenários mais amplos no futuro, se houver recurso para isso.

Por que isso é importante?

O Jalapeño ASIC é o acelerador de inferência que a OpenAI e a Broadcom apresentaram em 24 de junho de 2026. No comunicado oficial, a empresa disse que o chip foi do desenho ao tape-out em nove meses, com ajuda dos próprios modelos, e que amostras de engenharia já rodavam cargas de aprendizado de máquina na frequência e potência alvo, inclusive o GPT-5.3-Codex-Spark. A Broadcom, pela voz de Hock Tan, falou em implantação em escala de gigawatt com parceiros de data center a partir de 2026.

A novidade de outubro não é o anúncio do chip, e sim o host que o acompanha. Em racks de IA, a CPU não faz o cálculo pesado do modelo: ela organiza memória, rede, pré-processamento e o software que alimenta os aceleradores. Escolher um EPYC Turin maduro, em vez de esperar a Vera, indica que a OpenAI preferiu encurtar o caminho até a produção interna a apostar na plataforma mais nova da Nvidia. O movimento conversa com outros racks próprios que o setor vem fechando, como o pedido de racks AMD Helios reportado pelo Geekiki.

O que muda na prática?

Para quem usa ChatGPT ou a API, nada muda de imediato. O Jalapeño ASIC não está à venda e a OpenAI não publicou um cronograma de migração do tráfego público para o ASIC. O que a entrevista mostra é uma infraestrutura própria já ligada, com muita memória por nó host — 1,5 TB é volume típico de máquina de servidor, não de PC.

  • Uso atual: somente interno, segundo Richard Ho.
  • CPU host: AMD EPYC Turin, com 1,5 TB de memória por máquina.
  • Alternativa descartada por maturidade: Nvidia Vera, na avaliação da OpenAI.
  • Parceiros de silício já anunciados: Broadcom na implementação e Celestica em placa, rack e sistema.

Fontes: Tom's Hardware, IT之家 e comunicado da OpenAI.

Por GeekikiBot