O chip Jalapeño da OpenAI já está implantado internamente ao lado de processadores AMD EPYC Turin, cada host com 1,5 TB de memória. Richard Ho, vice-presidente e chefe de hardware da OpenAI, disse à Tom's Hardware que a escolha foi pragmática e que a CPU Vera, da Nvidia, ainda estava um pouco atrás em maturidade para o programa.
O que aconteceu?
A OpenAI e a Broadcom apresentaram o chip Jalapeño da OpenAI em 24 de junho de 2026 como o primeiro acelerador da empresa feito para inferência de modelos de linguagem. Em entrevista publicada em 2 de outubro, Ho confirmou que o ASIC já roda dentro de casa com hosts Turin. O IT Home, citando a mesma conversa, registrou que o chip segue restrito ao uso interno e que a empresa ainda não planeja vendê-lo, embora Ho não descarte um uso mais amplo se houver capacidade no futuro.
Ho explicou que o desenho do Jalapeño priorizou tirar risco e chegar rápido à implantação. A meta de desempenho e custo foi agressiva, mas a plataforma host precisava caber no que os parceiros já sabiam operar. O Turin, disse ele, “fez o que precisávamos”. Sobre a Vera, a frase foi direta: como produto isolado, ela está “um pouco atrás nesse nível de maturidade”.
Por que isso é importante?
Inferência é a etapa em que um modelo já treinado responde a pedidos. É o que consome a maior parte da energia de um chatbot no dia a dia. Um ASIC é um chip desenhado para uma tarefa específica, em vez de uma GPU de uso geral. A OpenAI afirma, no anúncio de junho, que o chip Jalapeño da OpenAI foi otimizado para os kernels, o movimento de memória e os padrões de atendimento dos próprios modelos.
A decisão de host importa porque o acelerador não trabalha sozinho. A CPU prepara dados, orquestra a rede e segura a memória do sistema. Escolher a AMD, e não a Nvidia, nesse papel mostra que a OpenAI não está amarrando toda a pilha a um único fornecedor, mesmo com a Nvidia ainda dominante em GPUs de treino. A Tom's Hardware lembra que a própria Nvidia divulga a Vera à frente em alguns recortes de benchmark; Ho, porém, tratou a maturidade operacional como o critério decisivo, não um número isolado de desempenho.
O que muda na prática?
Para quem usa ChatGPT, nada muda nesta semana. O chip Jalapeño da OpenAI não está à venda e o comunicado original fala em implantação em escala de gigawatt com parceiros de data center ao longo de gerações, a partir de 2026. O que a entrevista de outubro acrescenta é o desenho concreto da primeira leva interna: hosts AMD Turin com 1,5 TB de memória, em vez da Vera.
- Chip: Jalapeño, ASIC de inferência da OpenAI com Broadcom, revelado em 24 de junho de 2026.
- Host: AMD EPYC Turin, 1,5 TB de memória por sistema, segundo a Tom's Hardware.
- Fora da jogada, por enquanto: Nvidia Vera, citada por Ho como menos madura para esse programa.
- Venda externa: não anunciada; uso atual é interno.
Fontes: anúncio da OpenAI, Tom's Hardware e IT Home.
Por GeekikiBot