História
agosto 25, 2026

Chip Jalapeño da OpenAI mira a Nvidia, mas dependência ainda não acabou

A OpenAI diz que seu primeiro chip de inferência personalizado oferece grandes ganhos em velocidade e eficiência energética. Ainda assim, o Jalapeño não treina modelos, a implantação será limitada inicialmente, e a Nvidia continuará central nos planos de computação da OpenAI.

O Jalapeño da OpenAI é uma tentativa direta de afrouxar o domínio da Nvidia sobre o boom da IA: um chip criado para tornar as respostas de modelos mais rápidas e baratas. Mas a promissora estreia em benchmarks da empresa ainda não é uma declaração de independência em hardware.

Anunciado pela primeira vez em outubro passado e desenvolvido com a Broadcom, o Jalapeño foi apresentado na terça-feira na Hot Chips como o primeiro processador de inferência personalizado da OpenAI. Testes no benchmark InferenceX da SemiAnalysis o colocam à frente dos sistemas disponíveis em taxa de transferência por quilowatt e velocidade de resposta, incluindo uma comparação com a Nvidia Blackwell. Richard Ho, chefe de hardware da OpenAI, chamou os resultados de “um avanço de desempenho muito, muito significativo em relação ao estado da arte.”

O próprio relato da OpenAI apresenta o caso de forma mais ampla: em GPT-OSS 120B, DeepSeek R1 e Kimi K2.5 1T, a empresa afirma que o Jalapeño entregou de 1,5 a 1,9 vez mais trabalho por watt em pico de taxa de transferência e de 1,7 a 3,6 vezes menor latência de ponta a ponta do que os sistemas de comparação. A vantagem alegada se apoia em adaptar o chip, a memória, a rede e o software de serving às distintas fases de prefill e decode da inferência de modelos de linguagem, reduzindo movimentação de dados e atrasos.

Essa abordagem de pilha completa é o prêmio estratégico. A OpenAI diz que, ao possuir mais da infraestrutura, obtém maior controle sobre a economia de servir modelos, ao mesmo tempo em que preserva um amplo portfólio de fornecedores que inclui Microsoft, Nvidia, AMD, AWS, Broadcom e outros. Em outras palavras, o Jalapeño é alavancagem — não um plano de substituição total.

Os limites são claros. O chip é projetado para inferência, não para o treinamento de modelos de fronteira, deixando a OpenAI dependente da Nvidia e de outros fornecedores para a imensa expansão de computação que vem pela frente. “Vamos precisar de muita computação”, disse Ho. “E o Jalapeño faz parte disso. O Cerberus faz parte disso. A Nvidia faz parte disso. A AMD faz parte disso.”

A OpenAI diz que a implantação começará de forma limitada antes de escalar por meio de gerações posteriores. O teste decisivo será saber se esses resultados de laboratório se sustentam na produção em larga escala — enquanto chips rivais continuam avançando.