article

OpenAI diz que chip Jalapeño supera a Nvidia em watt

3 min de leitura

🎬 Assista esta matéria

A OpenAI divulgou em 25 de agosto de 2026, durante a conferência Hot Chips, os primeiros números públicos do Jalapeño, seu chip próprio dedicado a inferência. Segundo a empresa, o acelerador entrega de 1,5 a 1,9 vez mais trabalho de IA por watt, em pico de throughput, do que sistemas comerciais baseados nas plataformas Blackwell e Rubin, da Nvidia.

Os testes também apontam latência ponta a ponta de 1,7 a 3,6 vez menor e desempenho de 2,1 a 4,1 vezes maior em cargas interativas, o tipo de uso típico de chatbots e agentes. Os modelos usados na comparação foram o GPT-OSS 120B, o DeepSeek R1 670B e o Kimi K2.5 1T.

O Jalapeño é um chip exclusivamente de inferência, ou seja, ele executa modelos já treinados e não participa do treinamento. A OpenAI o desenvolveu com a Broadcom como parceira de fabricação. O projeto começou em meados de 2024 e a fabricação teve início em novembro de 2025.

Os números têm ressalvas

Os resultados foram produzidos sobre o benchmark público InferenceX, da SemiAnalysis, com a OpenAI fornecendo as medições e a consultoria verificando parte das execuções presencialmente em laboratório. Ainda assim, a comparação tem limitações importantes.

A principal delas é de memória. O Jalapeño usa HBM4, mais recente, enquanto os sistemas Blackwell testados usam memória de geração anterior. O concorrente direto em pé de igualdade seria o Rubin, plataforma da Nvidia que também adota HBM4 e que já está sendo entregue a clientes. O chip da OpenAI, por sua vez, ainda está em fase de amostras de engenharia.

Há outra assimetria: os sistemas usados na comparação empregavam otimizações como predição de múltiplos tokens e decodificação especulativa, técnicas que o Jalapeño ainda não incorporou. O chip também não foi avaliado contra modelos maiores e mais recentes.

Pressão sobre as margens da Nvidia

O anúncio reforça um movimento que se acelerou em 2026: grandes compradores de computação projetando o próprio silício em vez de depender integralmente da Nvidia. Analistas ouvidos pela CNBC classificaram o Jalapeño como uma nova ameaça às margens da fabricante, hoje a fornecedora dominante de aceleradores para IA.

Para a OpenAI, a motivação é econômica antes de ser técnica. Inferência é o custo recorrente de operar produtos como o ChatGPT, e ganhos de eficiência energética se traduzem diretamente em menor custo por token servido, além de reduzir a dependência de um único fornecedor em um mercado com oferta apertada.

A empresa não informou quando o Jalapeño entra em produção em volume nem se pretende vendê-lo a terceiros.

Fontes: The Decoder · CNBC · Tom’s Hardware

🎙️ Gostou? Receba só o que te interessa, todo dia

Escolha seus temas e receba um briefing diário em áudio e texto, de graça, no WhatsApp ou e-mail.

Montar meu briefing grátis