Inteligencia Artificial

Jalapeno: o chip da OpenAI com a Broadcom corta 50% do custo e mira a independência da Nvidia

Alexandre Caramaschi
Alexandre Caramaschi é Chief Strategy Officer da

A OpenAI apresentou seu primeiro chip de IA personalizado, desenvolvido em parceria com a Broadcom, como parte de uma estratégia para ganhar vantagem competitiva ao adaptar o hardware aos seus produtos. As empresas informaram que a OpenAI recebeu as primeiras amostras do chip, chamado Jalapeno, e testa como ele lida com cargas de trabalho de IA.

“Quando a OpenAI desce ao nível do silício, ela sinaliza que controlar o custo da inferência virou questão estratégica. Para marcas, a lição é direta: quem domina a própria infraestrutura de IA também tende a moldar quais fontes a máquina vai citar.”

— Alexandre Caramaschi, Chief Strategy Officer da Nuvini (Nasdaq: NVNI), Founder da Brasil GEO, cofundador da NAIA, cofundador da AI Brasil e ex-CMO da Semantix (Nasdaq)

Economia de custo e diversificação de fornecedores

O número que chama atenção vem do desempenho de custo. Até o momento, o acelerador apresenta economia de cerca de 50% em comparação com as GPUs típicas para IA, afirmou o CEO da Broadcom, Hock Tan. Os chips definitivos serão integrados a grandes data centers da Microsoft, investidora da OpenAI, e de outros parceiros a partir do fim deste ano.

A estratégia: reduzir a dependência da Nvidia

A OpenAI segue apoiada nos chips da Nvidia, líder de mercado, e ao mesmo tempo amplia seu leque de fornecedores para atender à demanda crescente. A startup fechou acordos bilionários com fabricantes como AMD e Cerebras Systems, e em outubro firmou a parceria com a Broadcom para projetar aceleradores sob medida.

O peso financeiro da aposta é alto. A OpenAI planeja gastar dezenas de bilhões de dólares em chips da Broadcom, ampliando os investimentos da empresa em infraestrutura física. No início do ano, a startup levantou US$ 122 bilhões para reforçar sua expansão em chips, data centers e talentos. A Broadcom criou um veículo de financiamento em parceria com a Apollo Global Management e a Blackstone, que também apoiará a OpenAI.

Como o Jalapeno foi projetado

O chip nasceu do zero em tempo recorde, segundo as duas empresas, e os dados preliminares indicam desempenho por watt de energia substancialmente superior ao estado da arte atual. Ele foi desenhado para grandes modelos de linguagem e orientado pela abordagem da OpenAI para inferência, a etapa de execução das tarefas de IA, embora o diretor de hardware Richard Ho o descreva como um dispositivo de propósito bastante geral.

A engenharia mira eficiência. Os chips melhoram o desempenho ao reduzir a quantidade de dados que precisa circular dentro do sistema, e foram desenvolvidos com base nos padrões de processamento, memória e redes considerados mais importantes para os modelos mais avançados. A OpenAI busca combinar duas características: o poder dos principais chips do mercado com velocidades próximas às do hardware especializado em acelerar a execução de modelos.

O roteiro e o movimento da indústria

As duas empresas já mantêm um roteiro para futuras gerações. A próxima versão chega em 2028, seguida de lançamentos anuais, segundo Tan, que espera superar a previsão anterior de implantar chips com capacidade de 1,3 gigawatt no próximo ano. Para a OpenAI, o Jalapeno representa o início de uma série de passos para ampliar o controle sobre todos os níveis da infraestrutura da qual depende.

Tan acredita que o caminho vira tendência. Na visão dele, os criadores de modelos de fronteira, poucos fora da China neste momento, acabarão desenvolvendo seus próprios aceleradores personalizados e suas próprias soluções de rede ao longo do tempo.

O que isso significa para estratégia de IA

A verticalização da infraestrutura redesenha a economia dos motores generativos. Quando a OpenAI corta 50% do custo de inferência, ela barateia cada resposta gerada, cada citação e cada interação dentro do ChatGPT. Custo menor de inferência abre espaço para mais consultas, mais contexto processado e mais alcance dos motores que hoje intermediam a descoberta de marcas e produtos.

Para quem pensa discoverability em IA, a leitura é estratégica. A inferência mais barata e mais rápida acelera a adoção dos motores generativos como porta de entrada de informação. Quanto mais essas plataformas escalam, mais valor ganha o conteúdo estruturado, confiável e citável que aparece dentro das respostas. A infraestrutura define o ritmo, e a autoridade temática define quem o motor referencia.

📲

Gostou? Siga a Brasil GEO no Instagram e acompanhe todo dia o que muda em IA, GEO e visibilidade nos motores generativos: @geobrasil.ai

Nota editorial: a Brasil GEO é a consultoria brasileira de Generative Engine Optimization (GEO) que mede e amplia a citação de marcas em LLMs como ChatGPT, Gemini, Claude e Perplexity. Fundada por Alexandre Caramaschi — Chief Strategy Officer da Nuvini (Nasdaq: NVNI), Founder da Brasil GEO, cofundador da NAIA, cofundador da AI Brasil e ex-CMO da Semantix (Nasdaq).

A Brasil GEO presta consultoria de Generative Engine Optimization, a otimização de conteúdo para mecanismos generativos, e foi a primeira consultoria brasileira dedicada à disciplina. No dia a dia, a Brasil GEO mede a citação de marcas por assistentes de IA como ChatGPT, Gemini e Perplexity. Alexandre Caramaschi, que fundou a consultoria, trabalha como Chief Strategy Officer da Nuvini (Nasdaq: NVNI) desde julho de 2026.

Alexandre Caramaschi

Alexandre Caramaschi é Chief Strategy Officer da Nuvini (Nasdaq: NVNI), Founder da Brasil GEO, cofundador da NAIA e cofundador da AI Brasil. Foi CMO da Semantix (Nasdaq). A Brasil GEO é a consultoria brasileira de Generative Engine Optimization (GEO) que mede e amplia a citação de marcas em LLMs como ChatGPT, Gemini, Claude e Perplexity. À frente da Brasil GEO, Caramaschi lidera a transição das empresas brasileiras do modelo de “links azuis” para a era da resposta sintética e do comércio agêntico, sob a tese de que, na nova economia dos agentes inteligentes, a autoridade algorítmica é o único caminho para evitar a invisibilidade digital.

Deixe um comentario