OpenAI e Broadcom revelam chip de inferência otimizado para LLM
- Testes iniciais mostram que o acelerador de primeira geração terá um desempenho por watt substancialmente melhor do que o atual estado da arte
- Concebido de raiz para LLMs atuais e futuros em todo o setor
- Desenvolvido do desenho à produção em nove meses, com aceleração pelos modelos da OpenAI
- Expande a plataforma full-stack da OpenAI, dos produtos aos modelos e agora aos chips
- Será implementado à escala de gigawatts com parceiros de centros de dados, ao longo de várias gerações
A OpenAI e a Broadcom (NASDAQ: AVGO) apresentaram hoje o Jalapeño, o primeiro Processador de Inteligência da OpenAI: um acelerador concebido em torno da visão da OpenAI para o futuro da inferência de LLM, e o primeiro acelerador de AI numa plataforma de computação multigeração que as empresas estão a construir em conjunto para tornar a AI avançada mais rápida, mais fiável e mais acessível a mais pessoas.

O Jalapeño foi entregue ao CEO da OpenAI, Sam Altman, e ao Presidente Greg Brockman pelo Presidente e CEO da Broadcom, Hock Tan, e pelo Presidente Charlie Kawwas, assinalando um passo importante na estratégia da OpenAI para construir toda a stack que sustenta os seus modelos e produtos.
A OpenAI concebeu o chip de raiz com base no seu profundo conhecimento dos fundamentos dos LLM, orientada pelo seu roadmap de modelos, kernels, sistemas de disponibilização e necessidades de produto, com os parceiros Broadcom e Celestica a ajudarem a industrializar a plataforma através da implementação do chip, placas, integração de sistemas em rack, redes de alto desempenho e sistemas de produção escaláveis. O Jalapeño foi concebido com flexibilidade para funcionar com todos os LLM, guiado pelos insights da OpenAI sobre as necessidades de inferência dos modelos de AI atuais e futuros em todo o setor. Amostras de engenharia do chip Jalapeño estão a executar cargas de trabalho de ML em laboratório, na frequência e potência-alvo de produção, incluindo GPT‑5.3‑Codex‑Spark.
Embora a OpenAI ainda esteja a medir o desempenho final, os testes iniciais mostram que o Jalapeño terá um desempenho por watt substancialmente superior ao atual estado da arte. Será apresentado nos próximos meses um relatório técnico detalhado sobre o desempenho. A arquitetura reduz a movimentação de dados e equilibra recursos de computação, memória e redes para alcançar uma utilização real muito mais próxima do pico teórico de desempenho. A implementação em silício e as tecnologias de rede da Broadcom, incluindo o silício de rede Tomahawk, ajudam a levar a plataforma à produção em grande escala.
«O mundo está a avançar para uma economia movida pela computação», afirmou Greg Brockman, Presidente e Co-Fundador da OpenAI. «O Jalapeño faz parte da nossa estratégia de longo prazo para uma infraestrutura full-stack que torne a computação mais abundante, resultando numa AI mais rápida, mais fiável e mais acessível para pessoas e empresas, e que possa ser usada para resolver problemas mais importantes. Ao concebermos internamente uma parte maior da stack, conseguimos disponibilizar mais inteligência com maior eficiência e continuar a levar a AI avançada a um acesso mais amplo.»
«O Jalapeño foi concebido de raiz para inferência de LLM, usando insights detalhados da nossa colaboração próxima com investigadores da OpenAI», afirmou Richard Ho, que lidera o programa de hardware da OpenAI. «Otimizámos a arquitetura em torno dos kernels, da movimentação de memória, das redes e dos padrões de disponibilização mais importantes para modelos de AI de fronteira. Com base nos testes iniciais, o Jalapeño executará de forma eficiente as nossas cargas de trabalho mais importantes, perto dos limites teóricos do hardware.»
«A nossa colaboração com a OpenAI representa um compromisso fundamental com a expansão da infraestrutura física necessária para a próxima década de AI», afirmou Hock Tan, Presidente e CEO da Broadcom. «Isto é apenas o início de um roadmap multigeração. Ao desenvolvermos em conjunto o nosso silício líder no setor diretamente com a OpenAI, estamos a permitir a implementação de centros de dados à escala de gigawatts com a Microsoft e outros parceiros a partir de 2026.»
O Jalapeño é um projeto de raiz para a inferência moderna de LLM, não um acelerador genérico adaptado de cargas de trabalho de AI anteriores. A sua conceção baseia-se nos sistemas que a OpenAI opera todos os dias no ChatGPT, no Codex, na API e em futuros produtos com agentes, ao mesmo tempo que foi pensada para LLMs atuais e futuros em todo o setor. O objetivo é combinar a potência e a taxa de processamento dos principais aceleradores de AI atuais com uma latência mais próxima da dos sistemas especializados de inferência mais rápidos, tornando o Jalapeño adequado a produtos de LLM interativos à escala.
É essa a vantagem de controlar toda a stack. A OpenAI não está apenas a desenvolver modelos de fronteira ou a criar produtos com base neles; está a desenhar a infraestrutura subjacente: arquitetura de chips, kernels, sistemas de memória, redes, escalonamento, sistemas de implementação e experiência de produto. Como a OpenAI atua em toda a stack, cada camada pode ser otimizada em torno do mesmo objetivo: tornar os seus modelos mais rápidos, mais fiáveis e mais acessíveis para os utilizadores.
O Jalapeño reforça o ciclo virtuoso que impulsiona o progresso da OpenAI. Uma melhor infraestrutura aumenta a eficiência da computação. Uma maior eficiência da computação permite melhor treino e disponibilização, alimentando em última análise modelos de AI mais capazes. Melhores modelos tornam-se melhores produtos para pessoas, programadores e empresas. Melhores produtos geram mais utilização, mais clientes e mais receita, permitindo à OpenAI reinvestir na próxima geração de infraestrutura. Com o tempo, esse ciclo ajuda a tornar a inteligência mais capaz, mais fiável e menos dispendiosa para todos.
O Jalapeño foi codesenvolvido desde o desenho inicial até ao tape-out para fabrico em apenas nove meses, e o programa de acelerador de AI personalizado representa aquilo que acreditamos ser o ciclo de desenvolvimento de ASIC mais rápido alguma vez alcançado em semicondutores avançados de alto desempenho. Essa rapidez reflete um profundo desenvolvimento conjunto de software e hardware com as equipas de engenharia da OpenAI, a especialização da Broadcom em implementação de silício e a utilização de modelos da OpenAI para acelerar partes do processo de desenho e otimização.
Os mesmos modelos disponibilizados aos utilizadores estão a ajudar a melhorar a infraestrutura usada para executar modelos futuros. Se a AI puder ajudar os engenheiros a desenhar chips melhores mais rapidamente, pode reduzir o custo da computação em todo o setor e ajudar a democratizar o acesso à AI avançada.
O Jalapeño é o primeiro passo numa plataforma de computação multigeração concebida para implementação inicial até ao final de 2026 e expansão nos anos seguintes, combinando aceleradores desenhados pela OpenAI com implementação em silício, redes e tecnologias de conectividade da Broadcom; e a experiência da Celestica em placas, racks e sistemas.
O objetivo deste trabalho é simples: é na inferência que a AI chega às pessoas. Cada melhoria no custo, na velocidade e na fiabilidade pode traduzir-se numa resposta mais rápida do ChatGPT, numa tarefa do Codex que consegue dar mais passos com menos espera, num produto de API mais barato de criar ou num acesso mais fiável quando a procura é elevada.
Democratizar a AI significa disponibilizar modelos avançados de forma suficientemente acessível, fiável e comportável para que mais pessoas os usem todos os dias. O Jalapeño ajuda a OpenAI a transformar mais da sua infraestrutura em inteligência útil para estudantes, programadores, pequenas empresas, investigadores, grandes empresas e qualquer pessoa que esteja a tentar aprender, criar ou resolver problemas difíceis.


