Pular para o conteúdo principal
OpenAI

24 de junho de 2026

Empresa

OpenAI e Broadcom apresentam chip de inferência otimizado para LLM

Carregando…
  • Testes iniciais mostram que o acelerador de primeira geração entregará desempenho por watt substancialmente melhor que o estado da arte atual
  • Criado do zero para LLMs atuais e futuros em toda a indústria
  • Desenvolvido do design à produção em nove meses, com aceleração pelos modelos da OpenAI
  • Expande a plataforma full-stack da OpenAI, de produtos a modelos e agora a chips
  • Será implantado em escala de gigawatts com parceiros de data center, ao longo de várias gerações

A OpenAI e a Broadcom (NASDAQ: AVGO) apresentaram hoje o Jalapeño, o primeiro Processador de Inteligência da OpenAI: um acelerador arquitetado em torno da visão da OpenAI para o futuro da inferência de LLM e o primeiro acelerador de AI em uma plataforma de computação multigeracional que as empresas estão construindo juntas para tornar a AI avançada mais rápida, confiável e acessível a mais pessoas.

Líderes da OpenAI e da Broadcom exibem o chip de inferência Jalapeño.

O Jalapeño foi entregue ao CEO da OpenAI, Sam Altman, e ao presidente Greg Brockman pelo presidente e CEO da Broadcom, Hock Tan, e pelo presidente Charlie Kawwas, marcando um passo importante na estratégia da OpenAI de construir todo o stack por trás de seus modelos e produtos.

A OpenAI projetou o chip do zero com base em seu profundo entendimento dos fundamentos de LLMs, orientada por seu roadmap de modelos, kernels, sistemas de serving e necessidades de produto, com os parceiros Broadcom e Celestica, que ajudam a industrializar a plataforma por meio da implementação do chip, placa, integração de sistemas em rack, redes de alto desempenho e sistemas de produção escaláveis. O Jalapeño foi projetado com flexibilidade para funcionar com todos os LLMs, guiado pelos insights da OpenAI sobre as necessidades de inferência de modelos de AI atuais e futuros em toda a indústria. Amostras de engenharia do chip Jalapeño estão executando workloads de ML no laboratório, na frequência e potência-alvo de produção, incluindo GPT‑5.3‑Codex‑Spark.

Embora a OpenAI ainda esteja medindo o desempenho final, testes iniciais mostram que o Jalapeño entregará desempenho por watt substancialmente melhor que o estado da arte atual. Um relatório técnico detalhado sobre desempenho será apresentado nos próximos meses. A arquitetura reduz a movimentação de dados e equilibra recursos de computação, memória e rede para alcançar uma utilização efetiva muito mais próxima do pico teórico de desempenho. A implementação de silício e as tecnologias de rede da Broadcom, incluindo o silício de rede Tomahawk, ajudam a levar a plataforma à produção em larga escala.

“O mundo está migrando para uma economia movida por computação”, disse Greg Brockman, presidente e cofundador da OpenAI. “O Jalapeño faz parte de nossa estratégia de infraestrutura full-stack de longo prazo para tornar a computação mais abundante, resultando em uma AI mais rápida, mais confiável e mais acessível para pessoas e empresas, que possa ser usada para resolver problemas mais importantes. Ao projetarmos mais partes do stack por conta própria, podemos oferecer mais inteligência com maior eficiência e continuar ampliando o acesso à AI avançada.”

“O Jalapeño foi projetado do zero para inferência de LLM usando insights detalhados de nossa colaboração próxima com pesquisadores da OpenAI”, disse Richard Ho, que lidera o programa de hardware da OpenAI. “Otimizamos a arquitetura em torno dos kernels, da movimentação de memória, das redes e dos padrões de serving mais importantes para modelos de AI de fronteira. Com base em testes iniciais, o Jalapeño executará com eficiência nossos workloads mais importantes, perto dos limites teóricos do hardware.”

“Nossa colaboração com a OpenAI representa um compromisso fundamental com a expansão da infraestrutura física necessária para a próxima década de AI”, disse Hock Tan, presidente e CEO da Broadcom. “Este é apenas o começo de um roadmap multigeracional. Ao codesenvolvermos nosso silício líder do setor diretamente com a OpenAI, estamos viabilizando a implantação de data centers em escala de gigawatts com a Microsoft e outros parceiros a partir de 2026.”

Projetado para ser a melhor plataforma de inferência para LLMs

O Jalapeño é um design criado do zero para a inferência moderna de LLM, não um acelerador de propósito geral adaptado de workloads de AI anteriores. Ele se baseia nos sistemas que a OpenAI opera todos os dias no ChatGPT, no Codex, na API e em futuros produtos agênticos, além de ser projetado para LLMs atuais e futuros em toda a indústria. O objetivo é combinar a potência e a taxa de processamento dos principais aceleradores de AI atuais com latência mais próxima dos sistemas especializados de inferência mais rápidos, tornando o Jalapeño adequado para produtos interativos de LLM em escala.

Essa é a vantagem full-stack. A OpenAI não está apenas desenvolvendo modelos de fronteira ou criando produtos sobre eles; está projetando a infraestrutura que os sustenta: arquitetura de chips, kernels, sistemas de memória, redes, escalonamento, sistemas de implantação e experiência do produto. Como a OpenAI opera em todo o stack, cada camada pode ser otimizada em torno do mesmo objetivo: tornar seus modelos mais rápidos, mais confiáveis e mais acessíveis para os usuários.

O Jalapeño fortalece o ciclo virtuoso por trás do progresso da OpenAI. Uma infraestrutura melhor impulsiona a eficiência computacional. Maior eficiência computacional permite melhor treinamento e serving, alimentando, em última instância, modelos de AI mais capazes. Modelos melhores se tornam produtos melhores para pessoas, desenvolvedores e empresas. Produtos melhores geram mais uso, mais clientes e mais receita, o que permite à OpenAI reinvestir na próxima geração de infraestrutura. Com o tempo, esse ciclo ajuda a tornar a inteligência mais capaz, mais confiável e menos cara para todos.

Tape-out em nove meses, acelerado por modelos da OpenAI

O Jalapeño foi codesenvolvido do design inicial ao tape-out de fabricação em apenas nove meses, e o programa de acelerador de AI personalizado representa o que acreditamos ser o ciclo de desenvolvimento de ASIC mais rápido já alcançado em semicondutores avançados de alto desempenho. Essa velocidade reflete um codesenvolvimento profundo entre software e hardware com as equipes de engenharia da OpenAI, a expertise da Broadcom em implementação de silício e o uso de modelos da OpenAI para acelerar partes do processo de design e otimização.

Os mesmos modelos servidos aos usuários estão ajudando a melhorar a infraestrutura usada para executar modelos futuros. Se a AI pode ajudar engenheiros a projetar chips melhores mais rapidamente, ela pode reduzir o custo da computação em toda a indústria e ajudar a democratizar o acesso à AI avançada.

Construindo uma plataforma multigeracional com parceiros

O Jalapeño é o primeiro passo em uma plataforma de computação multigeracional projetada para implantação inicial até o fim de 2026 e expansão nos anos seguintes, combinando aceleradores projetados pela OpenAI com implementação de silício, redes e tecnologias de conectividade da Broadcom; e a expertise da Celestica em placas, racks e sistemas.

Tornando a AI avançada mais amplamente disponível

O propósito deste trabalho é simples: a inferência é onde a AI chega às pessoas. Cada melhoria em custo, velocidade e confiabilidade pode aparecer como uma resposta mais rápida do ChatGPT, uma tarefa do Codex que consegue avançar mais etapas com menos espera, um produto de API mais barato de criar ou um acesso mais confiável quando a demanda é alta.

Democratizar a AI significa tornar modelos avançados disponíveis, confiáveis e acessíveis o suficiente para que mais pessoas os usem todos os dias. O Jalapeño ajuda a OpenAI a transformar mais de sua infraestrutura em inteligência útil para estudantes, desenvolvedores, pequenas empresas, pesquisadores, grandes empresas e qualquer pessoa que esteja tentando aprender, criar ou resolver problemas difíceis.

Autoria

OpenAI