OpenAI và Broadcom trình làng chip suy luận tối ưu hóa cho LLM
- Thử nghiệm ban đầu cho thấy bộ tăng tốc thế hệ đầu tiên sẽ mang lại hiệu năng trên mỗi watt vượt trội đáng kể so với công nghệ tiên tiến nhất hiện nay
- Được xây dựng từ đầu cho các LLM hiện tại và tương lai trong toàn ngành
- Quy trình phát triển từ thiết kế đến sản xuất diễn ra tốc độ trong chín tháng nhờ mô hình của OpenAI
- Mở rộng nền tảng full-stack của OpenAI, từ sản phẩm đến mô hình và nay là chip
- Sẽ được triển khai ở quy mô gigawatt cùng các đối tác trung tâm dữ liệu, qua nhiều thế hệ
OpenAI và Broadcom (NASDAQ: AVGO) hôm nay ra mắt Jalapeño, Bộ xử lý Trí tuệ đầu tiên của OpenAI: một bộ tăng tốc được kiến trúc xoay quanh tầm nhìn của OpenAI về tương lai của suy luận LLM, đồng thời là bộ tăng tốc AI đầu tiên trong nền tảng điện toán nhiều thế hệ mà hai công ty đang cùng xây dựng để giúp AI tiên tiến nhanh hơn, đáng tin cậy hơn và dễ tiếp cận hơn với nhiều người hơn.

Jalapeño đã được Chủ tịch kiêm Giám đốc điều hành Broadcom là Hock Tan và Chủ tịch Charlie Kawwas trao cho Giám đốc điều hành OpenAI là Sam Altman và Chủ tịch Greg Brockman, đánh dấu một bước quan trọng trong chiến lược của OpenAI nhằm xây dựng toàn bộ stack đứng sau các mô hình và sản phẩm của mình.
OpenAI đã thiết kế chip này từ con số khôngdựa trên sự am hiểu sâu sắc về các nguyên lý cốt lõi của LLM, được định hướng bởi lộ trình phát triển mô hình, nhân tính toán (kernels), hệ thống máy chủ vận hành (serving systems) và nhu cầu sản phẩm của chính mình, cùng các đối tác Broadcom và Celestica, những đơn vị hỗ trợ công nghiệp hóa nền tảng thông qua triển khai chip, bo mạch,tích hợp hệ thống tủ rack, mạng hiệu năng cao và hệ thống sản xuất có quy mô lớn. Jalapeño được thiết kế linh hoạt để hoạt động với mọi LLM, dựa trên những hiểu biết của OpenAI về nhu cầu suy luận của các mô hình AI hiện tại và tương lai trong toàn ngành. Các chip mẫu thử nghiệm (engineering samples) của Jalapeño đang chạy các tác vụ học máy (ML) trong phòng thí nghiệm đạt mức tần số và điện năng mục tiêu sản xuất thương mại, bao gồm cả mô hình GPT‑5.3‑Codex‑Spark.
Dù OpenAI vẫn đang đo hiệu năng cuối cùng, thử nghiệm ban đầu cho thấy Jalapeño sẽ mang lại hiệu năng trên mỗi watt vượt trội đáng kể so với công nghệ tiên tiến nhất hiện nay. Một báo cáo kỹ thuật chi tiết về hiệu năng sẽ được trình bày trong những tháng tới. Kiến trúc này giảm chuyển dịch dữ liệu và cân bằng tài nguyên tính toán, bộ nhớ và mạng để đạt mức sử dụng thực tế gần hơn nhiều với hiệu năng đỉnh lý thuyết. Công nghệ triển khai silicon và mạng của Broadcom, bao gồm silicon mạng Tomahawk, giúp đưa nền tảng vào sản xuất quy mô lớn.
“Thế giới đang chuyển sang một nền kinh tế được thúc đẩy bởi điện toán,” Greg Brockman, Chủ tịch kiêm Đồng sáng lập OpenAI, cho biết. “Jalapeño là một phần trong chiến lược hạ tầng full-stack dài hạn của chúng tôi nhằm làm cho điện toán dồi dào hơn, từ đó tạo ra AI nhanh hơn, đáng tin cậy hơn, hợp túi tiền hơn cho mọi người và doanh nghiệp, đồng thời có thể được dùng để giải quyết nhiều vấn đề quan trọng hơn. Khi tự tay thiết kế nhiều phần của stack hơn, chúng tôi có thể cung cấp nhiều trí tuệ hơn với hiệu quả cao hơn và tiếp tục thúc đẩy AI tiên tiến để nhiều người tiếp cận hơn.”
“Jalapeño được thiết kế từ đầu cho suy luận LLM, dựa trên những phân tích chuyên sâu rút ra từ quá trình hợp tác chặt chẽ của chúng tôi với các nhà nghiên cứu OpenAI,” Richard Ho, người dẫn dắt chương trình phần cứng của OpenAI, cho biết. “Chúng tôi đã tối ưu hóa kiến trúc xoay quanh các kernel, quá trình dịch chuyển bộ nhớ, hệ thống mạng và các mô hình vận hành máy chủ (serving patterns) vốn đóng vai trò quan trọng nhất đối với các mô hình AI tiên phong. Dựa trên thử nghiệm ban đầu, Jalapeño sẽ thực thi hiệu quả các tác vụ quan trọng nhất của chúng tôi ở mức tiệm cận các giới hạn lý thuyết của phần cứng.”
“Sự hợp tác của chúng tôi với OpenAI thể hiện cam kết nền tảng trong việc mở rộng hạ tầng vật lý cần thiết cho thập kỷ AI tiếp theo,” Hock Tan, Chủ tịch kiêm Giám đốc điều hành Broadcom, cho biết. “Đây mới chỉ là khởi đầu của một lộ trình nhiều thế hệ. Bằng cách cùng OpenAI đồng phát triển trực tiếp silicon dẫn đầu ngành của mình, chúng tôi đang cho phép triển khai các trung tâm dữ liệu ở quy mô gigawatt cùng Microsoft và các đối tác khác từ năm 2026.”
Jalapeño là thiết kế hoàn toàn mới ho các tác vụ suy luận LLM hiện đại, chứ không phải bộ tăng tốc đa năng được cải tiến từ các tác vụ AI thế hệ trước. Thiết kế này được định hướng bởi các hệ thống mà OpenAI vận hành hằng ngày trên ChatGPT, Codex, API và các sản phẩm tự trị mang tính tác nhân trong tương lai, đồng thời cũng được thiết kế để tương thích với các LLM hiện tại và sắp tới của toàn ngành. Mục tiêu là kết hợp sức mạnh và thông lượng của các bộ tăng tốc AI hàng đầu hiện nay với độ trễ tiệm cận các hệ thống suy luận chuyên dụng nhanh nhất, giúp Jalapeño trở thành lựa chọn phù hợp với các sản phẩm LLM có tính tương tác ở quy mô lớn.
Đó chính là lợi thế của việc làm chủ toàn diện từ phần cứng đến phần mềm. OpenAI không chỉ phát triển các mô hình tiên phong hay xây dựng sản phẩm trên các mô hình đó; công ty còn thiết kế hạ tầng bên dưới chúng: kiến trúc chip, kernel, hệ thống bộ nhớ, mạng, lập lịch, hệ thống triển khai và trải nghiệm sản phẩm. Chính vì OpenAI vận hành trên toàn bộ cấu trúc hệ thống, từng lớp một đều có thể được tối ưu hóa xoay quanh cùng một mục tiêu chung: giúp mô hình hoạt động nhanh hơn, đáng tin cậy hơn và có chi phí hợp lý hơn cho người dùng.
Jalapeño củng cố bánh đà thúc đẩy tiến bộ của OpenAI. Hạ tầng tốt hơn sẽ tăng cường hiệu suất điện toán. Hiệu suất điện toán cao hơn cho phép huấn luyện và phục vụ tốt hơn, cuối cùng tạo nền tảng cho các mô hình AI mạnh mẽ hơn. Mô hình tốt hơn trở thành sản phẩm tốt hơn cho mọi người, nhà phát triển và doanh nghiệp. Sản phẩm tốt hơn thúc đẩy mức sử dụng, thu hút nhiều khách hàng và mang lại doanh thu lớn hơn, giúp OpenAI tái đầu tư vào thế hệ hạ tầng tiếp theo. Theo thời gian, chu kỳ đó giúp trí tuệ nhân tạo trở nên thông minh hơn, đáng tin cậy hơn và ít tốn kém hơn cho tất cả mọi người.
Jalapeño được đồng phát triển từ thiết kế ban đầu đến tape-out sản xuất chỉ trong chín tháng, và chương trình bộ tăng tốc AI tùy chỉnh này đại diện cho điều chúng tôi tin là chu kỳ phát triển ASIC nhanh nhất từng đạt được trong lĩnh vực bán dẫn tiên tiến hiệu năng cao. Tốc độ đó phản ánh quá trình đồng phát triển phần mềm-phần cứng sâu sắc với các đội ngũ kỹ thuật của OpenAI, chuyên môn triển khai silicon của Broadcom, cũng như việc dùng các mô hình OpenAI để tăng tốc một số phần của quy trình thiết kế và tối ưu hóa.
Chính những mô hình phục vụ người dùng cũng đang giúp cải thiện hạ tầng dùng để vận hành các mô hình tương lai. Nếu AI có thể giúp kỹ sư thiết kế chip tốt hơn nhanh hơn, nó có thể giảm chi phí điện toán trên toàn ngành và giúp dân chủ hóa khả năng tiếp cận AI tiên tiến.
Jalapeño là bước đầu tiên trong một nền tảng điện toán nhiều thế hệ, được thiết kế để triển khai ban đầu vào cuối năm 2026 và mở rộng trong những năm sau đó, kết hợp các bộ tăng tốc do OpenAI thiết kế với công nghệ triển khai silicon, mạng và kết nối của Broadcom; cùng chuyên môn về bo mạch, rack và hệ thống của Celestica.
Mục tiêu của công việc này rất đơn giản: suy luận là nơi AI đến với mọi người. Mọi cải thiện về chi phí, tốc độ và độ tin cậy đều có thể thể hiện thành câu trả lời ChatGPT nhanh hơn, một tác vụ Codex có thể thực hiện nhiều bước hơn với ít thời gian chờ hơn, một sản phẩm API rẻ hơn để xây dựng, hoặc khả năng truy cập đáng tin cậy hơn khi nhu cầu tăng cao.
Dân chủ hóa AI nghĩa là làm cho các mô hình tiên tiến đủ sẵn có, đáng tin cậy và hợp túi tiền để nhiều người hơn có thể sử dụng hằng ngày. Jalapeño giúp OpenAI biến nhiều phần hạ tầng của mình hơn thành trí tuệ hữu ích cho học sinh, sinh viên, nhà phát triển, doanh nghiệp nhỏ, nhà nghiên cứu, doanh nghiệp lớn và bất kỳ ai đang cố gắng học hỏi, sáng tạo hoặc giải quyết các vấn đề khó.


