Mở rộng biên giá-hiệu năng với GPT‑5.6
Bằng cách nâng cao hiệu quả ở mọi lớp, OpenAI mang lại hiệu năng cao hơn trên mỗi đô la cho nhiều loại công việc doanh nghiệp hơn.
Hôm qua, chúng tôi đã chia sẻ cách GPT‑5.6 góp phần giúp chính nó vận hành hiệu quả hơn. Hôm nay, chúng tôi chuyển những lợi ích đó đến khách hàng bằng cách giảm giá GPT‑5.6 Luna(mở trong cửa sổ mới) và Terra(mở trong cửa sổ mới), đồng thời tăng tốc GPT‑5.6 Sol trong API. Kết hợp lại, các cập nhật này giúp khách hàng thu được nhiều giá trị hơn từ mỗi đô la đầu tư vào AI và hành động nhanh hơn khi thời gian là yếu tố then chốt.
Từ hôm nay, GPT‑5.6 Luna, mô hình nhanh nhất và có giá phải chăng nhất của chúng tôi, sẽ giảm giá 80%; còn GPT‑5.6 Terra, mô hình cân bằng cho công việc hằng ngày, sẽ giảm giá 20%. Mức giá thấp hơn của Luna và Terra cũng được áp dụng vào cách tính mức sử dụng trong các gói đăng ký trả phí khi dùng Codex và ChatGPT Công việc. Luna mang đến cho doanh nghiệp một phương án tiết kiệm chi phí hơn nhiều để xử lý khối lượng công việc lớn với chất lượng rất cao. Mô hình có thể sử dụng công cụ và hoàn thành quy trình nhiều bước, qua đó giúp nhiều ứng dụng AI hơn có thể được triển khai trên quy mô lớn.
Giúp trí tuệ tiên tiến trở nên dồi dào và phải chăng hơn là trọng tâm trong sứ mệnh của OpenAI nhằm bảo đảm AGI mang lại lợi ích cho toàn nhân loại. Những thay đổi này biến cam kết đó thành hành động thực tế. Chúng phản ánh nhiều năm cải tiến trong cách chúng tôi xây dựng, cung cấp và đưa các mô hình vào thực tiễn.
Chúng tôi cũng ra mắt Chế độ nhanh trong API để thay thế dịch vụ Xử lý ưu tiên. Với GPT‑5.6 Sol, Chế độ nhanh hiện đạt tốc độ nhanh hơn tối đa 2,5 lần so với xử lý Tiêu chuẩn với mức giá gấp đôi mà không làm thay đổi độ thông minh. Chế độ nhanh tương thích ngược: các yêu cầu được gắn thẻ priority sẽ tự động sử dụng Chế độ nhanh.
Sử dụng AI hiệu quả bắt đầu từ kết quả mong muốn. Mức độ hệ trọng, tổn thất do sai sót, tính cấp bách và quy mô quyết định sự cân bằng phù hợp giữa độ thông minh, tốc độ, độ tin cậy và chi phí. Sự cân bằng đó có thể thay đổi qua từng bước của quy trình.
GPT‑5.6 mang lại cho doanh nghiệp nhiều dư địa hơn để tối ưu hóa bài toán này. Luna đạt hiệu năng tương đương các mô hình thuộc nhóm tiên phong cách đây một năm, với chi phí mỗi tác vụ chỉ khoảng 6 xu trên mỗi đô la và tốc độ nhanh gần gấp chín lần. Với công việc chuyên môn được đo bằng Agents’ Last Exam, Luna vượt Fable 5 trong khi chi phí ước tính cho mỗi tác vụ thấp hơn gần 99%.
Trong thực tế, doanh nghiệp có thể xác định kết quả và tiêu chuẩn chất lượng cần đạt, sau đó dùng các bài đánh giá để tìm ra nơi độ thông minh bổ sung giúp cải thiện đáng kể kết quả và nơi xử lý nhanh hơn, chi phí thấp hơn vẫn mang lại chất lượng tương đương. Ví dụ, một quy trình lập trình có thể dùng Sol để giải quyết những điểm chưa chắc chắn và lập kế hoạch, rồi dùng Luna để triển khai các thay đổi đã được mô tả rõ, viết và chạy kiểm thử cũng như đánh giá kết quả. Một quy trình khác có thể cần cách cân bằng khác.
Dòng GPT‑5.6 mở rộng phạm vi lựa chọn đó. Doanh nghiệp có thể áp dụng mức độ thông minh hữu ích tối đa ở từng giai đoạn, đồng thời trả mức giá phù hợp với giá trị được tạo ra.
Để mang lại sự linh hoạt đó, trước hết cần nâng cao hiệu quả của mọi lớp công nghệ phía sau các mô hình.
Lợi thế về hiệu quả của chúng tôi đến từ việc cải tiến các mô hình, hệ thống suy luận vận hành chúng và hệ thống điều khiển tác nhân kết nối chúng với công cụ cùng ngữ cảnh. Các mô hình GPT‑5.6 xử lý công việc theo hướng trực tiếp hơn. Khả năng định tuyến tốt hơn giúp phần cứng hoạt động hiệu quả, phần mềm sản xuất được tối ưu hóa giúp tạo token hiệu quả hơn, còn việc quản lý ngữ cảnh thông minh hơn giúp các tác nhân tránh lặp lại công việc đã hoàn thành. Nhờ kết hợp các cải tiến này, chúng tôi có thể hoàn thành nhiều công việc hữu ích hơn với cùng năng lực điện toán, qua đó giảm thời gian, số token và chi phí cần thiết cho mỗi kết quả.
GPT‑5.6 Sol ngày càng giúp chúng tôi tìm ra và hiện thực hóa đợt cải tiến tiếp theo. Trong một quy trình do con người dẫn dắt, Sol đã tự động viết lại và tối ưu hóa các kernel sản xuất, thiết kế và tiến hành hàng trăm thí nghiệm để cải thiện khả năng tạo token, đồng thời giám sát quá trình huấn luyện và can thiệp khi phát sinh vấn đề. Công việc về kernel đã giúp giảm 20% tổng chi phí cung cấp mô hình từ đầu đến cuối, còn các thí nghiệm của Sol giúp tăng hiệu quả tạo token hơn 15%. Công việc này vẫn tiếp diễn và tạo nên vòng phản hồi chặt chẽ hơn: khi các mô hình được cải thiện và có thể hoạt động tự chủ hơn, khả năng nâng cao hiệu quả của chúng tôi cũng tăng tốc. Tìm hiểu thêm về công nghệ phía sau GPT‑5.6.
Đáp ứng nhu cầu về trí tuệ dồi dào đòi hỏi cả năng lực điện toán lớn hơn lẫn hiệu suất điện toán cao hơn. Chúng tôi đang xây dựng một danh mục hạ tầng có khả năng thích ứng cao và ghép từng khối lượng công việc với hệ thống phù hợp nhất để vận hành. Cách tiếp cận đó hỗ trợ cả hai đầu của đường cong giá-hiệu năng. Ở đầu chi phí thấp, mức giá mới của Luna và Terra giúp việc xử lý khối lượng công việc lớn trở nên kinh tế hơn ở quy mô vượt trội. Ở đầu tiên phong, Chế độ nhanh giúp khách hàng API truy cập Sol nhanh hơn khi thời gian phản hồi đóng vai trò quan trọng.
Doanh nghiệp có thể đưa thêm AI vào hoạt động hằng ngày mà không phải hy sinh tốc độ ở những công việc quan trọng nhất. Các tác vụ như phân tích tài liệu quy mô lớn, phân loại tương tác với khách hàng và triển khai thường quy có thể được vận hành rộng rãi với chi phí hợp lý, trong khi những tác vụ Sol phức tạp có thể chạy nhanh hơn khi lợi ích xứng đáng với mức phí cao hơn.
Những lợi ích này có thể tích lũy và nhân lên. Trong một quy trình do con người dẫn dắt, các mô hình mạnh hơn giúp đội ngũ kỹ thuật của chúng tôi tìm ra thế hệ cải tiến tiếp theo, rút ngắn con đường đến hiệu năng tốt hơn và chi phí thấp hơn. Chiến lược của chúng tôi vẫn tập trung nâng cao cả năng lực lẫn hiệu quả để mỗi thế hệ trí tuệ có thể hoàn thành nhiều công việc hơn với chi phí thấp hơn.
GPT‑5.6 Terra và Luna tiếp tục có mặt trong ChatGPT Công việc, Codex và API OpenAI. Trong ChatGPT Công việc và Codex, người dùng Free và ChatGPT Go có thể truy cập Terra, còn người dùng ChatGPT Plus, ChatGPT Pro, Business và Enterprise có thể chọn Terra hoặc Luna.
Từ ngày 30 tháng 7, giá API của Terra là 2 USD cho mỗi triệu token đầu vào và 12 USD cho mỗi triệu token đầu ra; của Luna là 0,20 USD cho mỗi triệu token đầu vào và 1,20 USD cho mỗi triệu token đầu ra. Giá Sol không thay đổi. Giá gói đăng ký và hạn mức sử dụng của ChatGPT và Codex không thay đổi, trong khi việc sử dụng Terra và Luna hiện tiêu tốn ít credit hơn. Các thay đổi về giá sẽ bắt đầu được triển khai trên AWS vào cuối hôm nay.
Chế độ nhanh cho GPT‑5.6 Sol thay thế Xử lý ưu tiên trong API và tương ứng với /fast trong Codex. Các yêu cầu API hiện có được gắn thẻ priority sẽ tiếp tục hoạt động. Xem đầy đủ thông tin giá API.


