Xem trước chế độ Ultrafast: GPT‑5.6 Sol nhanh gấp 14 lần
Một cấp tốc độ mới cho trí tuệ tiên phong, biến tốc độ thành lợi thế cạnh tranh.
Hôm nay, chúng tôi giới thiệu sớm Ultrafast, một Gói dịch vụ mới giúp GPT‑5.6 Sol chạy nhanh hơn tới 14 lần so với xử lý Tiêu chuẩn và sẽ được ra mắt trước tiên trên OpenAI API. Được vận hành bởi Cerebras, Ultrafast tạo ra tới 750 token đầu ra mỗi giây, đưa mô hình thông minh nhất của chúng tôi vào những sản phẩm và quy trình làm việc mà mỗi giây đều quý giá.
Với GPT‑5.6, chúng tôi đang mở rộng giới hạn tiên phong về khả năng của các mô hình, đồng thời nâng cao hiệu quả của chúng ở mọi lớp trong hệ thống công nghệ. Những cải tiến đó đã giúp năng lực trí tuệ tiên tiến có chi phí hợp lý hơn và hữu ích với nhiều người hơn. Trước đây, để đạt được tốc độ thời gian thực, người dùng thường phải chọn một mô hình nhỏ hơn hoặc chuyên biệt hơn. Ultrafast mở ra một hướng tiến bộ mới: hoàn thành nhiều công việc hữu ích hơn mỗi giây.
Khi tốc độ không còn đồng nghĩa với việc phải đánh đổi độ thông minh, AI có thể tham gia vào những khâu nhạy cảm nhất về thời gian của doanh nghiệp và mở ra các loại hình công việc mới. Chúng tôi đã ghi nhận một số kịch bản đầy hứa hẹn cho Ultrafast:
- Ứng phó sự cố và độ tin cậy: Khi một hệ thống trọng yếu gặp lỗi, hãy phân tích nhật ký ứng dụng, các thay đổi mã gần đây và báo cáo của kỹ sư để xác định nguyên nhân có khả năng nhất, đồng thời hỗ trợ chuẩn bị bản sửa lỗi ngay khi sự cố vẫn đang diễn ra.
- Nghiên cứu tài chính và bảo mật: Phân tích tín hiệu thị trường, đánh giá giao dịch và phát hiện hoạt động đáng ngờ ngay khi tình hình vẫn đang biến động.
- Hỗ trợ khách hàng và thoại: Giải quyết các vấn đề phức tạp của khách hàng theo thời gian thực mà không làm gián đoạn cuộc trò chuyện, ngay cả khi cần qua nhiều bước hoặc hệ thống mới tìm được câu trả lời.
- Thương mại: Trả lời câu hỏi về sản phẩm, kiểm tra hàng tồn kho, cá nhân hóa đề xuất và xử lý vấn đề thanh toán khi người mua vẫn đang cân nhắc, trước khi sự do dự khiến họ bỏ giỏ hàng.
- Nghiên cứu và thử nghiệm trực tiếp: Biến hoạt động nghiên cứu vốn phải chạy qua đêm thành một phiên làm việc tương tác, để các nhóm có thể thử nghiệm ý tưởng, xem xét kết quả, điều chỉnh cách tiếp cận và tiến hành thử nghiệm tiếp theo mà không bị ngắt mạch công việc.
Trong giai đoạn xem trước, chúng tôi đang hợp tác với nhóm khách hàng đầu tiên để tìm hiểu tốc độ này tạo ra khác biệt lớn nhất ở đâu và cách những bài học đó có thể định hướng sản phẩm của chúng tôi theo thời gian. Nếu doanh nghiệp của bạn cần trí tuệ tiên phong ở tốc độ cao nhất, bạn có thể đăng ký nhận thông báo khi quyền truy cập được mở rộng.
GPT‑5.6 Sol ở chế độ Ultrafast và tiêu chuẩn cùng xây dựng một trình mô phỏng nhà kho 3D hoạt động được từ cùng một câu lệnh văn bản, đặt cạnh nhau để so sánh.
Chúng tôi đã thử nghiệm GPT‑5.6 Sol ở chế độ Ultrafast với nhóm doanh nghiệp đầu tiên trong các lĩnh vực lập trình, thương mại, nghiên cứu tài chính, hỗ trợ và nhiều ứng dụng tương tác khác. Việc bắt đầu từ các quy trình kinh doanh cho phép chúng tôi nghiên cứu những điều kiện này trong môi trường vận hành thực tế. Những thử nghiệm ban đầu của họ đang giúp chúng tôi hiểu tốc độ tăng khoảng một bậc độ lớn tạo ra nhiều giá trị nhất ở đâu, cũng như sản phẩm thay đổi thế nào khi mô hình có thể theo kịp người sử dụng. Chúng tôi sẽ dùng những kết quả này để định hướng quá trình triển khai khi năng lực phục vụ tăng lên.
Tại OpenAI, một nhóm nhà phát triển đã thử nghiệm GPT‑5.6 Sol ở chế độ Ultrafast để tìm hiểu những quy trình nào được hưởng lợi từ trí tuệ tiên phong có khả năng phản hồi theo thời gian thực.
Ứng phó sự cố là một ví dụ về cách đội ngũ của chúng tôi sử dụng Ultrafast. Khi có cảnh báo, các kỹ sư cần nhanh chóng dựng nên bức tranh chính xác trong lúc hệ thống và các bằng chứng vẫn đang thay đổi. Các nhóm dùng Ultrafast để nhanh chóng đọc nhật ký, phân tích dấu vết, tổng hợp hội thoại, xác định các bước kiểm tra tiếp theo, đồng thời hỗ trợ chuẩn bị hoặc xác thực bản sửa lỗi—tất cả chỉ trong một phần nhỏ thời gian nhờ năng lực trí tuệ của Sol. Ultrafast rút ngắn khoảng thời gian từ lúc quan sát tín hiệu, kiểm chứng giả thuyết đến khi chọn hành động tiếp theo, trong khi kỹ sư vẫn chịu trách nhiệm về quyết định chuyên môn và việc triển khai.
Trong nghiên cứu, đội ngũ của chúng tôi dùng Ultrafast để nhanh chóng tìm kiếm trong các nguồn tri thức, truy vấn dữ liệu, cũng như thu thập, sắp xếp và tóm tắt thông tin từ các công cụ được kết nối. Một quy trình nghiên cứu phổ biến là các thành viên trong nhóm khởi chạy hàng loạt thử nghiệm qua đêm rồi xem kết quả vào sáng hôm sau. Với Ultrafast, chúng tôi nhận thấy vòng lặp này được rút ngắn để có thể thực hiện nhiều lượt lặp ngay trong ngày làm việc.
Ultrafast đánh dấu bước tiếp theo trong quan hệ hợp tác với Cerebras nhằm đưa khả năng suy luận có độ trễ cực thấp lên nền tảng của OpenAI. Giờ đây, với GPT‑5.6 Sol ở chế độ Ultrafast, Cerebras đang hỗ trợ mô hình thông minh nhất của OpenAI, cung cấp tới 750 token đầu ra mỗi giây, giúp doanh nghiệp xây dựng sản phẩm phản hồi nhanh hơn, ra quyết định nhanh hơn và đưa AI mạnh mẽ trực tiếp vào những quy trình đòi hỏi khắt khe nhất.
GPT‑5.6 Sol ở chế độ Ultrafast hiện được cung cấp dưới dạng bản xem trước giới hạn cho một nhóm khách hàng được chọn. Chúng tôi sẽ mở rộng quyền truy cập khi năng lực phục vụ tăng lên. Đăng ký nhận thông tin mới.


