GPT-5.6 lộ diện: bộ ba Sol, Terra, Luna đánh ba phân khúc cùng lúc

·BrainMap Team

Featured Cover Image

OpenAI đang tung ra GPT-5.6, và lần này không phải một mô hình mà là cả bộ ba: Sol làm flagship, Terra cân bằng giữa sức mạnh và chi phí, Luna nhanh và rẻ nhất. Đợt phát hành khởi động bằng bản preview cho nhóm đối tác thân cận qua API và Codex; ChatGPT và API đại trà sẽ theo sau trong vài tuần. Vài con số đã lộ ra: Sol Ultra đạt 91,9% trên Terminal-Bench 2.1, Terra chào giá quanh mức 2,50/15 đô mỗi triệu token, Luna khoảng 1/6 đô.

Hết thời "một GPT mới cho tất cả"

Cách đặt tên đã nói hộ chiến lược. OpenAI không còn phát hành "GPT mới" như một sản phẩm duy nhất, mà xếp hẳn một đội hình phủ kín các mức giá — đúng công thức Opus–Sonnet–Haiku mà Anthropic dùng lâu nay. Và thời điểm cũng chẳng ngẫu nhiên: chỉ vài ngày sau khi Claude Sonnet 5 kéo mặt bằng giá tầng giữa xuống. Cuộc đua giữa các lab giờ là đội hình đấu đội hình, giáp lá cà ở từng phân khúc.

Với người làm sản phẩm, tin quan trọng nhất có khi lại là tốc độ: trong tháng 7, OpenAI sẽ đưa Sol lên phần cứng Cerebras với tốc độ tối đa 750 token mỗi giây, ban đầu cho khách hàng chọn lọc. Chất lượng flagship ở tốc độ ấy sẽ đổi hẳn cảm giác dùng AI — cả một kế hoạch agent hiện ra trong quãng thời gian trước đây chỉ đủ quay xong icon loading.

Preview trước, đại trà sau — luật chơi mới

Kiểu phát hành "đối tác thân cận dùng trước" cũng cho thấy không khí hậu Fable 5: truy cập theo từng nấc, tổ chức được chọn đi trước, số đông chờ sau. OpenAI từng nói thẳng họ không muốn quy trình chính phủ rà soát trước khi phát hành "trở thành mặc định lâu dài" — nhưng nhìn cách các hãng tự vận hành, thời mô hình mới mở cửa toàn cầu ngay ngày đầu coi như đã khép lại.

Sơ đồ ba làn của gia đình GPT-5.6
Chú thích: Ba mô hình, ba vị trí — chọn làn theo bài toán, đừng chọn theo thương hiệu.

Lời khuyên kỹ thuật: thiết kế cho cả gia đình mô hình

Code của bạn còn một hằng số MODEL_NAME duy nhất? Vậy là đang bỏ phí thế hệ này. Hãy khai báo route theo loại việc — suy luận sâu, xử lý hàng loạt, tương tác realtime — rồi ánh xạ từng route sang một thành viên trong gia đình, kèm ngân sách độ trễ và trần chi phí riêng. Khi GPT-5.6 mở đại trà, bạn chỉ sửa một bảng cấu hình.

Hai điều cần nhớ. Một: anh em cùng nhà không có nghĩa hành xử giống nhau — mô hình lớp Luna đổi độ tinh tế lấy tốc độ, nên eval phải chạy riêng từng làn. Hai: 750 token/giây là số đo trên phần cứng tuyển chọn, không phải p95 của bạn — tự benchmark trên prompt và hạ tầng của mình trước khi hứa gì với người dùng.

Nguồn: OpenAI, Crypto Briefing, LLM Stats.

Còn bạn thì sao? Một mô hình làm được mọi thứ, hay ba mô hình chuyên biệt phải tự định tuyến — bạn chọn phía nào?

Sẵn sàng sắp xếp tri thức với AI?

BrainMap tự động phân loại ghi chú, khám phá kết nối và xây dựng đồ thị tri thức cá nhân. Miễn phí — không cần thẻ tín dụng.

Dùng thử miễn phí

Bài viết liên quan