GPT-5.6 lộ diện: bộ ba Sol, Terra, Luna đánh ba phân khúc cùng lúc

OpenAI đang tung ra GPT-5.6, và lần này không phải một mô hình mà là cả bộ ba: Sol làm flagship, Terra cân bằng giữa sức mạnh và chi phí, Luna nhanh và rẻ nhất. Đợt phát hành khởi động bằng bản preview cho nhóm đối tác thân cận qua API và Codex; ChatGPT và API đại trà sẽ theo sau trong vài tuần. Vài con số đã lộ ra: Sol Ultra đạt 91,9% trên Terminal-Bench 2.1, Terra chào giá quanh mức 2,50/15 đô mỗi triệu token, Luna khoảng 1/6 đô.
Hết thời "một GPT mới cho tất cả"
Cách đặt tên đã nói hộ chiến lược. OpenAI không còn phát hành "GPT mới" như một sản phẩm duy nhất, mà xếp hẳn một đội hình phủ kín các mức giá — đúng công thức Opus–Sonnet–Haiku mà Anthropic dùng lâu nay. Và thời điểm cũng chẳng ngẫu nhiên: chỉ vài ngày sau khi Claude Sonnet 5 kéo mặt bằng giá tầng giữa xuống. Cuộc đua giữa các lab giờ là đội hình đấu đội hình, giáp lá cà ở từng phân khúc.
Với người làm sản phẩm, tin quan trọng nhất có khi lại là tốc độ: trong tháng 7, OpenAI sẽ đưa Sol lên phần cứng Cerebras với tốc độ tối đa 750 token mỗi giây, ban đầu cho khách hàng chọn lọc. Chất lượng flagship ở tốc độ ấy sẽ đổi hẳn cảm giác dùng AI — cả một kế hoạch agent hiện ra trong quãng thời gian trước đây chỉ đủ quay xong icon loading.
Preview trước, đại trà sau — luật chơi mới
Kiểu phát hành "đối tác thân cận dùng trước" cũng cho thấy không khí hậu Fable 5: truy cập theo từng nấc, tổ chức được chọn đi trước, số đông chờ sau. OpenAI từng nói thẳng họ không muốn quy trình chính phủ rà soát trước khi phát hành "trở thành mặc định lâu dài" — nhưng nhìn cách các hãng tự vận hành, thời mô hình mới mở cửa toàn cầu ngay ngày đầu coi như đã khép lại.

Chú thích: Ba mô hình, ba vị trí — chọn làn theo bài toán, đừng chọn theo thương hiệu.
Lời khuyên kỹ thuật: thiết kế cho cả gia đình mô hình
Code của bạn còn một hằng số MODEL_NAME duy nhất? Vậy là đang bỏ phí thế hệ này. Hãy khai báo route theo loại việc — suy luận sâu, xử lý hàng loạt, tương tác realtime — rồi ánh xạ từng route sang một thành viên trong gia đình, kèm ngân sách độ trễ và trần chi phí riêng. Khi GPT-5.6 mở đại trà, bạn chỉ sửa một bảng cấu hình.
Hai điều cần nhớ. Một: anh em cùng nhà không có nghĩa hành xử giống nhau — mô hình lớp Luna đổi độ tinh tế lấy tốc độ, nên eval phải chạy riêng từng làn. Hai: 750 token/giây là số đo trên phần cứng tuyển chọn, không phải p95 của bạn — tự benchmark trên prompt và hạ tầng của mình trước khi hứa gì với người dùng.
Nguồn: OpenAI, Crypto Briefing, LLM Stats.
Còn bạn thì sao? Một mô hình làm được mọi thứ, hay ba mô hình chuyên biệt phải tự định tuyến — bạn chọn phía nào?
Sẵn sàng sắp xếp tri thức với AI?
BrainMap tự động phân loại ghi chú, khám phá kết nối và xây dựng đồ thị tri thức cá nhân. Miễn phí — không cần thẻ tín dụng.
Dùng thử miễn phíBài viết liên quan

510 tỷ đô đổ vào startup nửa đầu 2026 — gần một nửa chảy về hai cái tên
Báo cáo bán niên của Crunchbase: vốn mạo hiểm toàn cầu lập đỉnh lịch sử, nhưng riêng OpenAI và Anthropic đã hút 217 tỷ đô, tức 43% tổng vốn của cả thế giới startup.

Claude Science: khi agent ngồi vào bàn làm việc của nhà khoa học
Sản phẩm chủ lực mới của Anthropic nối hơn 60 cơ sở dữ liệu khoa học vào một agent tự làm việc. Hãng còn tự dùng nó để đi tìm thuốc cho các bệnh hiếm.

Claude Sonnet 5: mạnh gần bằng Opus, giá chỉ 2 đô
Anthropic vừa tung Sonnet 5 với sức mạnh tiệm cận Opus 4.8 nhưng giá khuyến mãi chỉ 2 đô mỗi triệu token. Người dùng Free và Pro được chuyển sang mô hình mới ngay lập tức.