Grok 4.5 thử lửa trong nhà máy SpaceX, xAI hứa mỗi tháng một mô hình

Hôm 28/6, Elon Musk xác nhận Grok 4.5 đã chạy beta kín trong các đội ngũ tại SpaceX và Tesla. Mô hình dựng trên V9 — kiến trúc được xAI viết lại từ đầu, quy mô khoảng 1,5 nghìn tỷ tham số — và được huấn luyện một phần bằng dữ liệu phiên lập trình từ Cursor, công ty IDE mà SpaceX vừa thâu tóm với giá 60 tỷ đô hồi giữa tháng 6. Musk khoe hiệu năng "gần bằng, có khi vượt Opus". Nhưng tuyên bố đáng chú ý hơn nằm ở nhịp độ: xAI muốn ra biến thể V9 mới mỗi tháng cho đến hết 2026, đích đến là Grok 5 với 6–10 nghìn tỷ tham số trên cụm Colossus 2.
Bãi thử nghiệm cũng là lợi thế cạnh tranh
Các lab khác beta-test qua đối tác API. xAI thì thử mô hình ngay trong nhà máy tên lửa và xưởng xe — những môi trường production mà ông chủ của lab cũng đồng thời sở hữu. Vòng khép kín ấy giờ ôm luôn cả dữ liệu huấn luyện: các phiên code thực tế trên Cursor chính là loại dữ liệu agentic mà lab nào cũng thèm nhưng gần như không mua được ở đâu. Mô hình học từ công việc nội bộ, triển khai vào vận hành nội bộ, rồi được tinh chỉnh mỗi ngày qua harness Grok Build — một chu trình mà đối thủ khó lòng sao chép.
Ra mô hình hàng tháng: món quà kèm hóa đơn
Nghe "mỗi tháng một bản mới" thì như tiến bộ thần tốc, nhưng với ai xây sản phẩm trên API, đó là một bản hợp đồng khác hẳn. Chu kỳ quý cho bạn thời gian đánh giá, di trú, ổn định. Chu kỳ tháng nghĩa là nền móng dưới chân sản phẩm đổi nhanh hơn cả chu kỳ release của chính bạn — rủi ro regression từ chuyện thỉnh thoảng mới lo trở thành chuyện thường trực.

Chú thích: Một nền V9, biến thể ra đều mỗi tháng, cuối đường là Grok 5 cỡ 6–10 nghìn tỷ tham số.
Cũng cần sòng phẳng: "gần bằng, có khi vượt Opus" là lời nhà sáng lập, không phải bảng benchmark. Beta kín trong các công ty cùng chủ sở hữu thì không sinh ra được eval công khai nào. Trước khi mô hình mở rộng, hãy xem đó là tín hiệu lộ trình, đừng xem là số liệu.
Lời khuyên kỹ thuật: dựng lưới an toàn trước khi cần
Nếu nhà cung cấp nào trong stack của bạn chuyển sang nhịp phát hành tháng, thứ bảo vệ bạn là một pipeline eval tự động chạy trên mọi phiên bản mới — thước đo do bạn đặt, không phải vendor. Duy trì bộ 100–300 tác vụ thật kèm đáp án chấm điểm được; phiên bản mới xuất hiện thì pipeline tự chạy và trả về bản so sánh: gì khá lên, gì tụt đi, gì thay đổi âm thầm. Production luôn ghim phiên bản cụ thể, tuyệt đối không trỏ vào alias kiểu latest. Nâng cấp theo lịch của bạn, dựa trên dữ liệu của bạn.
Đội sống khỏe trong thời mô hình ra hàng tháng không phải đội nâng cấp nhanh nhất — mà là đội biết trong vài giờ nâng cấp có an toàn hay không.
Nguồn: xAI, Releasebot, Build Fast With AI.
Còn bạn thì sao? Mỗi tháng một mô hình mới — với bạn đó là tiến bộ để tận dụng, hay nhiễu động phải phòng thủ?
Sẵn sàng sắp xếp tri thức với AI?
BrainMap tự động phân loại ghi chú, khám phá kết nối và xây dựng đồ thị tri thức cá nhân. Miễn phí — không cần thẻ tín dụng.
Dùng thử miễn phíBài viết liên quan

510 tỷ đô đổ vào startup nửa đầu 2026 — gần một nửa chảy về hai cái tên
Báo cáo bán niên của Crunchbase: vốn mạo hiểm toàn cầu lập đỉnh lịch sử, nhưng riêng OpenAI và Anthropic đã hút 217 tỷ đô, tức 43% tổng vốn của cả thế giới startup.

Claude Science: khi agent ngồi vào bàn làm việc của nhà khoa học
Sản phẩm chủ lực mới của Anthropic nối hơn 60 cơ sở dữ liệu khoa học vào một agent tự làm việc. Hãng còn tự dùng nó để đi tìm thuốc cho các bệnh hiếm.

Claude Sonnet 5: mạnh gần bằng Opus, giá chỉ 2 đô
Anthropic vừa tung Sonnet 5 với sức mạnh tiệm cận Opus 4.8 nhưng giá khuyến mãi chỉ 2 đô mỗi triệu token. Người dùng Free và Pro được chuyển sang mô hình mới ngay lập tức.