xAI, Anthropic, OpenAI và Moonshot AI đã phát hành bốn mô hình AI nền tảng trong vòng ba tuần vào Tháng 7 năm 2026. xAI phát hành Grok 4.5 vào ngày 8 Tháng 7, Anthropic ra mắt Claude Opus 5 vào ngày 24 Tháng 7, OpenAI đưa GPT-5.6 lên trạng thái sẵn sàng chung vào ngày 9 Tháng 7, và Moonshot AI công bố Kimi K3 vào ngày 16 Tháng 7. Mỗi mô hình đều hướng đến việc hoàn thành các tác vụ kéo dài nhiều giờ—từ nghiên cứu đến lập trình đến báo cáo có cấu trúc—mà không bị lạc kế hoạch thực thi. Cả bốn đều có cửa sổ ngữ cảnh từ 500.000 token trở lên, trong đó ba mô hình đạt 1 triệu token, giúp một phiên duy nhất có thể xử lý trọn vẹn các kho mã hoặc bộ sưu tập tài liệu.
xAI Ra Mắt Grok 1Mèm Dữ Liệu Huấn Luyện Từ Cursor
xAI phát hành Grok 4.5 vào ngày 8 Tháng 7. Mô hình chạy trên nền tảng 1,5 nghìn tỷ tham số và được huấn luyện một phần dựa trên dữ liệu sử dụng thực tế từ Cursor, nền tảng lập trình mà SpaceXAI mua lại trước đó trong năm. Giá được niêm yết ở mức $2 cho mỗi 1 triệu token đầu vào và $6 cho mỗi 1 triệu token đầu ra, với cửa sổ ngữ cảnh 500.000 token. Elon Musk mô tả Grok 4.5 là một mô hình tầm Opus, chạy nhanh hơn và chi phí thấp hơn. Các bộ theo dõi độc lập xếp nó thứ tư trong Artificial Analysis Intelligence Index, đứng trên mọi mô hình open-weight, với giá thấp hơn 60% so với Claude Opus 4.8 và GPT-5.5. Trên Terminal-Bench 2.1, một bài test chấm mức độ mô hình hoàn thành tốt các tác vụ kỹ thuật dòng lệnh, Grok 4.5 đạt 83,3%. xAI cho biết mô hình cần khoảng một phần năm số token đầu ra mà Opus 4.8 yêu cầu cho các tác vụ tương đương.
![Elon X post screenshot.]()
OpenAI Phát Hành GPT-5.6 Theo Cấu Trúc Giá Ba Cấp
OpenAI đưa GPT-5.6 lên sẵn sàng chung vào ngày 9 Tháng 7 sau giai đoạn preview kéo dài hai tuần, giới hạn ở khoảng 1Mổ chức đã được chính phủ Mỹ thẩm định, theo một lệnh điều hành gắn với việc rà soát an toàn cho mô hình nền tảng. Dòng sản phẩm được triển khai theo ba cấp: Sol, phiên bản chủ lực, giá $5 cho token đầu vào và $30 cho token đầu ra trên mỗi 1 triệu token; Terra, mô hình cấp trung với $2,50 đầu vào và $15 đầu ra, mà OpenAI cho rằng tương đương GPT-5.5 với chi phí bằng một nửa; và Luna, cấp nhanh, chi phí thấp với $1 đầu vào và $6 đầu ra. OpenAI báo cáo Sol dẫn đầu Artificial Analysis Coding Agent Index và đạt 88,8% trên Terminal-Bench 2.1, tăng lên 91,9% khi mô hình chạy bốn sub-agents song song trong chế độ ultra mới của hãng. Cả ba cấp đều mang xếp hạng rủi ro nội bộ cao nhất của OpenAI cho khả năng lạm dụng trong lĩnh vực mạng và sinh học.
![OpenAI X post screenshot.]()
Anthropic Ra Mắt Claude Opus 5 Là Mặc Định Ở Cấp Tối Đa
Anthropic phát hành Claude Opus 5 vào ngày 24 Tháng 7, định vị đây là một mô hình tiệm cận hiệu năng của Claude Fable 5 với chỉ một nửa giá của Fable: $10 cho đầu vào và $50 cho đầu ra. Opus 5 có cùng mức giá $5 cho đầu vào và $25 cho đầu ra như người tiền nhiệm Opus 4.8. Mô hình đi kèm cửa sổ ngữ cảnh 1 triệu token, tối đa 128.000 token đầu ra, và một thanh điều chỉnh mức nỗ lực suy luận từ mức thấp đến chế độ xhigh mới. Anthropic cho biết Opus 5 thiết lập cột mốc mới trên Frontier-Bench và GDPval-AA, hai bài đánh giá công việc lập trình và tri thức, dù vẫn thua mô hình Claude Mythos 1Mị hạn chế trong các tác vụ về an ninh mạng. Opus 5 hiện là mô hình mặc định trên Claude Max và là lựa chọn mạnh nhất trên Claude Pro.
![Claude X post screenshot.]()
Moonshot AI Công Bố Kimi K3 Là Mô Hình Open-Weight Lớn Nhất
Moonshot AI ra mắt Kimi K3 vào ngày 16 Tháng 7, một mô hình mixture of experts với 2,8 nghìn tỷ tham số, gồm 896 chuyên gia tổng và 16 chuyên gia hoạt động cho mỗi tác vụ. Mô hình có cửa sổ ngữ cảnh 1 triệu token và hỗ trợ đầu vào đa phương thức sẵn có, với giá API ở mức $3 cho đầu vào và $15 cho đầu ra trên mỗi 1 triệu token. Moonshot cam kết sẽ công bố toàn bộ open weights vào trước ngày 27 Tháng 7. K3 là mô hình open-weight lớn nhất từng được phát hành đến nay, lớn hơn khoảng 75% so với mô hình open-weight lớn nhất trước đó được dùng rộng rãi. Các bộ theo dõi độc lập xếp K3 thứ tư trong số các hệ thống nền tảng hiện tại, sau Claude Fable 5 và GPT-5.6 Sol, nhưng vượt trước Claude Opus 4.8.
![Kimi Moonshot X post screenshot.]()
Cửa Sổ Ngữ Cảnh Mở Rộng Cho Phép Xử Lý Trọn Vẹn Cả Kho Mã
Trước đây, các cửa sổ ngữ cảnh dưới 200.000 token từng buộc nhà phát triển phải chia kho mã lớn hoặc các gói nghiên cứu thành từng mảnh. Mỗi mô hình trong nhóm này giờ đều chạy ở 500.000 token hoặc hơn, với ba trong bốn mô hình đạt 1 triệu token, cho phép một phiên duy nhất chứa trọn vẹn một kho repository hoặc một chồng tài liệu nguồn chính. Các hệ thống từ giai đoạn 2023 và 2024 thường đánh mất kế hoạch sau một vài lần gọi công cụ. Những mô hình được phát hành trong tháng này được thiết kế để duy trì hàng chục bước được phối hợp và phục hồi khi một lần gọi công cụ trả về dữ liệu lỗi thay vì bị kẹt lại. Các cơ chế kiểm soát mức nỗ lực trong Opus 5, cách định giá theo cấp trong GPT-5.6 và các tuyên bố về hiệu quả đằng sau Grok 4.5 đều hướng đến cùng một mục tiêu: cho phép nhóm chọn mức compute mà một tác vụ xứng đáng, thay vì trả giá của phiên bản chủ lực cho mọi yêu cầu. Việc triển khai GPT-1Mị kiểm soát theo chính phủ cho thấy sự giám sát đã được tích hợp vào lịch phát hành của các mô hình lớn nhất. Việc Anthropic tạm dừng truy cập Fable và Mythos theo chỉ đạo và trong thời gian ngắn, do chính phủ yêu cầu, vào Tháng 6 là một phiên bản sớm hơn của cùng một kiểu mẫu.
FAQ
Bốn mô hình AI được phát hành vào Tháng 7 năm 2026 có điểm gì chung?
Grok 4.5, Claude Opus 5, GPT-5.6 và Kimi K3 đều nhắm đến việc hoàn thành các tác vụ kéo dài nhiều giờ—từ nghiên cứu đến lập trình đến báo cáo có cấu trúc—mà không bị lạc kế hoạch thực thi. Mỗi mô hình đều có cửa sổ ngữ cảnh ít nhất 500.000 token, trong đó ba mô hình đạt 1 triệu token, giúp một phiên duy nhất có thể xử lý trọn vẹn các kho mã hoặc bộ sưu tập tài liệu mà không bị chia cắt.
Tại sao OpenAI phát hành GPT-5.6 thông qua bản preview bị ràng buộc bởi chính phủ?
OpenAI đưa GPT-5.6 lên sẵn sàng chung vào ngày 9 Tháng 7 sau giai đoạn preview hai tuần, giới hạn ở khoảng 1Mổ chức đã được chính phủ Mỹ thẩm định, theo một lệnh điều hành gắn với rà soát an toàn cho mô hình nền tảng. Cả ba cấp của GPT-5.6 đều mang mức xếp hạng rủi ro nội bộ cao nhất của OpenAI cho khả năng lạm dụng trong lĩnh vực mạng và sinh học, điều này kích hoạt việc bổ sung khâu rà soát.
Giá Grok 4.5 so với Claude Opus 4.8 như thế nào?
Grok 4.5 được niêm yết $2 cho mỗi 1 triệu token đầu vào và $6 cho mỗi 1 triệu token đầu ra, thấp hơn 60% so với Claude Opus 4.8 và GPT-5.5. xAI cho biết mô hình cần khoảng một phần năm số token đầu ra mà Opus 4.8 yêu cầu cho các tác vụ tương đương, qua đó làm giảm chi phí vận hành các phiên tác nhân dài.