AI RACE— Cuộc đua AI
AI League

Kimi K3 gây chấn động, lập tức chen chân vào top 3 bảng xếp hạng Lập trình — bộ ba Claude đồng loạt tụt hạng

Tân binh Kimi K3 debut thẳng hạng #3 nhờ độ phổ biến gần như tuyệt đối, đẩy cả ba mô hình Anthropic lùi một bậc, trong khi OpenAI vẫn giữ vững song song hai vị trí dẫn đầu.

00:33 22/07/2026
AI League

Tuần 20/07 của bảng xếp hạng Lập trình mở màn bằng một cú xáo trộn hiếm thấy: chỉ một tân binh xuất hiện, nhưng đủ sức đẩy lùi cả một dây chuyền phía sau nó xuống từng bậc một.

BẢNG XẾP HẠNG · CẬP NHẬT 27/07/2026

Lập trình

#Mô hìnhAIMcách #1Biến động
1
99.6
2
Anthropic
99.6
MỚI
3
97.91.7
1
4
97.52.1
1
5
97.12.5
1
6
94.45.2
1
7
OpenAI
94.45.2
1
8
SpaceXAI
93.16.5
1

OpenAI giữ vững ngôi đầu, không hề nao núng

Ở đỉnh bảng, mọi thứ vẫn yên vị. GPT-5.6 Sol tiếp tục giữ ngôi vương với 99.8 điểm, còn người anh em GPT-5.6 Terra bám sát ở #2 với 98.0 điểm. Đây là tuần thứ hai liên tiếp cặp đôi này khóa chặt top 2, và không khó hiểu vì sao: GPT-5.6 Sol đạt điểm năng lực tối đa 100/100 theo dữ liệu benchmark, cộng thêm độ phổ biến 97 và độ mới 99 — một tổ hợp gần như không có điểm yếu. Về thực lực, model này được đánh giá xử lý code phức tạp, optimization và refactor ở mức production-ready, đi kèm khả năng suy luận multi-step và planning chi tiết — đúng chất một mô hình lập trình đầu bảng. Thông số kỹ thuật đi kèm cũng đáng chú ý: tốc độ 67 token/s với độ trễ 51.69 giây, mức giá 5 USD/1M token đầu vào và 30 USD/1M token đầu ra — mức phí không rẻ nhưng phản ánh đúng vị thế top 1.

Kimi K3 — tân binh đạp cửa vào top 3

Nhân vật gây chú ý nhất tuần này không phải ai tranh ngôi đầu, mà là cái tên hoàn toàn mới: Kimi K3 của hãng Kimi, debut thẳng ở hạng #3 với 97.6 điểm — vượt qua cả ba mô hình Claude của Anthropic ngay trong lần đầu góp mặt. Căn cứ để giải thích cú bứt phá này nằm ngay trong cấu trúc điểm: năng lực 97 (không vượt trội so với top đầu) nhưng độ phổ biến lên tới 99 — gần như tối đa, cho thấy cộng đồng lập trình viên đã đón nhận model này cực kỳ nhanh — cộng thêm độ mới 99 vì vừa ra mắt. Về điểm mạnh thật, Kimi K3 được ghi nhận có khả năng suy luận logic cấp cao (đứng thứ 2 trên bảng xếp hạng suy luận) và năng lực lập trình chắc chắn ở nhóm top 3, hỗ trợ đa ngôn ngữ lập trình. Yếu tố then chốt khác là mức giá: chỉ 3 USD/1M token đầu vào và 15 USD/1M token đầu ra — rẻ hơn đáng kể so với GPT-5.6 Sol — một lợi thế đủ sức giải thích vì sao độ phổ biến của nó tăng vọt chỉ trong thời gian ngắn.

Anthropic mất đà, cả ba đại diện đều lùi bước

Chính sự xuất hiện của Kimi K3 đã tạo hiệu ứng domino lên toàn bộ phần còn lại của bảng. Claude Fable 5 từ #3 tuần trước tụt xuống #4 (97.2 điểm), Claude Opus 4.8 từ #4 rơi xuống #5 (94.5 điểm), và Claude Opus 4.7 cũng lùi từ #7 xuống #8 (92.9 điểm). Đáng nói là Anthropic vẫn đang nắm tới 3 vị trí trong top 8 — ngang bằng với OpenAI — nhưng đây là tuần mà thế trận ba chân kiềng của họ bị một tân binh bên ngoài chọc thủng cùng lúc, thay vì bị chính đối thủ quen mặt vượt qua.

GPT-5.5 cũng chung cảnh ngộ, tụt từ #5 xuống #6 với 94.5 điểm — bằng điểm tuyệt đối với Claude Opus 4.8, cho thấy khoảng cách cạnh tranh ở nhóm giữa bảng đang cực kỳ sít sao. Trong khi đó Grok 4.5 của xAI lùi một bậc xuống #7 (93.3 điểm), giữ nguyên vị trí tương đối so với các mô hình xung quanh.

Cục diện: ba hãng, một cuộc đua song song

Nhìn tổng thể, tuần này không phải câu chuyện một model đơn lẻ vượt mặt đối thủ, mà là cuộc đối đầu giữa ba hãng: OpenAI tiếp tục thống trị đỉnh bảng bằng năng lực benchmark tuyệt đối, Anthropic vẫn giữ được số lượng đại diện đông đảo nhưng mất vị thế xếp hạng, còn Kimi — cái tên hoàn toàn mới trên bảng xếp hạng Lập trình — dùng chiến lược giá rẻ cộng độ phổ biến bùng nổ để chen ngay vào nhóm dẫn đầu.

Tuần tới, câu hỏi đáng theo dõi là liệu Kimi K3 có giữ được đà tăng độ phổ biến để tiến sâu hơn vào top 2, hay các mô hình Claude sẽ có bản cập nhật để giành lại vị trí đã mất. Với khoảng cách điểm số ở nhóm giữa bảng đang co hẹp đáng kể, bất kỳ cải thiện nhỏ nào về năng lực hay giá cả cũng có thể tạo ra xáo trộn thứ hạng tiếp theo.

Xem bảng xếp hạng Lập trình đầy đủ →

Tin liên quan