AI RACE— Cuộc đua AI
AI League

Kimi K3 gây chấn động, đâm thẳng vào top 3 "Trò chuyện tổng quát" — Claude Fable 5 vẫn giữ vững ngôi đầu

Kimi K3 debut ngoạn mục ở hạng #3 bảng "Trò chuyện tổng quát", đẩy lùi cả dàn model của Anthropic lẫn OpenAI xuống một bậc, trong khi Claude Fable 5 vẫn không ai lay động được ngôi vương.

00:31 23/07/2026
AI League

Bảng xếp hạng "Trò chuyện tổng quát" tuần này không thiếu kịch tính, dù vị trí số 1 vẫn án binh bất động. Cái tên khiến cả bảng phải xáo trộn là một tân binh đến từ hãng Kimi: Kimi K3 — xuất hiện lần đầu và lập tức chiếm ngay hạng #3, đẩy lùi một loạt model quen mặt xuống phía dưới. Đây là kiểu debut hiếm thấy: không đi từ từ mà nhảy thẳng vào nhóm dẫn đầu.

BẢNG XẾP HẠNG · CẬP NHẬT 27/07/2026

Trò chuyện tổng quát

#Mô hìnhAIMcách #1Biến động
1
Anthropic
99.9
MỚI
2
97.92.0
MỚI
3
97.12.8
MỚI
4
94.65.3
MỚI
5
91.78.2
MỚI
6
91.58.4
MỚI
7
SpaceXAI
89.810.1
MỚI
8
OpenAI
89.710.2
MỚI

Ngôi đầu vẫn thuộc về Claude Fable 5

Claude Fable 5 của Anthropic tiếp tục giữ vững vị trí #1 với 99.2 điểm, bỏ khá xa phần còn lại. Thành tích này không đến từ may mắn: điểm năng lực (benchmark) của Fable 5 đạt tuyệt đối 100, độ phổ biến trong cộng đồng cũng ở mức rất cao 91, cho thấy đây không chỉ là model "mạnh trên giấy" mà thực sự được người dùng tin dùng hàng ngày. Điểm mạnh thật sự nằm ở khả năng hội thoại tiếng Anh tự nhiên, linh hoạt — xứng đáng là model hội thoại tốt nhất bảng — cộng thêm năng lực lập trình vững (hạng #3 riêng ở mảng code), xử lý refactor và debug nhanh gọn. Theo dữ liệu Artificial Analysis, tốc độ xử lý của Fable 5 đạt 66 token/s với độ trễ 43.73 giây, mức giá 10 USD/1 triệu token đầu vào và 50 USD/1 triệu token đầu ra — không rẻ, nhưng đi kèm hiệu năng tương xứng.

Ngay sau lưng, GPT-5.6 Sol của OpenAI vẫn kiên trì bám hạng #2 với 98.3 điểm, khoảng cách với ngôi đầu chưa đầy 1 điểm — cuộc đua song mã giữa hai hãng lớn nhất ngành vẫn chưa có dấu hiệu ngã ngũ.

Kimi K3: cú vươn lên nhờ độ mới và sức hút cộng đồng cực lớn

Điều đáng nói nhất tuần này là cách Kimi K3 chen chân vào top 3 ngay lần đầu xuất hiện, với 95.9 điểm. Nhìn vào cấu phần điểm, lý do không khó đoán: độ phổ biến của Kimi K3 lên tới 99 — gần như tối đa — và độ mới cũng chạm mốc 99, phản ánh đúng hiệu ứng của một model vừa ra mắt đang được cộng đồng bàn tán rầm rộ. Năng lực benchmark của Kimi K3 cũng không hề kém cạnh với 95 điểm, đứng thứ 2 toàn bảng về suy luận logic cấp cao — xử lý tốt các bài toán cần phân tích sâu — và nằm trong top 3 về lập trình, hỗ trợ đa ngôn ngữ. Yếu tố khiến Kimi K3 càng dễ gây bão cộng đồng là mức giá: chỉ 3 USD/1 triệu token đầu vào và 15 USD/1 triệu token đầu ra, rẻ hơn đáng kể so với Fable 5 — một lợi thế rõ ràng khi người dùng cân nhắc chi phí vận hành ở quy mô lớn.

Hiệu ứng domino: cả Anthropic lẫn OpenAI đều bị đẩy lùi

Sự chen ngang của Kimi K3 tạo ra một hiệu ứng dây chuyền đúng nghĩa. Claude Opus 4.8 từ #3 tụt xuống #4 (92.9đ), GPT-5.6 Terra từ #4 xuống #5 (92.7đ), Grok 4.5 của SpaceXAI từ #5 xuống #6 (90.9đ), GPT-5.5 từ #6 xuống #7 (90.9đ), và Claude Sonnet 5 từ #7 xuống #8 (90.2đ). Không model nào trong nhóm này thực sự "yếu đi" — điểm số gần như giữ nguyên so với tuần trước — chỉ đơn giản là có một cái tên mới chen vào giữa khiến cả dây chuyền lùi lại một bậc.

Nhìn tổng thể top 8, đây thực chất là cuộc đối đầu giữa hai gã khổng lồ: Anthropic đang nắm 3 vị trí (Fable 5, Opus 4.8, Sonnet 5), còn OpenAI cũng không kém cạnh với 3 vị trí (GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.5). Hai hãng này gần như chia nhau thống trị 6 trên 8 vị trí, còn lại là 1 suất cho SpaceXAI và 1 suất — vừa giành được — cho Kimi.

Tuần tới, câu hỏi lớn nhất là liệu Kimi K3 có đủ sức duy trì phong độ hay chỉ là "hiệu ứng ra mắt" nhất thời khi độ mới hạ nhiệt dần. Trong khi đó, cuộc đua giữa Fable 5 và GPT-5.6 Sol cho ngôi đầu vẫn là điểm nóng cần theo dõi sát, khi khoảng cách giữa hai model này đang ngày càng thu hẹp.

Xem bảng xếp hạng Trò chuyện tổng quát đầy đủ →

Tin liên quan