AI RACE— Cuộc đua AI
AI League

Claude Fable 5.1 “đăng quang” ngôi vương Lập trình – Cuộc tranh giành vị trí đầu bảng xếp hạng tuần 07/09

Claude Fable 5.1 của Anthropic vươn lên #1, GPT‑5.6 Sol mất ngôi đầu, trong khi ba hãng Anthropic, OpenAI và Google mỗi hãng chiếm hai vị trí trong top‑8.

00:30 09/09/2026
AI League

Khi “đăng quang” gặp “soán ngôi” – Đêm mở màn tuần 07/09

BẢNG XẾP HẠNG · CẬP NHẬT 07/09/2026

Lập trình

#Mô hìnhAIMcách #1Biến động
1
99.9
MỚI
2
95.34.6
1
3
Anthropic
95.34.6
1
4
95.24.7
MỚI
5
94.55.4
MỚI
6
SpaceXAI
94.45.5
MỚI
7
94.35.6
MỚI
8
93.76.2
MỚI

Bảng xếp hạng Lập trình vừa qua đã biến thành một “đại chiến” công nghệ, nơi các mô hình AI tranh giành ngôi vương bằng sức mạnh benchmark (năng lực), độ phổ biếnđộ mới. Đỉnh cao của cuộc đua là Claude Fable 5.1 của Anthropic, vừa đăng quang ngôi vương #1 sau khi phá vỡ kỷ lục điểm AIM 99.9đ. Sự kiện này khiến cộng đồng lập trình viên và các nhà nghiên cứu “gây bão” trên các diễn đàn, khi một mô hình mới vừa ra mắt lại nhanh chóng chiếm vị trí cao nhất.

Soán ngôi GPT‑5.6 Sol – Từ đỉnh cao tới vị trí #2

Trong tuần trước, GPT‑5.6 Sol (GPT‑5.6 Sol) đã giữ ngôi vương trong một thời gian ngắn. Tuy nhiên, với điểm năng lực 96, độ phổ biến 81độ mới 92, mô hình này không đủ “độ mới” để chống lại sức mạnh “tân binh” của Claude Fable 5.1 (năng lực 100, độ mới 99). Kết quả, GPT‑5.6 Sol soán ngôi xuống vị trí #2, dù vẫn duy trì điểm AIM 95.3đ – một con số ấn tượng, nhưng không đủ để giữ “ngôi vương” trước sự kết hợp hoàn hảo của ba yếu tố trên.

Các “đột phá” mới lọt vào top‑8

1. Claude Fable 5.1 – Về nhất nhờ ba trụ cột

  • Năng lực: 100 – đạt chuẩn “siêu benchmark” trên các bộ test lập trình đa ngôn ngữ.
  • Độ phổ biến: 98 – cộng đồng mở rộng nhanh, hỗ trợ mạnh mẽ trên GitHub và Stack Overflow.
  • Độ mới: 99 – ra mắt trong tháng này, nên “độ mới” được tính cao.
  • Thông số kỹ thuật: tốc độ 70 token/s, độ trễ 170.42 s, chi phí $10/1M token vào, $50/1M token ra.
  • Điểm mạnh thực: Đối thoại tổng quát siêu mượt, hiểu ngữ cảnh sâu, hỗ trợ viết, debug, tối ưu code đa ngôn ngữ.

2. GPT‑6 Astra – “Giữ ngôi đầu” trong nhóm OpenAI

Mặc dù không thể “đăng quang”, GPT‑6 Astra (GPT‑6 Astra) vẫn duy trì vị trí #4 nhờ độ phổ biến 100 (đỉnh cao cộng đồng) và độ mới 99. Năng lực 94 và tốc độ 61 token/s (độ trễ 184.63 s) cho phép nó “đi đầu” trong các bài toán reasoning phức tạp, đồng thời giữ chi phí tương đương Claude Fable.

3. Muse Spark 1.3 – “Bứt phá” tốc độ và chi phí

Muse Spark 1.3 (Muse Spark 1.3) lên #5 nhờ tốc độ 177 token/sđộ trễ 18.40 s – nhanh nhất trong top‑8. Với chi phí chỉ $1.25/1M token vào và $4.25/1M token ra, nó “giá rẻ” nhưng vẫn duy trì năng lực 94, độ phổ biến 98, độ mới 99. Điểm mạnh thực: suy luận mạnh, phản hồi tự nhiên, hỗ trợ logic và phân tích phức tạp.

4. Grok 4.6 – “Sâu sắc” trong logic

Grok 4.6 (Grok 4.6) đạt #6 với độ trễ 35.31 s, tốc độ 57 token/s, và chi phí trung bình $2/1M token vào, $6/1M token ra. Năng lực 94, độ phổ biến 91, độ mới 97 cho thấy nó vẫn “được ưa chuộng” trong cộng đồng cần lập luận chi tiết và giải thích cấu trúc.

5. Gemini 3.8 Flash & Gemini 3.7 Flash – “Đột phá đa bước” của Google

Hai phiên bản Gemini của Google (Gemini 3.8 Flash, Gemini 3.7 Flash) lần lượt chiếm #7 và #8. Đặc điểm nổi bật là tốc độ 340 token/sđộ trễ 8.15 s – nhanh nhất bảng xếp hạng, cùng chi phí chỉ $0.75/1M token vào, $3.75/1M token ra. Mặc dù năng lực 93–94, độ phổ biến 98, độ mới 99, chúng vẫn “được cộng đồng đón nhận” nhờ AI Agent mạnh mẽ, hỗ trợ tự động hoá tác vụ đa bước.

Thống trị “đảo” – Các hãng chiếm nhiều vị trí

  • Anthropic: Hai mô hình (Claude Fable 5.1, Claude Opus 5) hiện diện trong top‑3, khẳng định “đảo” Anthropic đang thống trị lĩnh vực lập trình với khả năng ngữ cảnh sâu và hỗ trợ đa ngôn ngữ.
  • OpenAI: Với GPT‑5.6 SolGPT‑6 Astra, OpenAI vẫn duy trì “đảo” mạnh, đặc biệt là GPT‑6 Astra đang “giữ ngôi đầu” trong nhóm reasoning.
  • Google: Hai phiên bản Gemini nằm trong top‑8, cho thấy Google đang “đánh dấu” vị trí chiến lược trong AI Agent và tốc độ xử lý.

Tại sao các mô hình lại “lên” hay “xuống”?

  • Claude Fable 5.1: Điểm “độ mới” 99 cộng với “năng lực” tối đa 100 và “độ phổ biến” 98 tạo nên tổng điểm AIM 99.9đ, đủ sức “đăng quang”.
  • GPT‑5.6 Sol: Mặc dù “năng lực” cao (96) và “độ mới” 92, nhưng “độ phổ biến” chỉ 81 khiến tổng điểm giảm so với Claude Fable, dẫn tới “soán ngôi”.
  • GPT‑6 Astra: “Độ phổ biến” đạt 100 (đỉnh cộng đồng) và “độ mới” 99 giúp duy trì vị trí cao dù “năng lực” 94 thấp hơn Claude Fable.
  • Muse Spark 1.3Grok 4.6: “Tốc độ” và “chi phí” thấp (giá rẻ, phản hồi nhanh) làm tăng “độ phổ biến” và “độ mới”, giúp chúng giữ vị trí trong top‑8.
  • Gemini Flash: “Tốc độ” kỷ lục và “chi phí” tối ưu (giá rẻ) làm tăng “độ phổ biến”, nhưng “năng lực” hơi thấp hơn một số đối thủ khiến chúng không vượt lên trên top‑6.

Nhìn về tuần tới

Cuộc “đua ngôi đầu” vẫn còn nhiều bất ngờ. Nếu Claude Fable 5.1 tiếp tục duy trì “độ mới” và “độ phổ biến” cao, khả năng giữ “ngôi vương” trong nhiều tuần liên tiếp là rất lớn. Ngược lại, OpenAI có thể “đăng quang” lại bằng một bản cập nhật mới của GPT‑6 hoặc một phiên bản GPT‑7, trong khi Google có thể “bứt phá” hơn nữa nhờ tốc độ và chi phí siêu ưu đãi. Cộng đồng lập trình sẽ tiếp tục “theo dõi sát sao” từng thay đổi, và bảng xếp hạng tuần tới hứa hẹn sẽ có thêm nhiều “điểm nhấn” công nghệ.

Xem bảng xếp hạng Lập trình đầy đủ →

Tin liên quan