AI RACE— Cuộc đua AI
AI League

Tuần biến động 20/07: Gemini Omni Flash đăng quang ở hai bảng video, Qwen-Audio-3.0-TTS-Plus và GPT-5.2 ra mắt lên ngôi số 1

Gemini Omni Flash (Google) ra mắt thẳng vị trí số 1 ở cả bảng tạo video lẫn ảnh-sang-video, trong khi Qwen-Audio-3.0-TTS-Plus (Alibaba) và GPT-5.2 (OpenAI) cũng vào ngôi đầu ở bảng giọng nói và toán học — một tuần mà tân binh áp đảo đương kim vô địch.

01:01 22/07/2026
AI League

Có những tuần các bảng xếp hạng chỉ xê dịch vài bậc. Tuần này không phải vậy. Bốn trong bảy bảng xếp hạng lớn có mô hình mới ra mắt là lập tức vươn lên số 1 — không cần thời gian tích lũy, không cần leo hạng dần. Đáng chú ý nhất: Gemini Omni Flash của Google debut và giành ngôi đầu ở cùng lúc hai bảng — tạo video và ảnh-sang-video (image-to-video) — một cú phủ sóng hiếm thấy khi một mô hình duy nhất định hình lại hai hạng mục cùng lúc. Ở một hướng khác, Qwen-Audio-3.0-TTS-Plus của Alibaba ra mắt và soán luôn ngôi đầu bảng giọng nói (TTS) từng thuộc về Simba 3.2, còn GPT-5.2 của OpenAI vào thẳng số 1 bảng toán học ngay khi xuất hiện.

Cuộc đua giữa các hãng: OpenAI vẫn áp đảo, nhưng Google đang dồn lực vào media

Nhìn tổng thể bảy bảng xếp hạng, câu chuyện thực sự nằm ở tương quan giữa các hãng chứ không chỉ ở từng mô hình riêng lẻ. OpenAI hiện đang giữ ngôi đầu ở ba bảng — toán học (GPT-5.2), lập trình (GPT-5.6 Sol) và tạo ảnh (GPT Image 2 ở chế độ high) — cho thấy độ phủ năng lực đồng đều trên cả suy luận, sinh mã lẫn sinh ảnh. Google bám sát với hai bảng dẫn đầu, nhưng điểm khác biệt là cả hai đều thuộc về đúng một mô hình: Gemini Omni Flash. Việc một mô hình đa năng (omni) chiếm lĩnh đồng thời tạo video và ảnh-sang-video gợi ý đây là mô hình được tối ưu theo hướng đa phương thức dùng chung một kiến trúc lõi, thay vì hai sản phẩm tách biệt cho hai tác vụ. Alibaba và Anthropic mỗi hãng giữ một bảng: Alibaba thống trị giọng nói qua Qwen-Audio-3.0-TTS-Plus, còn Anthropic tiếp tục giữ ngôi đầu bảng trò chuyện tổng quát với Claude Fable 5 — bảng duy nhất tuần này không có xáo trộn ở vị trí số 1.

Nhóm mô hình ngôn ngữ: lập trình & trò chuyện tổng quát

Ở bảng lập trình, GPT-5.6 Sol (OpenAI) vẫn giữ ngôi đầu, nhưng tâm điểm chú ý lại là tân binh Kimi K3 — lần đầu lọt vào bảng xếp hạng lập trình. Đáng nói hơn, Kimi K3 không chỉ xuất hiện ở một bảng: mô hình này cũng lần đầu góp mặt ở bảng trò chuyện tổng quát, nơi Claude Fable 5 của Anthropic vẫn đang giữ vững ngôi đầu. Một mô hình mới chen chân vào top ở cả hai hạng mục cùng lúc là tín hiệu cho thấy Kimi K3 được định vị như một mô hình đa năng, không chỉ chuyên trách một tác vụ.

Bảng toán học có ít xáo trộn về thứ hạng dưới, nhưng sự kiện đáng chú ý nhất là GPT-5.2 ra mắt và vào thẳng số 1 — không có mô hình nào bị soán ngôi vì đây gần như là lần đầu bảng ghi nhận một mốc năng lực toán học mới ở vị trí đầu bảng.

Nhóm media: tạo ảnh, tạo video, giọng nói

Tạo ảnh (text-to-image) là bảng duy nhất trong nhóm media giữ nguyên vị trí số 1: GPT Image 2 (high) của OpenAI vẫn dẫn đầu. Nhưng phía dưới có chuyển động: tân binh Nano Banana 2 Lite (chạy trên nền Gemini 3.1 Flash Lite Image) lần đầu lọt bảng, trong khi Reve 2.0 tụt hạng — cho thấy áp lực cạnh tranh ở phân khúc giữa bảng đang tăng dù ngôi đầu chưa lung lay.

Tạo video là nơi diễn ra cú soán ngôi rõ ràng nhất tuần: Gemini Omni Flash ra mắt thẳng vị trí số 1, đẩy HappyHorse-1.0 — nhà vô địch trước đó — xuống hạng 2. Kling 3.0 Omni 1080p (Pro) cũng tụt hạng trong đợt xáo trộn này, phản ánh việc cả bảng phải sắp xếp lại khi có một mô hình mới xâm nhập từ đỉnh.

Ảnh-sang-video (image-to-video) chứng kiến kịch bản tương tự và gần như cùng thời điểm: Gemini Omni Flash tiếp tục ra mắt thẳng số 1, lần này đẩy Dreamina Seedance 2.0 720p xuống hạng 2. Việc cùng một mô hình debut ở vị trí đầu bảng của hai hạng mục video khác nhau trong cùng một kỳ cập nhật là điểm hiếm gặp, củng cố vị thế của Google trong mảng sinh video bằng AI.

Giọng nói (TTS) là bảng có biến động rõ nhất ở tầng trên: Qwen-Audio-3.0-TTS-Plus của Alibaba ra mắt và giành ngay ngôi đầu, đẩy Simba 3.2 — vốn đang giữ vị trí số 1 — xuống hạng 2. Đồng thời, Luna TTS cũng leo hạng trong đợt xếp lại này, cho thấy nhóm dẫn đầu bảng giọng nói đang được định hình lại toàn diện chứ không chỉ đổi ngôi ở vị trí số 1.

Nhận định

Tuần này khác biệt ở chỗ phần lớn biến động đến từ mô hình mới ra mắt đã trực tiếp giành ngôi đầu, thay vì các mô hình cũ leo hạng dần qua nhiều kỳ cập nhật. Về tổng thể cuộc đua giữa các hãng, OpenAI vẫn là bên có độ phủ rộng nhất với ba bảng dẫn đầu trải đều từ suy luận toán học đến sinh mã và sinh ảnh. Nhưng diễn biến đáng theo dõi nhất lại thuộc về Google: chỉ với một mô hình — Gemini Omni Flash — hãng này đã chiếm lĩnh đồng thời hai bảng xếp hạng video, một chiến lược tập trung nguồn lực vào một kiến trúc đa phương thức duy nhất thay vì dàn trải nhiều sản phẩm. Alibaba và Anthropic, dù mỗi hãng chỉ giữ một bảng, đều đang bảo vệ vững chắc lãnh địa chuyên biệt của mình — giọng nói và trò chuyện tổng quát. Kỳ cập nhật tới sẽ là phép thử xem HappyHorse, Kling hay Simba có tìm được lối phản công, hay Gemini Omni Flash và Qwen-Audio-3.0-TTS-Plus sẽ tiếp tục nới rộng khoảng cách.

Bảng xếp hạng nhắc tới trong bài

BẢNG XẾP HẠNG · CẬP NHẬT 27/07/2026

Tạo video

#Mô hìnhAIMcách #1Biến động
1
98.2
2
Alibaba-ATH
91.96.3
3
Alibaba-ATH
90.97.3
4
89.09.2
5
86.511.7
6
84.014.2
7
82.016.2
1
8
Video Rebirth
82.016.2
1
BẢNG XẾP HẠNG · CẬP NHẬT 27/07/2026

Giọng nói (TTS)

#Mô hìnhAIMcách #1Biến động
1
94.0
2
SpeechifyAI
93.20.8
3
90.23.8
4
Cartesia
88.85.2
5
87.07.0
4
6
86.87.2
1
7
86.87.2
MỚI
8
86.67.4
2
BẢNG XẾP HẠNG · CẬP NHẬT 27/07/2026

Toán học

#Mô hìnhAIMcách #1Biến động
1
OpenAI
95.4
MỚI
2
93.81.6
3
93.61.8
4
93.32.1
5
93.22.2
6
92.23.2
7
92.13.3
8
92.03.4

Tin liên quan