Phát hànhtháng 02, 2026
Tốc độ135 token/s
Độ trễ đầu1.00s
Giá input$0.4/1M
Giá output$3.2/1M
Thứ hạng
Đánh giá
Qwen3.5 là model chuyên biệt cho multimodal, phù hợp khi hình ảnh/video là yếu tố chính. Tránh dùng cho coding, chat thông dụng hoặc autonomous agents — chọn model chuyên biệt khác cho những mảng này.
Điểm mạnh
- Xuất sắc xử lý đa phương thức — hạng #4 toàn cầu, hiểu hình ảnh, video và text tích hợp tốt
- Suy luận logic ổn định — hiệu quả cho phân tích dữ liệu phức tạp, hiểu bối cảnh sâu
- Chất lượng output consistent — cân bằng tốt giữa độ chính xác và tốc độ
Điểm yếu
- Yếu trong lập trình — hạng 42 với lợi thế AIM 61.5 thấp, không đủ cho coding-heavy work
- Trò chuyện tổng quát yếu (hạng 67) — không phải lựa chọn tốt cho chatbot, QA thông dụng
- Khả năng agentic hạn chế — xếp hạng 88 ở AI Agent, không mạnh cho autonomous multi-step tasks
Use case
Xử lý hình ảnh, video, OCR, mô tả visual contentPhân tích tài liệu phức tạp có hình ảnh/chart kèm textBài toán suy luận yêu cầu hiểu đa modal context
Hướng dẫn & Video
Truy cập trang qwen35.com để dùng trực tiếp trên trình duyệt mà không cần setup. Nếu muốn chạy locally, sử dụng SGLang hoặc vLLM với GPU H100/A100 (cần 8 GPU). Model này tốt cho lý luận phức tạp, xử lý đa phương tiện (text, image, video), lập trình, và các tác vụ agent đa bước. Gợi ý: dùng thinking mode cho các bài toán logic khó, kích hoạt tool calling cho các tác vụ cần gọi hàm.