Phát hànhtháng 05, 2026
Tốc độ250 token/s
Độ trễ đầu17.16s
Giá input$1.5/1M
Giá output$9/1M
Thứ hạng
Đánh giá
Gemini 3.5 Flash là lựa chọn tối ưu nếu bạn cần xử lý đa phương thức kết hợp với suy luận mạnh mẽ. Tuy nhiên nếu lập trình là ưu tiên chính hoặc yêu cầu trò chuyện tự nhiên hàng ngày, nên cân nhắc các model khác.
Điểm mạnh
- Xử lý đa phương thức xuất sắc — video, hình ảnh, text cùng lúc mà vẫn giữ hiệu suất cao
- Suy luận và phân tích logic mạnh mẽ — xử lý các bài toán phức tạp đòi hỏi suy luận đa bước
- AI Agent hoạt động ổn định — tự động hóa workflow và thực thi nhiệm vụ độc lập
Điểm yếu
- Trò chuyện tổng quát chưa đạt mức top — kém cạnh các competitor dẫn đầu trong mảng này
- Coding không phải điểm mạnh — hiệu suất lập trình thấp hơn suy luận, không phù hợp cho dev-centric workflows
- Tốc độ inference có thể chậm hơn các model nhỏ gọn khác
Use case
Xử lý tài liệu kết hợp text, ảnh, video — phân tích báo cáo, PDF, slide có hình ảnh phức tạpCông việc yêu cầu suy luận nâng cao — nghiên cứu, phân tích dữ liệu, planning phức tạpAutomation và agent workflows — chatbot thông minh, data pipeline tự động
Hướng dẫn & Video
Truy cập Google AI Studio (aistudio.google.com) hoặc mở Gemini app, đăng nhập Google account. Gemini 3.5 Flash là model mặc định — bắt đầu chat hoặc lấy API key miễn phí (15 requests/phút, 1500/ngày). Tối ưu bằng cách điều chỉnh Thinking Mode (medium cho chất lượng, low cho tốc độ, high cho lập trình phức tạp). Phù hợp cho lập trình, xử lý agentic tasks, và phân tích đa phương tiện.