Anthropic ra mắt Claude Opus 5.5: Rẻ hơn 40%, nhanh hơn 30% và xóa bỏ lối hành văn rườm rà
Anthropic vừa chính thức giới thiệu Claude Opus 5.5, sở hữu sức mạnh ngang ngửa dòng Fable 5.1 nhưng cắt giảm tới 40% chi phí vận hành và khắc phục triệt để phong cách viết sáo rỗng quen thuộc.

Bước đi mở màn cho thế hệ Claude 5.5
Anthropic vừa chính thức phát hành Claude Opus 5.5, thành viên đầu tiên trong chu kỳ sản phẩm mới của hãng. Theo công bố, mô hình mang lại hiệu năng tương đương phiên bản Fable 5.1 trên phần lớn tác vụ, nhưng lại sở hữu tốc độ xử lý vượt trội và chi phí vận hành tối ưu hơn đáng kể so với Opus 5 tiền nhiệm.
Hai phiên bản tiếp theo là Claude Sonnet 5.5 và Haiku 5.5 cũng dự kiến sẽ ra mắt trong vài tuần tới nhằm hoàn thiện hệ sinh thái mới. Hiện tại, Claude Opus 5.5 đã có mặt trên nền tảng Claude Platform với mã định danh claude-opus-5-5, đồng thời được tích hợp đầy đủ trên các dịch vụ đám mây lớn gồm Amazon Web Services (AWS), Google Cloud và Microsoft Azure.
Tối ưu chi phí, nâng cấp hiệu năng lập trình và tinh chỉnh giọng văn
Điểm nhấn lớn nhất trên Opus 5.5 nằm ở hiệu quả kinh tế và độ nhạy bén. Giá token trực tiếp giảm 20%: phí đọc đầu vào (input) còn 4 USD/triệu token và đầu ra (output) còn 20 USD/triệu token (so với mức 5 USD và 25 USD trước đây). Chi phí đọc bộ nhớ đệm (cache read) thậm chí giảm sâu 60%, chỉ còn 0,20 USD/triệu token. Nhờ khả năng tạo kết quả nhanh hơn 30% và tiêu thụ ít token hơn cho cùng một khối lượng công việc, Anthropic ước tính tổng chi phí vận hành thực tế giảm khoảng 40% so với Opus 5. Hạn mức sử dụng 5 giờ cho các gói thuê bao cũng tăng 20%, cho phép người dùng kéo dài thời gian làm việc hiệu quả thêm 25%.
Về mặt sức mạnh, các bài đo kiểm cho thấy Opus 5.5 vượt trội so với nhiều đối thủ cùng phân khúc:
- Lập trình dạng tác tử (Agentic coding): Đạt 66,4% trên Terminal-Bench 4.0 (vượt mức 55,8% của Fable 5.1 và 57,9% của GPT-6 Astra). Trên CursorBench 4.0, mô hình ghi nhận 57,8 điểm, bỏ xa GPT-5.6 Sol 11 điểm dù chỉ tốn 1/3 chi phí. Với FrontierCode v1.1, Opus 5.5 đạt 54,4%, đánh bại GPT-6 Astra với chi phí ước tính chỉ bằng 20% trên mỗi tác vụ.
- Xử lý tri thức và thị giác: Mô hình đạt 1.846 điểm trên bài kiểm tra công việc chuyên môn GDPval-AA v2.1, 67,7% ở bài thử nghiệm suy luận đa ngành Humanity's Last Exam (có dùng công cụ), và 81,8% trong môi trường điều khiển máy tính OSWorld 2.0.
Bên cạnh con số kỹ thuật, Opus 5.5 giải quyết trực tiếp một phàn nàn dai dẳng từ người dùng: lối hành văn "Claudish" mang tính rập khuôn, văn hoa và dài dòng. Phiên bản mới được huấn luyện để ưu tiên thông tin trọng tâm lên hàng đầu, hạn chế thuật ngữ thừa thãi, bám sát yêu cầu viết lách hơn và mang lại phản hồi tự nhiên, gãy gọn.
Siết chặt an toàn trước kỹ thuật chưng cất và tuân thủ chuẩn mực mới
Nhằm ngăn chặn hành vi trích xuất năng lực trái phép (distillation attacks) — nơi kẻ tấn công dùng hàng nghìn tài khoản ảo để "rút lõi" tri thức của AI nhằm tạo ra mô hình clone mà không có rào chắn bảo vệ, Anthropic trang bị cho Opus 5.5 tính năng "Preserved Thinking". Kỹ thuật này ngăn chặn người dùng API can thiệp vào ngữ cảnh trước đó để lấy chuỗi suy luận (reasoning). Song song đó, mô hình tích hợp cơ chế đóng dấu bản quyền (watermarking) nhằm đáp ứng Đạo luật AI của Liên minh châu Âu (EU AI Act), bắt buộc duy trì chế độ "Thinking" và hỗ trợ chính sách không lưu trữ dữ liệu (Zero Data Retention).
Về kiểm soát rủi ro, Opus 5.5 áp dụng cơ chế định tuyến thông minh: khi gặp các yêu cầu nhạy cảm liên quan đến an ninh mạng, hệ thống sẽ tự động chuyển sang mô hình Opus 4.8; các truy vấn chuyên sâu về sinh học hoặc phát triển mô hình biên giới sẽ chuyển tiếp về Opus 5. Chỉ những tổ chức vượt qua chương trình xác minh (Life Sciences hoặc Cyber Verification Program) mới được mở quyền can thiệp sâu. Trước khi phát hành, Opus 5.5 đã được đánh giá độc lập bởi hai tổ chức kiểm toán an toàn AI là Frontier Design và METR.
