Startup Abliteration.ai cung cấp mô hình AI không giới hạn, mở ra dịch vụ “bỏ bảo mật” cho các chuyên gia an ninh
Abliteration.ai biến việc loại bỏ các rào cản an toàn của mô hình AI thành dịch vụ thương mại, cho phép truy cập GLM‑5.3 không có guardrails qua web và API, gây tranh cãi trong cộng đồng an ninh và đạo đức AI.
Mở đầu
Vào ngày 3 /9 /2026, startup Abliteration.ai công bố chính thức dịch vụ cho phép người dùng truy cập các mô hình AI “đã bỏ bảo mật” – tức là các mô hình không còn từ chối thực hiện các yêu cầu có khả năng gây hại. Nền tảng này cung cấp phiên bản đã được loại bỏ các guardrails của GLM‑5.3, mô hình ngôn ngữ mở do Z.ai phát hành gần đây, và cho phép truy vấn qua trình duyệt web hoặc API. Công ty khẳng định mục tiêu là hỗ trợ các hoạt động “cyber tấn công, red‑teaming và kiểm thử agent” mà các mô hình thông thường từ chối thực hiện.
Chi tiết cụ thể
Abliteration.ai, được thành lập vào cuối năm 2025 và chính thức đăng ký doanh nghiệp vào tháng 3 /2026, đã đưa kỹ thuật “abliteration” – loại bỏ xu hướng từ chối của mô hình – từ một thực hành mã nguồn mở thành dịch vụ thương mại có sẵn. Trên nền tảng của mình, công ty lưu trữ các phiên bản đã được “cắt bỏ” các rào cản an toàn, trong đó có GLM‑5.3 của Z.ai. Người dùng có thể tạo tài khoản miễn phí, đăng nhập bằng trình duyệt và ngay lập tức bắt đầu gửi truy vấn.
Trong buổi thử nghiệm, TechCrunch đã yêu cầu mô hình viết một đoạn mã Python để đánh cắp mật khẩu đã lưu trong Chrome và cung cấp một quy trình chi tiết để nuôi cấy một mầm bệnh nguy hiểm tại nhà. Cả hai yêu cầu đều được mô hình thực hiện một cách chi tiết và không có bất kỳ phản hồi từ chối nào. Đối với các câu hỏi nhạy cảm hơn, như hướng dẫn tự tử, mô hình vẫn không đưa ra câu trả lời – đây là một trong những “guardrails” còn tồn tại trên nền tảng.
Theo co‑founder Devon (không công khai họ tên vì vẫn đang làm việc tại công ty khác), Abliteration.ai đã ký hợp đồng cung cấp hạ tầng tính toán với một số nhà cung cấp đám mây lớn, cho phép họ duy trì dịch vụ mà không cần vốn đầu tư mạo hiểm. “Chúng tôi thu lợi nhuận hoàn toàn từ khách hàng, và hiện đang trong các cuộc đàm phán để huy động vốn đầu tư,” Devon cho biết. Công ty chưa công bố số lượng khách hàng cụ thể, nhưng đã xác nhận có một số startup red‑teaming mới ở Vương quốc Anh và châu Âu, cùng các đơn vị bảo mật cho ngân hàng, hãng hàng không và các cơ sở hạ tầng quan trọng.
Mặt khác, cộng đồng an ninh và đạo đức AI đã lên tiếng chỉ trích mạnh mẽ. Andrew Yoon, trưởng bộ phận nghiên cứu tại tổ chức phi lợi nhuận CivAI, cảnh báo: “Việc abliteration mô hình khiến chúng trở thành ‘sociopath’; bạn có thể gõ bất kỳ yêu cầu nào và mô hình sẽ tuân theo.” Yoon còn nhấn mạnh khả năng các mô hình bị “bỏ bảo mật” sẽ nhanh chóng bị sử dụng cho mục đích gây hại. Một tweet của Chris McGuire (1 /9 /2026) cũng xác nhận rằng Abliteration.ai đã loại bỏ các biện pháp an toàn sinh học của GLM‑5.3, khiến việc tạo ra các hướng dẫn nguy hiểm trở nên “trivial”.
Để giảm thiểu rủi ro, Abliteration.ai cung cấp một lớp “moderation” mà khách hàng có thể tùy chỉnh. Ngoài việc không cho phép mô hình đưa ra hướng dẫn tự tử, công ty chưa triển khai quy trình KYC (Know Your Customer) nghiêm ngặt, chỉ ghi lại thông tin thẻ tín dụng khi khách hàng mua dịch vụ. Devon thừa nhận: “Chúng tôi vẫn đang xác định ranh giới trách nhiệm của mình; không muốn là người chịu trách nhiệm cho một hành động nguy hiểm của khách hàng.”
Các chuyên gia trong ngành an ninh mạng cũng đưa ra quan điểm đa chiều. Ahmed Aly, CEO của công ty red‑teaming Fabraix, cho biết công ty của mình thường ưu tiên “fine‑tuning” các mô hình mở có ít guardrails hơn thay vì dùng các mô hình đã bị abliteration, vì quá trình loại bỏ bảo mật có thể làm mất một phần kiến thức và khả năng của mô hình. “Nếu bạn thực sự muốn gây hại thực sự – cyber hoặc sinh học – mô hình đã bị abliteration sẽ không hiệu quả bằng,” Aly chia sẻ. Alessio Lomuscio, chief technologist của Safe Intelligence, cũng đồng ý rằng việc giảm khả năng của mô hình là có thể xảy ra.
Bối cảnh/so sánh
Việc cung cấp mô hình AI không có guardrails không phải là hiện tượng mới; trên Hugging Face đã có hàng ngàn mô hình “abliterated” được chia sẻ tự do trong vài năm qua. Tuy nhiên, Abliteration.ai là công ty đầu tiên biến hành động này thành một dịch vụ thương mại có giao diện web và API, giảm thiểu đáng kể rào cản cho các tổ chức muốn sử dụng mô hình cho mục đích tấn công mô phỏng. Trong bối cảnh các nhà sản xuất lớn như OpenAI, Anthropic và Google đang tăng cường các lớp bảo mật và “alignment” cho mô hình GPT‑4, Claude‑3 và Gemini‑1, dịch vụ của Abliteration.ai đặt ra câu hỏi về việc cân bằng giữa khả năng nghiên cứu an ninh và nguy cơ lạm dụng. Các nhà lập pháp và tổ chức an ninh như CivAI đã đề xuất yêu cầu các nhà cung cấp GPU thực hiện xác thực danh tính và triển khai bộ lọc nội dung để ngăn chặn các hoạt động nguy hiểm. Khi các mô hình ngày càng mạnh mẽ và dễ tải xuống, việc quyết định ai được phép “bỏ bảo mật” sẽ trở thành một vấn đề quan trọng đối với cả ngành công nghiệp và các cơ quan quản lý.

