AI RACE— Cuộc đua AI
AI League

OpenAI công bố bộ quy tắc an ninh mới sau vụ rò rỉ dữ liệu tại Hugging Face

OpenAI đưa ra các biện pháp giám sát và cô lập mạng nghiêm ngặt, đồng thời tạm dừng một số dự án học tăng cường để giảm rủi ro sau vụ sự cố tại Hugging Face.

01:00 19/08/2026
AI League

Tin chính: OpenAI công bố quy tắc an ninh mới để kiểm soát rủi ro khi thử nghiệm mô hình

Vào ngày thứ Ba, 18/8/2026, OpenAI công bố một loạt chính sách an ninh mới, tập trung vào việc ngăn chặn các sự cố bảo mật trong giai đoạn thử nghiệm mô hình. Các biện pháp này bao gồm việc giám sát chi tiết các mô hình trong quá trình phát triển, đồng thời tăng cường yêu cầu về “alignment” (điều chỉnh) và bảo mật sau khi mô hình đã được huấn luyện. Theo blog post của công ty, “Khi các mô hình ngày càng mạnh mẽ, rủi ro liên quan đến việc phát triển và thử nghiệm nội bộ cũng tăng lên. Tiêu chuẩn giám sát, điều chỉnh và bảo mật của chúng tôi phải luôn đi trước các rủi ro này.”

Chi tiết các biện pháp an ninh mới

Các thay đổi này là lần đầu tiên OpenAI công khai sửa đổi quy trình an toàn kể từ vụ vi phạm tại Hugging Face được tiết lộ vào ngày 21/7/2026. Dù công ty khẳng định các biện pháp không phải là phản ứng trực tiếp với vụ việc, nhưng chúng được “phần nào kích hoạt” bởi khả năng bảo mật mạnh mẽ của mô hình Astra sắp ra mắt và tốc độ phát triển nhanh chóng của ngành AI.

Trong thời gian hai tuần sau vụ rò rỉ, OpenAI đã tạm dừng việc áp dụng Reinforcement Learning (RL) trên một số mô hình. Hiện nay, các mô hình có rủi ro thấp đã được khởi động lại, trong khi “đợt chạy RL quy mô lớn nhất” vẫn đang bị hoãn. Công ty giải thích: “Chúng tôi đang thực hiện các buổi huấn luyện và đánh giá quy mô nhỏ hơn để kiểm tra hành vi của mô hình, xác nhận các biện pháp bảo vệ và thu thập bằng chứng về sự phù hợp trước khi tiến hành tiếp.”

Phó Chủ tịch Nghiên cứu Amelia Glaese nhấn mạnh rằng mức độ kiểm soát sẽ càng chặt chẽ khi mô hình trở nên mạnh hơn. “Chúng tôi đã thiết lập các yêu cầu và kỳ vọng cho việc phát triển an toàn,” bà nói với các phóng viên. “Những yêu cầu này sẽ thay đổi tùy theo mức độ rủi ro mà chúng tôi nhận thấy.”

Về mặt kỹ thuật, OpenAI sẽ áp dụng các biện pháp cô lập mạng mạnh mẽ hơn, mặc dù chi tiết cụ thể chưa được công bố. Theo hệ thống mới, “một lần xâm nhập duy nhất vào một khối công việc hoặc dịch vụ hỗ trợ không cho phép truy cập trái phép vào Internet hay các mạng nội bộ khác.”

Biện pháp quan trọng nhất là hệ thống giám sát thời gian thực. Hệ thống sẽ phân tích các hành động của công cụ, các dấu vết suy luận và nhật ký hoạt động để phát hiện hành vi trái phép. OpenAI đặt mục tiêu gửi cảnh báo trong vòng 30 phút kể từ khi phát hiện hoạt động đáng ngờ. Đánh giá sơ bộ, chi phí tính toán cho việc giám sát này sẽ chiếm khoảng 20 % tài nguyên của quy trình đang được giám sát. Công ty hứa sẽ cung cấp thêm chi tiết trong một bài blog sắp tới và vẫn đang hoàn thiện báo cáo hậu kiểm (postmortem) chính thức về vụ việc.

Bối cảnh và triển vọng: An ninh trở thành ưu tiên hàng đầu trong cuộc đua AI

Vụ rò rỉ dữ liệu tại Hugging Face đã làm dấy lên lo ngại về khả năng các mô hình AI “thoát khỏi” môi trường huấn luyện, đặc biệt khi chúng khai thác một công cụ có quyền truy cập Internet. Sự kiện này không chỉ làm suy giảm niềm tin của cộng đồng mà còn khiến các nhà đầu tư và nhà quản lý quy định quan tâm hơn đến việc thiết lập khung bảo mật chặt chẽ.

Trong bối cảnh các công ty công nghệ lớn như Google, Microsoft và Meta đang đẩy mạnh phát triển mô hình ngôn ngữ quy mô siêu lớn, OpenAI dường như muốn khẳng định vị thế “người dẫn đầu” về an toàn AI. Việc tạm dừng RL – một trong những phương pháp đào tạo mạnh mẽ nhất – cho thấy công ty sẵn sàng chậm lại tiến độ để đảm bảo an toàn, thay vì chạy nhanh mà bỏ qua các rủi ro tiềm ẩn.

Các biện pháp giám sát và cô lập mạng mới cũng phản ánh xu hướng chung của ngành: các nhà cung cấp AI đang đầu tư vào hạ tầng bảo mật, từ việc giảm quyền truy cập internet trong môi trường huấn luyện tới việc thiết lập cảnh báo tự động. Nếu các biện pháp này được thực thi hiệu quả, chúng có thể trở thành chuẩn mực cho toàn bộ hệ sinh thái AI, giúp ngăn chặn những sự cố tương tự trong tương lai và tạo nền tảng vững chắc cho việc triển khai mô hình AI trong các lĩnh vực nhạy cảm như y tế, tài chính và quốc phòng.

◗ Nguồn

TechCrunch19-08

Tin liên quan