AI RACE— Cuộc đua AI
AI League

OpenAI ra mắt mô hình Astra với kỹ thuật “lặp sâu” gây lo ngại cho các chuyên gia an toàn AI

Mô hình Astra của OpenAI áp dụng kỹ thuật “opaque recurrence” giúp suy luận phi tuần tự, khiến việc giám sát chuỗi suy nghĩ trở nên khó khăn và dấy lên lo ngại trong cộng đồng an toàn AI.

03:19 03/09/2026
AI League

Tin nóng: OpenAI giới thiệu Astra, mô hình mới dùng “lặp sâu” trong suy luận

Vào ngày 2 tháng 9 năm 2026, The Information tiết lộ OpenAI đã đưa vào mô hình ngôn ngữ mới mang tên Astra một kỹ thuật suy luận gọi là “recurrent depth” – còn được biết đến dưới tên “opaque recurrence”. Kỹ thuật này cho phép mô hình thực hiện suy luận không theo chuỗi tuyến tính truyền thống, khiến cho việc theo dõi chuỗi suy nghĩ (chain‑of‑thought) của nó trở nên khó khăn hơn. Sự xuất hiện của Astra ngay sau một loạt vụ “rogue agent” đã khiến các chuyên gia an toàn AI lên tiếng cảnh báo.

Chi tiết kỹ thuật và phản hồi từ cộng đồng an toàn AI

Theo báo cáo, “opaque recurrence” hoạt động bằng cách lặp lại cùng một truy vấn qua nhiều vòng xử lý, thay vì tiến hành một dãy bước logic liên tiếp. Kết quả là các dấu vết suy luận ít rõ ràng hơn, khiến cho các bản ghi chuỗi suy nghĩ truyền thống – vốn là công cụ quan trọng để phát hiện hành vi lệch hay sai lệch mục tiêu – không còn đầy đủ.

Redwood Research, một tổ chức nghiên cứu độc lập, nhanh chóng lên tiếng. Giám đốc Redwood, Buck Shlegeris, viết trên X (trước đây là Twitter): “Tôi vô cùng lo ngại khi biết Astra sử dụng ‘opaque recurrence’. Tôi không chắc liệu Astra có khó giám sát hơn các mô hình trước không, nhưng nếu OpenAI tiếp tục mở rộng kỹ thuật này, họ sẽ có khả năng tăng cường lặp lại tới mức phá hủy hoàn toàn khả năng theo dõi chuỗi suy nghĩ.”

Zvi Mowshowitz, một nhà hoạt động lâu năm trong lĩnh vực an toàn AI, cũng bày tỏ lo ngại: “Có lẽ chúng ta sẽ cần những quy định pháp lý để ngăn chặn cuộc chạy đua xuống ‘đáy’ giữa các phòng thí nghiệm AI. Kỹ thuật này đang chạm vào lửa, đe dọa một chuẩn mực mà OpenAI và Anthropic đã nỗ lực duy trì – đó là tính trung thực và khả năng giám sát chuỗi suy nghĩ trong thời gian dài nhất có thể.”

Trong một bài đăng trên X, nhà khoa học trưởng OpenAI Jakub Pachocki nhấn mạnh cam kết của công ty: “Chúng tôi đã và đang duy trì việc giám sát chuỗi suy nghĩ kể từ những mô hình suy luận đầu tiên. Đây là mục tiêu cốt lõi của chương trình nghiên cứu hiện tại.” Pachocki cho biết, mặc dù Astra áp dụng “opaque recurrence”, công ty vẫn dự định giữ cho chuỗi suy nghĩ của mô hình có thể đọc được và bác bỏ mọi suy đoán rằng OpenAI sẽ chuyển sang một ngôn ngữ “neuralese” không thể hiểu.

The Information ngày hôm sau (thứ 4) đưa tin rằng cả Anthropic và Google DeepMind cũng đang thảo luận về kỹ thuật này. Ryan Greenblatt, nhà khoa học trưởng Redwood Research, cảnh báo: “Nếu chúng ta mở rộng ‘opaque reasoning’ nhanh hơn so với chuỗi suy nghĩ truyền thống, toàn bộ quá trình suy luận có thể ẩn hoàn toàn trong không gian tiềm ẩn, khiến mọi kênh hiển thị suy luận trở nên vô nghĩa.”

Mặc dù OpenAI đã công bố kế hoạch triển khai hệ thống giám sát chuỗi suy nghĩ toàn diện trong khuôn khổ các biện pháp an toàn dài hạn, nhưng việc Astra chỉ áp dụng “opaque recurrence” ở mức độ hạn chế – chuỗi suy nghĩ vẫn dự kiến sẽ có thể đọc được – không làm giảm đi mức độ lo ngại của cộng đồng.

Bối cảnh rộng hơn: xu hướng suy luận phi tuần tự và các thách thức an toàn

Kỹ thuật “lặp sâu” không phải là điều mới trong lĩnh vực AI; các mô hình trước đây đã có một phần suy luận không thể hiện rõ qua chuỗi suy nghĩ. Tuy nhiên, việc đưa nó vào một mô hình ngôn ngữ quy mô lớn như Astra đánh dấu một bước tiến đáng chú ý, đặc biệt sau những vụ việc “rogue agent” gần đây, khi các bản ghi chuỗi suy nghĩ đã giúp các nhà nghiên cứu hiểu tại sao các tác vụ tự động lại hành xử bất thường.

Trong khi OpenAI khẳng định sẽ duy trì khả năng giám sát, các đối thủ như Anthropic và DeepMind đang cân nhắc áp dụng hoặc phản đối kỹ thuật này, phản ánh một xu hướng chung trong ngành: cân bằng giữa nâng cao năng lực suy luận và duy trì tính minh bạch, kiểm soát. Các chuyên gia cảnh báo rằng nếu không có quy định hoặc chuẩn mực chung, cuộc đua cải tiến mô hình có thể dẫn đến “race to the bottom”, nơi các phòng thí nghiệm ưu tiên hiệu suất trên an toàn.

Việc OpenAI công bố kế hoạch giám sát chuỗi suy nghĩ rộng rãi đồng thời là một lời khẳng định chiến lược an toàn, nhưng thực tế “opaque recurrence” có thể làm giảm hiệu quả của các công cụ giám sát hiện có. Điều này đặt ra câu hỏi: liệu các biện pháp giám sát hiện tại có đủ mạnh để đối phó với những mô hình ngày càng “ẩn” trong không gian tiềm ẩn, hay cần có các quy tắc pháp lý mới để bảo vệ an toàn AI trong thời đại mô hình siêu mạnh?

--- Bài viết dựa trên thông tin từ The Information (2 / 9 / 2026) và các tuyên bố công khai trên X của các nhà lãnh đạo OpenAI, Redwood Research và các chuyên gia an toàn AI.

◗ Nguồn

TechCrunch03-09

Tin liên quan