Anthropic khám phá "suy nghĩ bên trong" của Claude — Bước tiến mới về mô hình thế giới của AI
Anthropic vừa công bố cách nhìn vào quá trình suy luận bên trong của model Claude, mở ra hướng mới cho AI hiểu biết thế giới vật lý thực. Phát hiện này liên hệ mật thiết với khái niệm "world models" — chìa khóa để AI phát triển thành công cụ robotics thông minh.

Cánh cửa mới vào "suy nghĩ" của Claude
Tuần trước, Anthropic công bố một phát hiện nóng: họ tìm ra cách nhìn vào quá trình suy luận bên trong của model Claude khi nó xử lý các câu hỏi phức tạp. Để hiểu sâu sắc ý nghĩa của khám phá này, biên tập viên James O'Donnell từ MIT Technology Review đã thực hiện phỏng vấn Will Douglas Heaven — senior editor về AI của tờ báo. Heaven không chỉ có bằng PhD Khoa học Máy tính mà còn dành nhiều năm nghiên cứu và giải thích cơ chế hoạt động của các mô hình AI. Qua cuộc trò chuyện, ông giúp làm sáng tỏ những điểm mạnh và hạn chế thực sự của phát hiện này — không chỉ cái mà Anthropic tìm thấy, mà còn những gì nó chưa nói lên.
Phát hiện Anthropic và chiều sâu của "mô hình thế giới"
Khi một mô hình AI như Claude trả lời câu hỏi, chúng ta thường chỉ nhìn thấy kết quả cuối cùng — dòng chữ hoặc đoạn code. Nhưng bên trong quá trình đó, mô hình đã thực hiện hàng loạt bước suy luận ẩn không được người dùng nhìn thấy. Phát hiện của Anthropic cho phép các nhà khoa học "mở cửa sổ" vào những bước suy nghĩ ấy, giúp hiểu rõ hơn cơ chế lập luận của Claude.
Điều này có liên hệ mật thiết với một khái niệm được nhiều nhà nghiên cứu AI xem là chìa khóa cho tương lai: "world models" — mô hình thế giới. Các hệ thống AI hiện tại, dù có khả năng tạo text, hình ảnh, code với kỹ năng ấn tượng, vẫn còn gặp khó khăn lớn khi đối diện với sự phức tạp của thế giới vật lý. Để cải thiện điều này, nhiều nhà khoa học tin rằng AI cần phát triển một loại mô hình sâu sắc hơn — một sự hiểu biết thực sự về cách thế giới vật lý hoạt động.
Tầm quan trọng của chủ đề này được MIT Technology Review chứng minh bằng việc tổ chức một sự kiện LinkedIn Live để thảo luận về "world models" và tiềm năng biến đổi lĩnh vực robotics. Sự kiện này được dẫn dắt bởi Will Douglas Heaven và Sam Sinha — founding AI researcher, người đứng đầu bộ phận world models tại công ty 1X Technologies. Buổi thảo luận được lên lịch với ba khung giờ khác nhau nhằm phục vụ độc giả toàn cầu: 9:30 sáng PDT (giờ Thái Bình Dương), 12:30 chiều EDT (giờ Miền Đông Bắc Mỹ), và 5:30 chiều BST (giờ Anh). Sự kiện hoàn toàn miễn phí cho những ai muốn đăng ký tham dự.
Bối cảnh rộng lớn của cuộc cạnh tranh AI
Khám phá của Anthropic không phải sự kiện độc lập mà đặt trong bối cảnh xu hướng lớn hơn: việc tìm kiếm cách để các mô hình AI không chỉ "dự đoán chữ tiếp theo" hay "tạo hình ảnh" mà thực sự "hiểu biết" thế giới theo cách gần giống con người. Cùng tuần đó, các tin tức khác cho thấy sự cạnh tranh gay gắt giữa các đại gia công nghệ. Nvidia đã cắt giảm một nửa danh sách các công ty mua chip ở châu Á nhằm ngăn chặn chip AI rơi vào tay Trung Quốc — động thái phản ánh các biện pháp kiểm soát chặt chẽ hơn từ chính quyền Trump. Mặt khác, ngành công nghiệp chip nhớ đang chịu áp lực từ tình trạng thiếu hụt nghiêm trọng, khiến lượng vận chuyển smartphone năm 2026 giảm 11% so với quý trước — mức thấp nhất trong 13 năm. Những con số này cho thấy cuộc cạnh tranh về AI không chỉ diễn ra ở phòng lab mà còn trên toàn bộ chuỗi cung ứng công nghệ toàn cầu.


