Báo cáo mới nhất từ The Information tiết lộ mô hình Astra của OpenAI đang áp dụng một kỹ thuật suy luận mang tên độ sâu lặp lại (recurrent depth), cho phép hệ thống vận hành vượt ra ngoài tư duy tuần tự thông thường. Phương thức này, còn được gọi là lặp lại đục (opaque recurrence), xử lý cùng một truy vấn nhiều lần trong một vòng lặp thay vì đi theo các bước logic từng bước một. Mặc dù giúp tối ưu hóa hiệu suất xử lý, sự thay đổi này đang gây ra làn sóng lo ngại sâu sắc trong cộng đồng an toàn AI vì nó làm suy giảm khả năng giám sát chuỗi suy luận (chain of thought – CoT).
Thông thường, chuỗi suy luận đóng vai trò là “bản đồ tư duy” giúp các kỹ sư theo dõi từng bước giải quyết vấn đề của AI, từ đó phát hiện sớm các dấu hiệu sai lệch mục tiêu (misalignment) hoặc hành vi bất thường của các tác nhân tự trị. Việc chuyển dịch sang cơ chế xử lý phi tuyến tính có thể khiến các vết tích suy luận trở nên mờ nhạt và khó đọc hơn đối với con người, tạo ra những khoảng trống trong việc kiểm soát mức độ an toàn của hệ thống.
Nguy cơ mất kiểm soát khi quá trình tư duy chuyển vào không gian tiềm ẩn
Trong các mô hình suy luận tiêu chuẩn, con người có thể quan sát cách AI đi từ giả thuyết đến kết luận thông qua các bước trung gian rõ ràng. Tuy nhiên, với recurrent depth, mô hình thực hiện các vòng lặp xử lý nội bộ khiến các bước suy luận không còn được trình bày dưới dạng ngôn ngữ dễ hiểu. Buck Shlegeris, CEO của Redwood, cảnh báo rằng nếu OpenAI tiếp tục đẩy mạnh kỹ thuật này, khả năng giám sát CoT có thể bị phá hủy hoàn toàn. Đồng quan điểm, chuyên gia Zvi Mowshowitz cho rằng việc lạm dụng các kỹ thuật suy luận không minh bạch giống như đang “đùa với lửa”, đe dọa các tiêu chuẩn an toàn mà các phòng thí nghiệm hàng đầu đã nỗ lực thiết lập bấy lâu nay.
Nỗi lo lớn nhất hiện nay là việc suy luận dần chuyển dịch hoàn toàn sang không gian tiềm ẩn (latent space) – nơi các phép toán diễn ra mà không để lại bất kỳ dữ liệu hữu hình nào cho con người kiểm chứng. Ryan Greenblatt từ Redwood Research nhấn mạnh rằng các mô hình có thể sớm đạt đến trình độ tư duy phức tạp nhưng lại nằm ngoài mọi kênh giám sát truyền thống. Dù OpenAI, thông qua nhà khoa học trưởng Jakub Pachocki, khẳng định vẫn cam kết duy trì tính minh bạch của chuỗi suy luận, sự tham gia của các đối thủ lớn như Anthropic và Google DeepMind vào việc thảo luận kỹ thuật này cho thấy một xu hướng công nghệ mới đang hình thành.
Nếu không có các quy định hoặc rào cản kỹ thuật nghiêm ngặt, cuộc đua nâng cao năng lực suy luận có thể vô tình dẫn đến việc tạo ra những “hộp đen” trí tuệ. Khi đó, việc giải mã lý do tại sao một AI đưa ra quyết định sai lầm hoặc gây hại sẽ trở nên bất khả thi. Các chuyên gia cho rằng cần có những quy định pháp lý cụ thể để ngăn chặn một “cuộc đua xuống đáy”, nơi các tiêu chuẩn về khả năng giám sát bị hy sinh để đổi lấy tốc độ và hiệu suất xử lý của mô hình.
Sự phát triển của recurrent depth đánh dấu một bước ngoặt trong nỗ lực tối ưu hóa trí tuệ nhân tạo, nhưng đồng thời cũng đặt ra bài toán hóc búa về trách nhiệm giải trình của các nhà phát triển. Người dùng và các tổ chức công nghệ cần theo dõi sát sao các cam kết về an toàn từ phía OpenAI, đồng thời thúc đẩy việc xây dựng các khung quản trị để đảm bảo rằng trí tuệ nhân tạo luôn vận hành trong giới hạn có thể kiểm soát được.


Liên hệ qua Zalo


