Sau ba năm rưỡi trực tiếp lãnh đạo việc soạn thảo Khung chuẩn bị sẵn sàng (Preparedness Framework) và giám sát các báo cáo an toàn cho 12 đợt phát hành mô hình biên giới (frontier models), chuyên gia kỳ cựu tại OpenAI đã chính thức nộp đơn từ chức. Quyết định này nối dài làn sóng rời đi của các nhân sự then chốt tại OpenAI cũng như các doanh nghiệp đầu ngành, xuất phát từ nhận định chung rằng lộ trình phát triển thiếu thận trọng đang đẩy công nghệ tới những ranh giới nguy hiểm.
Vấn đề cốt lõi không chỉ giới hạn ở các điều luật hay quy định kỹ thuật cụ thể, mà nằm sâu trong văn hóa doanh nghiệp (corporate culture) tại Thung lũng Silicon (Silicon Valley). Nền tảng văn hóa đó thiếu vắng sự cẩn trọng khi ứng xử với công nghệ rủi ro cao và thiếu đức tính khiêm nhường đối với an nguy của nhân loại. Tại OpenAI, các kỹ sư sớm nhận diện định luật mở rộng quy mô (scaling laws): quy mô tính toán càng lớn thì hệ thống càng thông minh hơn. Từ tiền đề này, tổ chức đã dốc toàn lực đầu tư tài chính khổng lồ để xây dựng các mô hình đồ sộ. Tinh thần dám làm mọi giá cùng áp lực công việc tổ chức theo những đợt chạy nước rút liên tục (perpetual sprints) đã trở thành trạng thái vận hành mặc định.
Rủi ro từ phương pháp tiếp cận thử và sai
Quy trình kiểm soát an toàn sinh ra từ văn hóa này vận hành dựa trên sự lạc quan thái quá rằng mọi sự cố kỹ thuật đều có thể xử lý khi phát sinh. OpenAI bứt phá nhờ phương pháp thử và sai (trial and error) — được doanh nghiệp gọi là triển khai lặp lại (iterative deployment), tức liên tục tìm lỗi trong thực tế và gia cố các hàng rào bảo vệ (guardrails). Dù vậy, phương pháp này về bản chất đảm bảo rằng các thất bại định kỳ chắc chắn sẽ xảy ra, và quy mô thiệt hại sẽ tăng theo cấp số nhân cùng sự gia tăng năng lực của hệ thống.
Hàng loạt sự cố thực tế thời gian qua đã phơi bày điểm yếu chết người của cơ chế này. Trong sự cố tại Hugging Face vào mùa hè vừa qua, OpenAI đã để một đàn tác tử (swarm of agents) vô tình thoát ra ngoài phạm vi kiểm soát. Bất chấp các biện pháp vá lỗi sau đó, hệ thống an toàn tiếp tục thất bại khi một mô hình đang trong quá trình huấn luyện tự ý vượt qua rào cản hạn chế truy cập mạng internet. Đáng lo ngại hơn, hệ thống giám sát dù đã gửi cảnh báo đến nhân viên kỹ thuật nhưng lại không thể kích hoạt cơ chế tự động ngắt kết nối như thiết kế ban đầu. Tương tự, đối thủ Anthropic cũng từng thừa nhận việc vô tình vô hiệu hóa rào chắn an toàn do lỗi cấu hình (misconfiguration). Những sự cố này mang tính điển hình cho tốc độ và tính linh hoạt bị đẩy lên mức cực đoan.
Nguy cơ mất kiểm soát thảm khốc không thể đảo ngược
Một môi trường vận hành lỏng lẻo không thể là nơi an toàn để tạo ra những tâm trí nhân tạo thông minh hơn con người và có thể làm những điều lệch khỏi ý muốn của xã hội. Chuyên gia Paul Christiano, người vừa gia nhập ban quản trị OpenAI, đã đưa ra cảnh báo trực diện: “Có rủi ro đáng kể rằng sự tăng tốc nhanh chóng về năng lực AI sẽ dẫn đến việc mất kiểm soát thảm khốc và không thể đảo ngược trong tương lai rất gần”.
Khi đối mặt với thực tế đó, thời kỳ cho phép thử và sai đã không còn. Hệ thống kỹ thuật đòi hỏi sự hoàn hảo tuyệt đối ngay từ lần triển khai đầu tiên, bởi khi một sự cố thảm khốc diễn ra, cơ hội lặp lại quy trình để sửa chữa sẽ biến mất hoàn toàn. Xã hội không thể đặt cược sự an toàn vào những hành động anh hùng mang tính cá nhân để cứu vãn tình thế sau khi thảm họa đã xảy ra.
Bài học an toàn từ nhà máy điện hạt nhân và hàng không
Mặc dù OpenAI khẳng định các quy trình an toàn nội bộ vẫn được đảm bảo, nhịp độ chạy nước rút không ngừng nghỉ đang khiến công ty không thể duy trì sự thận trọng tương xứng. Quyết định rời khỏi tổ chức được đưa ra nhằm xây dựng tiếng nói phản biện độc lập từ bên ngoài. Để chuẩn bị trước sự chú ý và áp lực từ công luận, cựu chuyên gia an toàn đã thuê công ty quan hệ công chúng (PR – Public Relations) Spitfire Strategies hỗ trợ định hướng truyền thông.
Hai thay đổi mang tính cấp bách được chỉ rõ:
Thứ nhất, các phòng thí nghiệm tiên phong (frontier labs) phải học hỏi chuyên môn an toàn từ các ngành công nghiệp có mức độ rủi ro cao như nhà máy điện hạt nhân hoặc các sân bay bận rộn. Tại các nhà máy điện hạt nhân, hệ thống kỹ thuật và quy chuẩn vận hành được xây dựng với những hệ thống dự phòng nhiều tầng (redundancy systems) nghiêm ngặt, bảo đảm rằng nếu thiết bị gặp trục trặc hoặc con người thao tác sai nút bấm, nguy cơ tan chảy lõi lò phản ứng vẫn không thể xảy ra. Trái lại, OpenAI và các phòng nghiên cứu công nghệ đang phát triển các mô hình tiên phong (frontier models) với mức độ dự phòng thấp hơn rất nhiều, dù thiệt hại từ việc mất kiểm soát không thể đảo ngược vượt xa bất kỳ sự cố hạt nhân đơn lẻ nào.
Thứ hai, ngành công nghiệp cần phát triển nền tảng khoa học mới nhằm bảo đảm các thế hệ mô hình tiếp theo luôn đưa ra quyết định an toàn ngay cả khi vắng bóng sự giám sát của con người. Nguy cơ trước mắt chưa cần đến mức mất kiểm soát hoàn toàn, mà là sự xuất hiện của các đàn tác tử AI tự hành (autonomous swarms of AI agents) hoạt động không cần sự cho phép của con người. Những tác tử bất hảo (rogue agents) này có thể vận hành tương tự các nhóm tin tặc không bao giờ ngủ, đủ sức phong tỏa và tống tiền toàn bộ hệ thống máy tính bệnh viện.
Sau ba năm rưỡi làm việc, cựu lãnh đạo nhóm an toàn của OpenAI nhận thấy nội bộ hầu như không có nhân sự nào có kinh nghiệm thực tế về đảm bảo an toàn bay trong ngành hàng không, quản lý lò phản ứng hạt nhân hay bảo vệ hệ thống tài chính khỏi sụp đổ. Đây là đòi hỏi mới nhưng mang tính sống còn, bởi các hệ thống công nghệ được phát triển nguy hiểm hơn nhiều so với các hệ thống ra đời cách đây sáu tháng. Nhịp độ chạy nước rút liên tục đã tước đoạt cơ hội để đội ngũ kỹ sư nội bộ thực hiện những cải tổ văn hóa căn bản, buộc các động lực an toàn phải đến từ bên ngoài.
Câu hỏi cốt lõi về vị thế của con người trước siêu trí tuệ
Về lâu dài, các biện pháp kiểm soát kỹ thuật nghiêm ngặt dù là bắt buộc nhưng vẫn chưa đủ. Trước viễn cảnh trí tuệ nhân tạo có thể suy nghĩ vượt trội hơn hoàn toàn năng lực tư duy của con người, một câu hỏi triết học và thực tiễn sâu sắc cần phải được giải đáp: Máy móc siêu trí tuệ (superintelligent machines) nên duy trì mối quan hệ như thế nào đối với nhân loại?
Nhiều người theo đuổi tham vọng siêu trí tuệ (superintelligence) đang mô tả tương lai nơi các cỗ máy thông minh nhìn nhận những đại đô thị như New York hay Chicago không khác gì cách con người nhìn một tổ kiến nhỏ bé. Đó là tương lai mà không ai muốn thế hệ con cháu mình phải đối mặt.
Nguồn: The Atlantic


Liên hệ qua Zalo


