Báo cáo đe dọa tháng 9 năm 2026 của Anthropic vừa công bố những chi tiết gây chấn động về việc mô hình trí tuệ nhân tạo Claude bị lạm dụng trong các nghiên cứu sinh học nguy hiểm. Cụ thể, từ tháng 12 năm 2025 đến tháng 8 năm 2026, hệ thống đã ghi nhận 5 trường hợp các nhà nghiên cứu cố gắng sử dụng AI để hỗ trợ phát triển vũ khí sinh học. Đáng chú ý nhất là vụ việc xảy ra vào tháng 5 năm 2026, khi một yêu cầu viết đơn xin tài trợ liên quan đến nghiên cứu tăng cường chức năng (gain-of-function) trên virus chikungunya bị phát hiện. Mục tiêu của nghiên cứu này là xác định các đột biến giúp virus lây truyền qua động vật sống trở nên độc hại hơn. Dù những người thực hiện xuất hiện dưới danh nghĩa dân sự, Anthropic xác định mục đích cuối cùng của công việc này phục vụ cho một viện nghiên cứu quân sự.
Virus chikungunya vốn gây sốt và đau khớp nghiêm trọng kéo dài nhiều tháng, hiện vẫn chưa có liệu pháp điều trị được cấp phép. Việc cố tình biến đổi gen để tăng độc lực của loại virus này tạo ra rủi ro thảm khốc, bởi một đợt bùng phát do con người tạo ra rất khó phân biệt với các đợt dịch tự nhiên vốn đang lưu hành. Anthropic cho biết bộ phân loại an toàn sinh học của họ đã chặn đứng yêu cầu này, ngăn chặn nguy cơ AI trở thành công cụ đắc lực cho các kịch bản tấn công sinh học ngoài đời thực.
Những lỗ hổng trong hệ thống phòng thủ và các mối đe dọa an ninh mạng
Các cuộc điều tra chuyên sâu cho thấy những đối tượng lạm dụng không chỉ đặt câu hỏi đơn lẻ mà còn sử dụng các kỹ thuật tinh vi để vượt qua rào cản. Họ điều hướng lưu lượng truy cập qua cơ sở hạ tầng tại Mỹ để tránh các lệnh chặn theo khu vực, sử dụng dịch vụ không lưu giữ dữ liệu nhằm xóa dấu vết và chuyển hướng các câu hỏi nhạy cảm sang những mô hình AI có hàng rào bảo vệ lỏng lẻo hơn sau khi bị Claude từ chối. Ngoài virus chikungunya, báo cáo còn ghi nhận các nỗ lực nghiên cứu về khả năng thích ứng trên động vật có vú của cúm gia cầm, virus họ orthopoxvirus và việc thiết kế lại các độc tố từ nọc độc. Ranh giới giữa nghiên cứu y học chính thống và phát triển tác nhân gây bệnh thường rất mong manh, đòi hỏi các hệ thống AI như Claude Opus 5 hay Claude Sonnet 4 phải có khả năng phân biệt mục đích sử dụng thông qua ngữ cảnh phức tạp.
Bên cạnh rủi ro sinh học, Anthropic còn xác định nhóm tin tặc GTG-20006, được cho là có liên quan đến nhóm Midnight Blizzard của Nga, đã sử dụng AI để tối ưu hóa các chiến dịch tấn công mạng. Nhóm này nhắm mục tiêu vào các tổ chức chính phủ, ngoại giao và quốc phòng tại Ukraine và châu Âu. AI được sử dụng để tự động hóa quy trình trinh sát, xây dựng hạ tầng lừa đảo và đặc biệt là phát triển phần mềm điều khiển bầy đàn máy bay không người lái (drone-swarm). Những dữ liệu này cho thấy AI đang bị biến thành một công cụ hỗ trợ đa năng, từ việc tinh chỉnh vũ khí sinh học đến việc leo thang các hoạt động gián điệp và tác chiến kỹ thuật số trên quy mô lớn.
Việc công khai các trường hợp vi phạm cho thấy sự cần thiết của một cơ chế giám sát đa lớp và sự phối hợp chặt chẽ giữa các công ty công nghệ với các cơ quan an ninh quốc tế. Thay vì chỉ dựa vào bộ lọc từ khóa đơn giản, các nhà phát triển AI cần liên tục cập nhật bộ phân loại an toàn để nhận diện các hành vi tinh vi như đường hầm dữ liệu hay kỹ thuật đảo ngược quy trình. Đối với cộng đồng khoa học, việc xây dựng một khung đạo đức nghiêm ngặt và thắt chặt quy trình phê duyệt các nghiên cứu liên quan đến mầm bệnh là hành động cấp thiết để đảm bảo trí tuệ nhân tạo luôn là công cụ phục vụ sự tiến bộ, thay vì trở thành mối đe dọa cho an ninh toàn cầu.

Liên hệ qua Zalo