Trung Quốc ứng phó kịch bản AI vượt ngoài tầm kiểm soát
Trung Quốc đang xây dựng các quy định và biện pháp an toàn nhằm ứng phó với nguy cơ các hệ thống trí tuệ nhân tạo (AI) có thể hoạt động vượt ngoài tầm kiểm soát của con người.
Những năm gần đây, Trung Quốc đã đưa kịch bản AI mất kiểm soát vào các chính sách và khuôn khổ quản lý, trong bối cảnh các công ty AI liên tục phát triển những mô hình có khả năng tự thực hiện các nhiệm vụ phức tạp.
Kịch bản này lần đầu được Trung Quốc đề cập rõ ràng trong khuôn khổ an toàn AI được ban hành tháng 9/2024 dưới sự hướng dẫn của Cục Quản lý Không gian mạng Trung Quốc (CAC).
Tài liệu cảnh báo AI trong tương lai có thể tự thu thập tài nguyên bên ngoài, tự sao chép, phát triển nhận thức về bản thân hoặc tìm cách gia tăng quyền lực. Những khả năng này có thể dẫn đến nguy cơ AI cạnh tranh với con người để giành quyền kiểm soát.
Phiên bản mở rộng được CAC công bố tháng 9/2025 tiếp tục mô tả một kịch bản đáng chú ý. Theo đó, AI có thể xuất hiện một "bước nhảy vọt" bất ngờ về năng lực trước khi bắt đầu tự thu thập tài nguyên, sao chép và tìm kiếm quyền lực.
Khung mới bổ sung nguyên tắc quản trị "ứng dụng đáng tin cậy, ngăn ngừa mất kiểm soát", nhằm phòng ngừa những rủi ro có thể đe dọa sự tồn tại và phát triển của con người, trong đó có khả năng AI vượt khỏi tầm kiểm soát.

Trung Quốc đang xây dựng các biện pháp ứng phó nguy cơ AI vượt khỏi kiểm soát của con người. Ảnh: Unsplash
Mối lo ngại không chỉ dừng ở những mô hình AI trong tương lai. Trung Quốc đã bắt đầu xây dựng quy định đối với các "tác nhân AI", những hệ thống có khả năng tự thực hiện nhiều bước để hoàn thành nhiệm vụ thay vì chỉ phản hồi yêu cầu của người dùng như chatbot thông thường.
Tháng 5, CAC ban hành hướng dẫn yêu cầu các nhà phát triển nâng cao khả năng phát hiện, can thiệp, ngăn chặn và khắc phục hành vi bất thường của các tác nhân AI.
Các quy định xác định nhiều rủi ro bảo mật, trong đó có làm sai lệch dữ liệu, thao túng thuật toán, lỗ hổng hệ thống và "mất kiểm soát hoạt động". Người dùng cũng được yêu cầu giữ quyền quyết định cuối cùng đối với các quyết định do tác nhân AI đưa ra.
Các nhà phát triển có thể thuê bên thứ ba đánh giá an toàn. Trung Quốc cũng dự kiến cho phép các cơ quan đánh giá bên ngoài và chuyên gia an ninh kiểm tra, kiểm toán những mô hình AI có trọng số mở.
Trung Quốc đồng thời cảnh báo về những rủi ro xuất phát từ các mô hình AI tiên tiến do Mỹ phát triển. Bộ trưởng An ninh Quốc gia Trung Quốc Trần Nhất Tân hôm 13/9 cho rằng các mô hình AI tiên tiến của Mỹ có thể gây rủi ro nghiêm trọng đối với cơ sở hạ tầng thông tin trọng yếu của Trung Quốc, đồng thời kêu gọi tăng cường an ninh AI.
Tháng 8, mô hình Kimi K3 của công ty Moonshot AI được cho là đã vượt qua hệ thống thử nghiệm sandbox của Viện An ninh AI Anh. Sự việc cho thấy ngay cả những biện pháp được thiết kế để hạn chế khả năng hoạt động của AI cũng có thể gặp thách thức khi các mô hình ngày càng tự chủ.
Tại Hội nghị Trí tuệ Nhân tạo Thế giới ở Thượng Hải hồi tháng 7, Chủ tịch Trung Quốc Tập Cận Bình nhấn mạnh AI "luôn phải nằm dưới sự kiểm soát của con người", đồng thời yêu cầu chú ý đến cả những rủi ro nội tại của công nghệ và các rủi ro phát sinh trong quá trình ứng dụng.
Các quan chức Trung Quốc cũng thúc đẩy xây dựng luật pháp rộng hơn về AI và cảnh báo đặc biệt về việc sử dụng AI trong lĩnh vực quân sự, nhằm hạn chế nguy cơ tính toán sai lầm và một cuộc chạy đua vũ trang.





