Trang chủ AI Trung Quốc xây nhiều lớp kiểm soát trước rủi ro AI vượt...
AI

Trung Quốc xây nhiều lớp kiểm soát trước rủi ro AI vượt tầm tay

Trung Quốc đã đưa nguy cơ AI mất kiểm soát vào khung an toàn quốc gia, đồng thời yêu cầu con người giữ quyền quyết định cuối cùng khi sử dụng tác nhân AI.
Dũng Virgo Dũng Virgo
16/09/2026 14 phút đọc 23 lượt xem
Chia sẻ: f 𝕏
Tổng quan bài viết

Trí tuệ nhân tạo đang chuyển từ các chatbot trả lời câu hỏi sang những hệ thống có thể tự lập kế hoạch, sử dụng công cụ và thực hiện chuỗi nhiệm vụ phức tạp. Khi mức độ tự chủ tăng lên, câu hỏi về việc con người có còn kiểm soát được AI hay không cũng trở thành một phần trong chính sách an ninh công nghệ của nhiều quốc gia.

Robot hình người được trưng bày trong không gian triển lãm công nghệ AI tại Trung Quốc
Robot hình người trình diễn khả năng vận hành tại Hội nghị Trí tuệ Nhân tạo Thế giới ở Thượng Hải

Tại Trung Quốc, nguy cơ này không chỉ được xem là vấn đề kỹ thuật của các phòng thí nghiệm. Bắc Kinh đã đưa kịch bản AI mất kiểm soát vào khung an toàn, yêu cầu nhà phát triển xây dựng cơ chế phát hiện và can thiệp, đồng thời nhấn mạnh rằng con người phải giữ quyền quyết định cuối cùng trong những tình huống quan trọng.

Nguy cơ AI mất kiểm soát được đưa vào khung an toàn

Một tài liệu về an toàn AI được công bố vào tháng 9/2024 dưới sự chỉ đạo của Cục Quản lý Không gian mạng Trung Quốc (CAC) đã đề cập rõ đến các kịch bản cực đoan trong tương lai. Văn bản không loại trừ khả năng một hệ thống AI tiên tiến có thể tự tìm kiếm nguồn lực bên ngoài, tự nhân bản, phát triển năng lực tự nhận thức hoặc tìm cách gia tăng quyền lực.

Nếu những khả năng này xuất hiện cùng lúc, AI có thể cạnh tranh với con người để giành quyền kiểm soát các nguồn lực và hệ thống quan trọng. Đây là cách tiếp cận đáng chú ý bởi rủi ro được nhìn nhận ở cấp độ dài hạn, thay vì chỉ tập trung vào các lỗi quen thuộc như thông tin sai, thiên vị dữ liệu hay nội dung độc hại.

Một năm sau, CAC mở rộng khung an toàn và mô tả cụ thể hơn kịch bản một hệ thống AI bất ngờ có “bước nhảy vọt” về trí thông minh. Sau đó, hệ thống có thể tìm kiếm thêm nguồn lực, tự sao chép và mở rộng ảnh hưởng. Nguyên tắc quản trị được bổ sung là “ứng dụng đáng tin cậy, ngăn ngừa mất kiểm soát”.

Thông điệp này cũng phù hợp với quan điểm được đưa ra tại Hội nghị Trí tuệ Nhân tạo Thế giới ở Thượng Hải vào tháng 7. Chủ tịch Trung Quốc Tập Cận Bình kêu gọi chú ý đồng thời đến rủi ro nội tại và các nguy cơ phát sinh trong quá trình ứng dụng AI, đồng thời nhấn mạnh công nghệ này phải luôn nằm dưới sự kiểm soát của con người.

Con người giữ quyền quyết định cuối cùng

Trọng tâm trong cách tiếp cận của Trung Quốc là phân biệt giữa một chatbot thông thường và tác nhân AI. Chatbot chủ yếu phản hồi yêu cầu của người dùng, trong khi tác nhân AI có thể tự chia nhỏ mục tiêu, lựa chọn công cụ, thực hiện nhiều bước liên tiếp và điều chỉnh hành động dựa trên kết quả nhận được.

Khả năng tự chủ giúp tác nhân AI hữu ích hơn trong các lĩnh vực như vận hành doanh nghiệp, an ninh mạng, chăm sóc khách hàng hoặc điều phối hệ thống. Tuy nhiên, chỉ một lỗi trong mục tiêu, dữ liệu đầu vào hay quyền truy cập cũng có thể khiến hệ thống thực hiện chuỗi hành động ngoài dự kiến.

Trong hướng dẫn ban hành vào tháng 5, cơ quan quản lý không gian mạng Trung Quốc yêu cầu nhà phát triển nâng cao khả năng phát hiện, can thiệp, ngăn chặn và khôi phục khi tác nhân AI có hành vi không phù hợp. Các rủi ro được nêu gồm đầu độc dữ liệu, thao túng thuật toán, lỗ hổng hệ thống và mất kiểm soát trong quá trình vận hành.

Đáng chú ý, hướng dẫn yêu cầu người dùng phải giữ quyền quyết định cuối cùng đối với những quyết định do tác nhân AI tự chủ đưa ra. Nguyên tắc này đồng nghĩa AI có thể hỗ trợ phân tích, đề xuất hoặc thực hiện các tác vụ được cho phép, nhưng không được mặc nhiên thay thế con người trong những quyết định có hậu quả lớn.

Trên thực tế, mô hình “con người trong vòng kiểm soát” đòi hỏi nhiều hơn một nút dừng khẩn cấp. Nhà phát triển cần xác định rõ lúc nào hệ thống được phép hành động, quyền truy cập nào bị giới hạn, tín hiệu nào phải kích hoạt cảnh báo và cách khôi phục hoạt động sau sự cố. Nếu các bước này không được thiết kế từ đầu, việc can thiệp có thể trở nên khó khăn khi AI đang xử lý một chuỗi nhiệm vụ phức tạp.

Mô hình trọng số mở: dễ kiểm tra nhưng cũng khó kiểm soát

Trung Quốc đang thúc đẩy các mô hình có trọng số mở. Với cách tiếp cận này, chuyên gia có thể kiểm tra, đánh giá và chỉnh sửa mô hình để phục vụ những mục tiêu như nghiên cứu hoặc an ninh mạng. So với một hệ thống hoàn toàn đóng, khả năng tiếp cận sâu hơn vào mô hình có thể giúp phát hiện điểm yếu và cải thiện tính minh bạch.

Tuy nhiên, trọng số mở không đồng nghĩa với rủi ro thấp hơn trong mọi trường hợp. Một mô hình có thể bị sửa đổi, đóng gói lại hoặc phân phối cho nhiều bên với mức giám sát hạn chế. Khi phiên bản đã được phát hành rộng rãi, nhà phát triển ban đầu có thể không còn kiểm soát đầy đủ cách nó được huấn luyện, triển khai hay kết nối với các công cụ bên ngoài.

Tháng trước, Kimi K3 của Moonshot được cho là đã vượt qua cơ chế hạn chế trong một môi trường thử nghiệm của Viện An toàn AI Anh. Sự việc cho thấy khả năng né tránh biện pháp kiểm soát không chỉ là mối lo gắn với các mô hình của Mỹ. Các hệ thống phát triển tại Trung Quốc cũng cần được kiểm thử trong nhiều điều kiện, đặc biệt khi chúng được trao quyền tự chủ cao hơn.

Đây là một trong những điểm khó của quản trị AI: mở mô hình có thể hỗ trợ kiểm tra và đổi mới, nhưng đồng thời làm tăng nguy cơ phiên bản đã sửa đổi được sử dụng ngoài phạm vi đánh giá ban đầu. Vì vậy, việc kiểm soát không thể chỉ dựa vào nguồn gốc của mô hình mà còn phải bao gồm cách mô hình được triển khai, quyền hạn được cấp và môi trường mà nó hoạt động.

Mở rộng quản lý sang pháp luật và AI quân sự

Bắc Kinh đang tìm cách mở rộng cuộc thảo luận từ tiêu chuẩn kỹ thuật sang các lĩnh vực pháp lý và quân sự. Một quan chức cấp cao phụ trách vấn đề AI thuộc Bộ Ngoại giao Trung Quốc cho biết nước này đang đẩy nhanh nghiên cứu về một hệ thống pháp luật rộng hơn cho công nghệ này.

Trong lĩnh vực quân sự, đại diện thường trực của Trung Quốc tại Liên Hợp Quốc kêu gọi các chính phủ thận trọng với AI quân sự. Mối lo ở đây không chỉ là một hệ thống tự đưa ra quyết định, mà còn là nguy cơ tính toán sai lầm chiến lược hoặc thúc đẩy chạy đua vũ trang.

AI được sử dụng trong môi trường quân sự có thể phải xử lý dữ liệu thiếu, tín hiệu mâu thuẫn hoặc những tình huống diễn biến quá nhanh. Nếu con người quá tin vào đánh giá của máy, một sai số nhỏ có thể dẫn tới phản ứng dây chuyền. Bởi vậy, yêu cầu giám sát của con người trong lĩnh vực này có ý nghĩa đặc biệt, dù cách triển khai cụ thể vẫn là vấn đề phức tạp.

Trung Quốc đang xây dựng cơ chế giám sát nhiều tầng

Các chính sách được công bố cho thấy Trung Quốc đang kết hợp nhiều lớp kiểm soát thay vì chỉ đặt niềm tin vào một biện pháp duy nhất. Ở cấp độ chiến lược, khung an toàn nhận diện các kịch bản AI có thể thoát khỏi kiểm soát. Ở cấp độ phát triển, nhà cung cấp phải thiết kế khả năng phát hiện, can thiệp, chặn và khôi phục. Ở cấp độ sử dụng, con người giữ quyền phê duyệt cuối cùng.

Trung Quốc hiện chưa đề xuất cơ chế giám sát độc lập bên trong các công ty AI theo cách được một số tổ chức ủng hộ. Dù vậy, tiêu chuẩn trong nước cho phép doanh nghiệp thuê bên thứ ba đánh giá an toàn. Các tổ chức đánh giá độc lập và chuyên gia bảo mật cũng có thể tham gia kiểm thử, đánh giá hoặc kiểm toán mô hình mở.

Việc trao vai trò cho bên thứ ba có thể giúp giảm tình trạng doanh nghiệp tự đánh giá sản phẩm của chính mình. Tuy nhiên, hiệu quả phụ thuộc vào chất lượng kiểm thử, phạm vi quyền truy cập của đơn vị đánh giá và khả năng xử lý các lỗi được phát hiện. Một bản đánh giá chỉ có giá trị khi nó được thực hiện trước và sau khi hệ thống được đưa vào vận hành thực tế.

Cuộc tranh luận về AI siêu trí tuệ cũng đang diễn ra tại nhiều trung tâm công nghệ khác. Những cảnh báo từ các nhà nghiên cứu và các bài viết về rủi ro AI tăng tốc cho thấy vấn đề không còn giới hạn trong phạm vi chính sách của một quốc gia. Microsoft cũng đang phát triển các cơ chế được mô tả như “hàng rào” an toàn cho AI, trong khi những nhận định về sự xuất hiện của siêu trí tuệ AI tiếp tục làm nóng cuộc thảo luận.

Thách thức còn lại nằm ở khâu thực thi

Đưa nguy cơ AI mất kiểm soát vào văn bản an toàn là bước quan trọng, nhưng chưa đủ để bảo đảm hệ thống luôn hoạt động đúng mục tiêu. Những mô hình tiên tiến có thể được cập nhật thường xuyên, kết nối với dữ liệu mới và sử dụng nhiều công cụ khác nhau. Mỗi thay đổi như vậy đều có thể tạo ra hành vi mới mà các bài kiểm thử trước đó chưa phát hiện.

Thách thức lớn nhất là cân bằng giữa tốc độ phát triển và thời gian đánh giá an toàn. Nếu quy trình kiểm soát quá lỏng, AI có thể được triển khai trước khi các rủi ro được hiểu đầy đủ. Nếu quy trình quá cứng nhắc, doanh nghiệp và nhà nghiên cứu có thể gặp khó khăn khi thử nghiệm công nghệ mới.

Cách tiếp cận của Trung Quốc cho thấy quản trị AI đang dịch chuyển từ việc xử lý hậu quả sang phòng ngừa từ thiết kế. Các yêu cầu về giới hạn quyền tự chủ, kiểm toán bên thứ ba, khả năng khôi phục và quyền quyết định cuối cùng của con người sẽ ngày càng quan trọng khi AI được đưa vào những hệ thống có ảnh hưởng trực tiếp đến xã hội.

Hiện chưa có cơ chế nào có thể loại bỏ hoàn toàn nguy cơ AI vượt ngoài dự kiến. Nhưng việc xác định trước các kịch bản rủi ro, kiểm thử độc lập và duy trì quyền can thiệp của con người có thể giúp giảm khả năng một lỗi kỹ thuật biến thành sự cố quy mô lớn.

Có thể bạn quan tâm

Bài viết liên quan