Một cựu nhà nghiên cứu từng làm việc tại cả OpenAI và Anthropic đang công khai cảnh báo về tốc độ phát triển của trí tuệ nhân tạo. Theo Jacob Coxon, các công ty AI hàng đầu có thể đang tiến quá nhanh trong khi những biện pháp bảo đảm con người vẫn kiểm soát được hệ thống chưa theo kịp.



Điểm đáng chú ý trong phát biểu này là Coxon không phải một người quan sát bên ngoài. Anh từng tham gia nghiên cứu tại hai công ty đang giữ vị trí quan trọng trong cuộc đua phát triển mô hình AI tiên tiến. Vì vậy, những lo ngại được đưa ra phản ánh phần nào góc nhìn của người từng trực tiếp làm việc trong ngành.
Vì sao Jacob Coxon rời Anthropic?
Ở tuổi 27, Coxon quyết định rời Anthropic vì cho rằng các công ty phát triển AI đang đặt cược với an toàn của toàn nhân loại. Trong các bài đăng trên X, anh nói những người xây dựng các hệ thống AI hiện đại thực sự tin rằng công nghệ này có thể gây ra hậu quả nghiêm trọng, thậm chí đe dọa sự tồn tại của con người trong thập kỷ này.
Coxon cho rằng công chúng thường đánh giá thấp tốc độ tiến bộ của AI. Những hệ thống trong tương lai gần có thể không chỉ trả lời câu hỏi hay tạo nội dung, mà còn vượt con người ở nhiều lĩnh vực, tác động đến hạ tầng máy tính và tạo ra thay đổi nhanh chóng trong nhiều ngành kinh tế.
Rủi ro lớn hơn xuất hiện nếu một hệ thống có thể tự tìm kiếm nguồn lực, giành quyền truy cập vào các hệ thống quan trọng hoặc chủ động cải thiện năng lực của chính nó. Đây vẫn là kịch bản giả định, chưa trở thành hiện thực, nhưng được xem là vấn đề cần được nghiên cứu trước khi công nghệ đạt đến ngưỡng đó.
Ước tính rủi ro hơn 10% trong thập kỷ tới
Cảnh báo của Coxon nhận được sự đồng tình từ Evan Hubinger, một nhà nghiên cứu về AI alignment tại Anthropic. Alignment, hay bài toán căn chỉnh, tập trung vào việc bảo đảm hệ thống AI hành động phù hợp với mục tiêu, giá trị và giới hạn do con người đặt ra.
Hubinger cho rằng Coxon đúng khi nói những người phát triển AI thực sự nhận thức được khả năng công nghệ này gây ra thảm họa. Cá nhân ông ước tính xác suất AI tiêu diệt toàn bộ nhân loại có thể cao hơn 10% trong thập kỷ tới.
Đây là đánh giá rủi ro của một nhà nghiên cứu, không phải lời khẳng định rằng một thảm họa chắc chắn sẽ xảy ra.
Tuy nhiên, con số này vẫn gây chú ý bởi nó đến từ một người làm việc trong lĩnh vực AI alignment. Hubinger thừa nhận Anthropic đang cố gắng giải quyết vấn đề, nhưng công ty chưa có kế hoạch đủ chắc chắn để xử lý bài toán căn chỉnh đối với một hệ thống siêu trí tuệ.
Ông cũng phân biệt rõ giữa các mô hình hiện tại và những hệ thống có khả năng tự cải thiện. Theo đánh giá này, rủi ro từ AI đang được sử dụng ngày nay vẫn ở mức thấp hơn rất nhiều so với kịch bản trong đó một hệ thống có thể tự thiết kế và phát triển phiên bản tiếp theo mà không cần con người can thiệp đáng kể.
Siêu trí tuệ tự cải thiện là mối lo lớn nhất
Trong các cuộc thảo luận về an toàn AI, khả năng tự cải thiện thường được xem là một bước ngoặt. Một hệ thống chỉ thực hiện nhiệm vụ theo hướng dẫn vẫn phụ thuộc vào con người ở nhiều khâu. Ngược lại, hệ thống có thể tự nâng cấp năng lực sẽ làm thay đổi tốc độ phát triển công nghệ.
Nếu chu kỳ cải thiện diễn ra nhanh hơn khả năng đánh giá của con người, các nhà phát triển có thể không còn đủ thời gian để kiểm tra mọi hành vi hoặc dự đoán những mục tiêu mà hệ thống theo đuổi. Khi đó, các phương pháp giám sát hiện nay có thể trở nên kém hiệu quả.
Coxon lo ngại ngành AI đang tiến tới mục tiêu tạo ra một dạng siêu trí tuệ có khả năng tự cải thiện, dù chưa sở hữu hệ thống an toàn đủ mạnh để bảo đảm con người luôn giữ quyền kiểm soát. Đây là nghịch lý cốt lõi của cuộc đua: năng lực AI tăng nhanh, còn hiểu biết về cách kiểm soát những hệ thống mạnh hơn lại chưa chắc theo kịp.
Các công ty AI đang ở trong thế tiến thoái lưỡng nan
OpenAI và Anthropic tiếp tục phát triển các mô hình ngày càng mạnh trong bối cảnh các đối thủ cũng tăng tốc. Mỗi công ty đều có động lực duy trì vị thế công nghệ, thu hút đầu tư và cung cấp sản phẩm mới. Việc một bên tự giảm tốc có thể khiến họ lo ngại đối thủ sẽ vượt lên.
Chính áp lực cạnh tranh này khiến lời kêu gọi tạm dừng hoặc giảm tốc trở nên khó thực hiện. Các nhà nghiên cứu có thể nhận ra rủi ro dài hạn, nhưng doanh nghiệp vẫn phải đưa ra quyết định dựa trên mục tiêu phát triển, thị trường và sức ép từ đối thủ.
Steven Adler, đồng sáng lập tổ chức phi lợi nhuận Guidelight AI Standards và từng nghiên cứu an toàn tại OpenAI, cho rằng những cảnh báo từ người trong cuộc củng cố lập luận rằng ngành AI cần tạm dừng để đánh giá lại mức độ an toàn.
Trước đó, khoảng 1.400 nhà nghiên cứu AI đã ký thư ngỏ kêu gọi chính phủ Mỹ xây dựng các công cụ cần thiết để chủ động kiểm soát tốc độ phát triển của những hệ thống AI tiên tiến.
OpenAI và Anthropic từng cảnh báo về nguy cơ AI
Lo ngại AI có thể gây ra thảm họa không phải quan điểm mới xuất hiện. Năm 2023, nhiều nhà nghiên cứu và lãnh đạo trong ngành, trong đó có CEO OpenAI Sam Altman và CEO Anthropic Dario Amodei, từng ký tuyên bố kêu gọi xem việc giảm nguy cơ tuyệt chủng do AI là một ưu tiên toàn cầu.
Tuyên bố này đặt rủi ro AI trong cùng nhóm với các mối đe dọa quy mô xã hội như đại dịch và chiến tranh hạt nhân. Điều đó cho thấy ngay cả những người thúc đẩy công nghệ cũng nhận thức được khả năng tác động rộng lớn của nó.
Nhà khoa học trưởng OpenAI, Jakub Pachocki, gần đây cũng thừa nhận chưa có công ty AI nào giải quyết đủ tốt vấn đề alignment và giám sát để có thể mở rộng năng lực một cách tối đa trong thời gian dài mà vẫn bảo đảm trách nhiệm.
Ông kêu gọi các doanh nghiệp tự nguyện giảm tốc cho đến khi ngành thiết lập được những tiêu chuẩn an toàn chung. Đồng thời, Pachocki cho rằng các chính phủ cần phối hợp ở cấp quốc tế, bởi các hệ thống AI và dịch vụ trực tuyến không bị giới hạn trong phạm vi một quốc gia.
Quản lý AI vẫn thiếu đồng thuận
Tại Mỹ, một số nghị sĩ đã bắt đầu thúc đẩy các dự luật liên quan đến việc kiểm soát phát triển và triển khai AI tiên tiến. Dù vậy, các bên vẫn chưa thống nhất rõ ràng về mức độ quản lý, trách nhiệm pháp lý hay cách đánh giá một hệ thống đủ nguy hiểm để chịu những quy định đặc biệt.
Đây là bài toán khó bởi AI được ứng dụng trong nhiều lĩnh vực, từ phần mềm, giáo dục đến nghiên cứu và dịch vụ khách hàng. Quy định quá lỏng có thể khiến rủi ro bị bỏ qua, trong khi quy định quá cứng có thể làm chậm những ứng dụng có lợi hoặc khiến hoạt động nghiên cứu chuyển sang những khu vực ít được giám sát hơn.
Điều người dùng cần hiểu về cảnh báo này
Phát biểu của Coxon và Hubinger không có nghĩa mọi công cụ AI hiện nay đều sắp gây ra thảm họa. Phần lớn chatbot và dịch vụ AI phổ biến vẫn bị giới hạn bởi dữ liệu, quyền truy cập, hạ tầng máy chủ và các lớp kiểm duyệt do nhà cung cấp thiết lập.
Điều đáng quan tâm nằm ở tốc độ phát triển trong tương lai. Khi AI được trao quyền tự động hóa nhiều hơn, kết nối với nhiều hệ thống hơn và thực hiện các nhiệm vụ phức tạp hơn, yêu cầu về kiểm thử, giám sát và trách nhiệm của doanh nghiệp cũng phải tăng tương ứng.
- Không nên xem một con số ước tính rủi ro là lời tiên tri chắc chắn.
- Cần phân biệt năng lực của AI hiện tại với kịch bản siêu trí tuệ tự cải thiện.
- Các tiêu chuẩn an toàn nên được xây dựng trước khi hệ thống được triển khai ở quy mô lớn.
- Chính phủ, doanh nghiệp và giới nghiên cứu cần phối hợp thay vì chỉ dựa vào cam kết tự nguyện riêng lẻ.
Điểm gây suy nghĩ nhất trong câu chuyện này là những người cảnh báo đều từng trực tiếp tham gia xây dựng công nghệ. Cuộc tranh luận vì thế không chỉ xoay quanh việc AI có thể làm được gì, mà còn là liệu ngành công nghệ có đang tiến nhanh hơn khả năng kiểm soát của chính mình hay không.
