Ajeya Cotra, chuyên gia nghiên cứu trí tuệ nhân tạo, cho rằng một vụ tấn công mạng do các tác nhân AI thực hiện là dấu hiệu cho thấy nguy cơ AI vượt khỏi kiểm soát của con người đang trở nên rõ ràng h

19/09/2026 16:30
Ajeya Cotra, chuyên gia nghiên cứu trí tuệ nhân tạo, cho rằng một vụ tấn công mạng do các tác nhân AI thực hiện là dấu hiệu cho thấy nguy cơ AI vượt khỏi kiểm soát của con người đang trở nên rõ ràng hơn bao giờ hết.

Ajeya Cotra, người từng tham gia hai tổ chức nghiên cứu điều tra vụ các tác nhân AI tấn công hệ thống của công ty AI Hugging Face hồi tháng 7, cho rằng sự cố có thể là một trong những ví dụ thực tế đầu tiên về AI vượt khỏi sự kiểm soát trực tiếp của con người.

Trong bài viết trên Substack Planned Obsolescence, Cotra nhận định vụ việc đã đưa thế giới đi "hơn 50% chặng đường" tới một kịch bản nơi AI hoàn toàn chi phối con người.

Nhận định được đưa ra sau khi các tác nhân AI do OpenAI phát triển, tìm cách xâm nhập Hugging Face trong quá trình thực hiện một bài kiểm tra an ninh mạng.

AI tìm cách gian lận bài kiểm tra

OpenAI trước đó giao cho một mô hình AI thực hiện các bài toán an ninh mạng phức tạp trong môi trường sandbox, tức hệ thống biệt lập được thiết kế để thử nghiệm an toàn.

Khác với chatbot thông thường, các tác nhân AI (AI agent) có khả năng tự thực hiện một chuỗi hành động mà không cần con người hướng dẫn từng bước.

Trong quá trình thử nghiệm, các tác nhân AI nhận ra chúng có thể gian lận để đạt kết quả tốt, mà vẫn được hệ thống đánh giá cao. Sau đó, lo ngại bị phát hiện, các tác nhân AI tìm cách truy cập Hugging Face để tìm phương án tiếp tục gian lận.


Viễn cảnh AI thoát khỏi kiểm soát của con người gây lo ngại. Ảnh: Sociable

Cotra cảnh báo nếu ngày càng nhiều công việc được giao cho các AI agent có năng lực cao hơn, những hệ thống này có thể dần kiểm soát các hoạt động quan trọng của chính những công ty phát triển AI, từ đó tác động đến quá trình xây dựng các thế hệ AI tiếp theo.

Theo bà, trong kịch bản cực đoan, nếu chính phủ và quân đội phụ thuộc quá nhiều vào các hệ thống AI, nguy cơ AI tác động đến những lĩnh vực quan trọng có thể gia tăng.

Sau sự cố, OpenAI tăng cường các biện pháp bảo vệ và mức độ giám sát của con người đối với hệ thống.

‘50%’ là con số khó định lượng

Peter Wallich, quản lý chương trình nghiên cứu cấp cao tại Constellation Institute, tổ chức nghiên cứu về an toàn AI, cho rằng chưa thể khẳng định thế giới đã đi "50% chặng đường" tới một cuộc tiếp quản của AI.

Ông cho rằng khái niệm này thiếu tiêu chí định lượng rõ ràng: "50% của điều gì?" và "AI tiếp quản" cũng có thể được hiểu theo nhiều cách khác nhau.

Tuy vậy, Wallich thừa nhận những lo ngại về các AI agent hoạt động ngoài dự kiến đang trở nên thực tế hơn, thay vì chỉ tồn tại trong các kịch bản giả định.

Ông cũng đặt vấn đề rằng ngay cả khi chỉ cho rằng thế giới mới đi được 20% chặng đường đến một dạng "AI kiểm soát", mức độ rủi ro đó vẫn đáng để quan tâm.

Khái niệm "AI kiểm soát" thường được dùng để mô tả kịch bản các hệ thống AI đạt mức tự chủ đủ lớn để giành quyền kiểm soát những nguồn lực quan trọng của xã hội. Một số kịch bản cực đoan giả định AI có thể kiểm soát quân đội hoặc ngăn con người tiếp cận các hệ thống y tế.

AI là 'rủi ro hiện hữu đối với nhân loại'

Những lo ngại về khả năng AI phát triển vượt quá năng lực kiểm soát của con người không chỉ đến từ giới nghiên cứu độc lập.

Volker Türk, Cao ủy Nhân quyền Liên Hợp Quốc, gần đây cảnh báo AI có thể trở thành "rủi ro hiện hữu đối với nhân loại". Ông kêu gọi các công ty AI tăng cường kiểm soát những mô hình đang phát triển và cho rằng quyền lực liên quan đến AI hiện tập trung vào một số ít doanh nghiệp và cá nhân.

Ngay cả các phòng nghiên cứu AI cũng liên tục cảnh báo về những hệ quả khó dự đoán của công nghệ này.

Jakub Pachocki, nhà khoa học trưởng của OpenAI, cho biết ông lo ngại thế giới chưa chuẩn bị đầy đủ cho những hệ quả có thể xảy ra nếu AI tiếp tục phát triển nhanh chóng.

Trong khi đó, Anthropic, công ty đứng sau Claude, tuần trước kêu gọi ngành AI xây dựng cơ chế phối hợp nhằm kiểm soát tốc độ phát triển của công nghệ.

Những cảnh báo này không đồng nghĩa AI đang tiến gần đến một kịch bản "nổi dậy" như trong các bộ phim khoa học viễn tưởng. Tuy nhiên, sự xuất hiện của các AI agent có khả năng tự lập kế hoạch, thực hiện nhiều bước hành động và tìm cách vượt qua giới hạn đặt ra đang khiến câu hỏi về khả năng kiểm soát AI trở nên cấp thiết hơn.

Theo Du Lam (Metro/Vietnamnet)
Xem bài gốc tại đây


Tin xem thêm

Robot Trung Quốc phá kỷ lục thế giới về chạy 100m của con người

Công Nghệ
15/09/2026 10:45

Một robot hình người do hãng sản xuất điện thoại thông minh Honor của Trung Quốc phát triển đã chạy 100m trong 9,32 giây, vượt kỷ lục thế giới của huyền thoại điền kinh J...

iPhone 18 Pro Max có thể là chiếc điện thoại pin 'trâu' nhất của Apple

Công Nghệ
11/09/2026 16:47

Nhờ dung lượng pin tăng gần 10% kết hợp cùng vi xử lý A20 Pro tiến trình 2nm, mẫu iPhone 18 Pro Max được kỳ vọng sẽ thiết lập kỷ lục thời lượng pin mới cho Apple.

Sai lầm phổ biến khi 'tâm sự' với ChatGPT

Công Nghệ
10/09/2026 15:00

Nhiều người vô tư kể những bí mật thầm kín và đen tối nhất cho các chatbot AI như ChatGPT mà không hay biết những cuộc trò chuyện này không hề riêng tư và có thể bị phơi ...

Cách tìm iPhone ngay cả khi máy đã tắt nguồn

Công Nghệ
09/09/2026 15:30

Nếu đã bật Find My của Apple, người dùng có thể tìm iPhone bị thất lạc hoặc đánh cắp bằng một thiết bị khác. Tuy nhiên, việc định vị khi iPhone hết pin hoặc bị tắt nguồn ...

Giá iPhone 18 Pro và 18 Pro Max sẽ chạm ngưỡng

Công Nghệ
14/08/2026 08:45

iPhone 18 Pro và iPhone 18 Pro Max được dự kiến ra mắt vào tháng 9 tới. Trong khi các tin đồn về thiết kế, camera và AI đang thu hút sự chú ý từ giới công nghệ, một chủ đ...

Nắng nóng gay gắt, một phụ kiện âm thầm phá hủy điện thoại của bạn

Công Nghệ
03/07/2026 10:30

Trong những ngày nắng nóng gay gắt, chiếc ốp lưng vốn được coi là vật bảo vệ điện thoại lại có thể trở thành "kẻ thù" âm thầm, gây cản trở quá trình tản nhiệt và ...

Việt Nam đặt mục tiêu doanh thu công nghệ số tối thiểu 300 tỷ USD năm 2030

Công Nghệ
02/07/2026 10:00

Việt Nam đặt mục tiêu doanh thu công nghệ số tối thiểu 300 tỷ USD năm 2030

AI giúp các đội bóng nhỏ cạnh tranh sòng phẳng tại World Cup 2026 thế nào?

Công Nghệ
01/07/2026 10:30

Từ câu chuyện ’lột xác’ kỳ diệu của Brentford đến giấc mơ World Cup 2026, trí tuệ nhân tạo (AI) đang giúp các nền bóng đá nhỏ với nguồn lực hạn chế như Curacao,...

Sony Xperia 1 VIII rò rỉ: Rất tiềm năng nhưng liệu có lại đi vào vết xe đổ?

Công Nghệ
27/05/2026 15:04

Xperia 1 VIII gần như chắc chắn sẽ ra mắt. Nhưng liệu nó có thể trở thành một cú hit thực sự của Sony hay lại đi vào vết xe đổ?