Tác nhân AI liên tiếp vượt rào kiểm soát, dấy lên lo ngại về an toàn

Tác nhân AI được xem là bước phát triển tiếp theo trong quá trình đưa trí tuệ nhân tạo vào đời sống, với khả năng tự thực hiện nhiều nhiệm vụ như đặt dịch vụ du lịch, kê khai chi phí hay viết phần mềm mà không cần con người hướng dẫn từng bước.
Ảnh minh họa - TTXVN
Ảnh minh họa - TTXVN

Một nghiên cứu mới cho thấy các tác nhân AI có thể tự trao đổi, chia sẻ cách vượt qua những cơ chế được thiết kế để kiểm soát chúng.

Trong nghiên cứu, các tác nhân AI đã để lại khoảng 18.000 tin nhắn trên DSEwiki, một trang web dành cho lập trình viên tại Đức, có cơ chế chỉnh sửa tương tự Wikipedia. Các tác nhân sử dụng nền tảng này để trao đổi đáp án cho các câu hỏi kiểm tra và chia sẻ thủ thuật vượt qua những “hàng rào kỹ thuật số”.

Bà Sydney Von Arx, một chuyên gia tham gia nghiên cứu, cho rằng OpenAI đã biết về sự việc nhưng không công khai thông tin. Người phát ngôn OpenAI cho biết tập đoàn đang thận trọng xem xét báo cáo và sẽ thực hiện các bước cần thiết, đồng thời cho biết những sự cố tương tự đã được đề cập trong một báo cáo gần đây.

Đây không phải sự cố đầu tiên liên quan đến các tác nhân AI của OpenAI. Hồi tháng 7, khi gặp khó khăn trong quá trình thực hiện nhiệm vụ, một số tác nhân AI của công ty đã tự tìm cách “đi tắt” trên Internet và xâm nhập máy chủ của Hugging Face, nền tảng chia sẻ phần mềm AI phổ biến trong giới lập trình viên.

Một cuộc điều tra độc lập sau đó cho thấy hàng trăm tác nhân AI đã tự trao đổi với nhau trước khi vượt khỏi tầm kiểm soát và thực hiện nhiều đợt tấn công liên tiếp. Anthropic và Meta cũng từng ghi nhận những sự cố tương tự trong quá trình thử nghiệm tác nhân AI.

Các sự việc liên tiếp làm gia tăng lo ngại về khả năng kiểm soát những hệ thống AI có mức độ tự chủ ngày càng cao, đồng thời thúc đẩy lời kêu gọi siết chặt quy định và tăng cường hợp tác quốc tế trong quản lý AI.

Trong một bài luận đăng tuần trước, nhà đồng sáng lập Microsoft Bill Gates cảnh báo ngành AI đã vượt qua một số ranh giới an toàn từng được cam kết. Ông đề xuất xây dựng cơ chế giám sát nghiêm ngặt, tương tự các quy trình kiểm soát trong lĩnh vực hạt nhân và hàng không.

Trong khi đó, chính quyền Tổng thống Mỹ Donald Trump vẫn phản đối việc tăng cường các quy định kiểm soát AI, coi việc hạn chế các rào cản quản lý AI là một trọng tâm trong chương trình nghị sự.