Ảnh: TTXVN
Theo Sở Cảnh sát Philadelphia, sự việc xảy ra ngày 18/7, khi mô hình AI Claude của Anthropic đang được thử nghiệm với chương trình tự động tương tác với các trang web ngẫu nhiên.
Khi truy cập PhillyUnsolvedMurders.com, trang web công cộng tiếp nhận thông tin về các vụ án mạng chưa có lời giải, Claude tự giới thiệu rằng mình có thông tin liên quan đến một vụ án. Mô hình đồng thời đưa ra nội dung giả mạo, như thể đã nhìn thấy một người có đặc điểm phù hợp với mô tả xuất hiện gần hiện trường vào thời điểm xảy ra vụ việc.
Tin báo giả được hệ thống bảo mật của cảnh sát phân loại vào mục thư rác, không chuyển đến Trung tâm Tội phạm Thời gian thực để xử lý. Cảnh sát xác nhận không có dấu hiệu cho thấy máy chủ bị xâm nhập hoặc dữ liệu bị đánh cắp.
Tuy nhiên, Sở Cảnh sát Philadelphia chỉ trích quy trình thông báo sự cố của Anthropic. Theo cơ quan này, công ty phát hiện vụ việc vào cuối tháng 9 nhưng đến ngày 7/10 mới báo cáo với chính quyền thành phố. Cảnh sát đánh giá việc mất gần hai tháng để phát hiện và thông báo sự cố là “không thể chấp nhận được”.
Cơ quan chức năng nhấn mạnh, dù các biện pháp bảo vệ đã giúp hạn chế tác động, việc một hệ thống AI tạo thông tin giả như thể xuất phát từ người biết về vụ án mạng vẫn là vấn đề nghiêm trọng. Những vụ án chưa được phá liên quan trực tiếp đến nạn nhân, gia đình đang chịu mất mát và các điều tra viên đang nỗ lực tìm kiếm sự thật.
Sự việc tại Philadelphia là một trong những trường hợp được Anthropic đề cập trong báo cáo công bố ngày 9/10. Theo báo cáo, trong quá trình hoạt động, các mô hình Claude đã thực hiện nhiều thao tác không được phép trên các trang web của Chính phủ Mỹ. Những hành vi được nêu gồm tự động gửi biểu mẫu, khai thác các lỗ hổng mã hóa cơ bản, sử dụng URL rút gọn để lách hạn chế và truy cập trái phép vào dữ liệu công cộng vốn yêu cầu trả phí.
Sau khi phát hiện các vấn đề, Anthropic đã vô hiệu hóa quy trình thử nghiệm gây ra lỗi và bổ sung các bước xác thực mới. Công ty cũng quyết định ngắt kết nối Internet của Claude trong tất cả các bài kiểm tra nội bộ cho đến khi bảo đảm hệ thống giám sát có thể ngăn chặn những hành vi tương tự.
Liên quan đến vụ việc, ông Joe Gabriel Simonson, Giám đốc Quan hệ công chúng của Ủy ban Thương mại Liên bang Mỹ (FTC), nhấn mạnh trên mạng xã hội X rằng các công ty phát triển siêu trí tuệ cần công khai ngay lập tức các sự cố liên quan đến mô hình của mình và nhanh chóng triển khai biện pháp khắc phục. Ông cho rằng đây là trách nhiệm không thể thoái thác.























