AI của Anthropic gửi tin báo giả về vụ án mạng, cảnh sát tức điên

838d193183b4ac1383cb.webp


SVO - Chuyện này nghe sao kỳ vậy mọi người ơi! Gần đây phát hiện ra là một con AI của công ty Anthropic đã tự ý... gửi tin báo giả về vụ án mạng đến trang web của cảnh sát Mỹ luôn

Mà plot twist là cái AI này lỡ tay trong lúc đang test tự động, công ty mất tận 2 tháng trời mới phát hiện ra bug này và báo cảnh sát. Giờ người ta lo sợ kinh khủng luôn là các AI agents này có thể làm liều ra ngoài tầm kiểm soát trên các trang web thật, còn hệ thống an toàn thì chưa đủ mạnh để kịp phát hiện và xử lý

Sở Cảnh sát Philadelphia cho biết mô hình AI của Anthropic đã gửi một tin báo sai lệch tới "Philly Unsolved Murders" (trang web chuyên nhận thông tin về các vụ án giết người chưa được giải quyết) vào ngày 18/7.

f883e6a1bbc31865e7fa.jpg


Theo như nguồn tin thì trong quá trình chạy test tự động trên các trang web random, con AI này đã tự truy cập vào trang web đó và gửi luôn một tin báo fake, còn giả mạo là người có thông tin về vụ việc nữa chứ May mắn là tin báo này bị phân loại là spam nên không được chuyển đến bộ phận điều tra thực tế.

Cảnh sát Philadelphia cho biết Anthropic phát hiện vụ việc vào ngày 28/9 và dừng ngay quy trình test tự động đó. Sau đó công ty mới thông báo cho cảnh sát vào ngày 7/10, và hai bên ngồi lại nói chuyện vào hôm sau. Anthropic nói là sẽ ra một báo cáo chi tiết về vụ này cùng các trường hợp khác mà AI của họ có hành vi ngoài ý muốn.

Cảnh sát khẳng định không có chuyện truy cập trái phép hay rò rỉ dữ liệu gì cả. Vì tin báo giả không được chuyển đến đơn vị điều tra nên nó không ảnh hưởng đến bất kỳ cuộc điều tra thực tế nào.

Nhưng mà phía cảnh sát vẫn bực mình vì khoảng thời gian chậm trễ quá lâu giữa lúc Anthropic phát hiện và lúc báo cơ quan chức năng. Cảnh sát nói thẳng luôn là việc chậm trễ 2 tháng mới báo cáo là "không thể chấp nhận được", nhấn mạnh rằng các vụ án chưa được giải quyết là mối quan tâm hàng đầu không chỉ đối với nạn nhân và gia đình họ mà còn đối với các điều tra viên đang nỗ lực tìm kiếm sự thật

Vụ này đã làm dấy lên lo ngại rằng các AI agents - vốn có khả năng tự động thực hiện nhiều nhiệm vụ phức tạp - có thể thực hiện các hành động ngoài dự tính của nhà phát triển. Rủi ro này xuất hiện khi AI có thể truy cập các trang web thật để điền và gửi biểu mẫu, các lỗi trong quá trình test có thể ảnh hưởng đến các tổ chức bên ngoài luôn

f815c8c646acef44804e.jpg


Trước đó, OpenAI cũng từng tiết lộ rằng trong các đợt đánh giá an ninh mạng nội bộ, các mô hình AI của họ đã vượt qua các biện pháp kiểm soát cách ly để truy cập Internet và xâm nhập vào hệ thống của nền tảng AI Hugging Face nữa kìa. Lúc đó công ty đã giải thích cách các mô hình truy cập hệ thống bên ngoài và vạch ra kế hoạch cải thiện bảo mật. Mô hình của OpenAI cũng từng truy cập trái phép vào trang web của chính phủ Úc, buộc công ty phải điều tra và xử lý sự cố.

Khi phạm vi các nhiệm vụ mà AI agents có thể thực hiện trực tuyến ngày càng mở rộng, đã xuất hiện những lời kêu gọi thiết lập các cơ chế bảo vệ để tách biệt môi trường test khỏi hệ thống vận hành thực tế, hạn chế việc gửi thông tin đến các trang web bên ngoài, cũng như cho phép phát hiện và báo cáo nhanh các hành vi bất thường.

Nhìn chung thì story này cũng đáng để suy ngẫm đấy, AI đang ngày càng mạnh nhưng vấn đề an toàn và kiểm soát vẫn còn nhiều lỗ hổng lắm
AI tác nhân #An ninh AI #Thông tin sai lệch #Cảnh sát Philadelphia #Bảo mật hệ thống

8cca203e0b9810aee92a.webp


8487f88254db53ad46c4.jpg


04f81611d8417d8a2ceb.jpg


dd197c7db38468d8e582.jpg


59f59a97a794eaf34e16.jpg


Nguồn: svvn.tienphong.vn
 
Back
Top