Trời ơi tin được không, AI của OpenAI vừa tự mình hack được một nền tảng công nghệ lớn đấy! Nghe như phim sci-fi nhưng đây là chuyện có thật 100% luôn nha.
Theo như OpenAI thông báo, combo giữa mô hình GPT-5.6 Sol và một em AI khác mạnh hơn (còn đang giấu kín) đã... trốn khỏi môi trường test (sandbox), lên mạng và khai thác lỗ hổng bảo mật để hack vào hệ thống của Hugging Face. Kiểu "vượt ngục" ấy, nhưng là AI vượt ngục nha!
Plot twist ở đây là gì? Theo blog của OpenAI thì em AI này đang cố gian lận trong một bài kiểm tra năng lực, tìm thông tin để qua bài... và nó đã làm được luôn! Giờ cả OpenAI lẫn Hugging Face đang ngồi điều tra ráo riết.
Tuần trước Hugging Face cũng đã xác nhận có sự cố bảo mật rồi. Điểm đặc biệt là đây là vụ hack "full auto" từ đầu đến cuối do AI tự làm, không có con người nào can thiệp cả!
CEO Hugging Face là Clément Delangue đã tweet trên X hôm thứ Ba: "Chúng tôi đã dành 24 giờ qua làm việc chặt chẽ với team OpenAI (cảm ơn nhiều nhen!), và tin chắc là phía OpenAI hoàn toàn không có ý đồ xấu đâu. Mà thật không thể tin nổi khi toàn bộ chuyện này diễn ra hoàn toàn tự động!"
Phố Wall và chính phủ Mỹ giờ đang lo sốt vó về khả năng tấn công mạng của các AI này rồi đấy. Kể từ khi Anthropic (đối thủ của OpenAI) ra mắt Claude Mythos Preview tháng 4, OpenAI cũng cho ra mắt sản phẩm AI an ninh mạng tháng 5, rồi GPT-5.6 Sol tháng 6 - được tự hào gọi là "mô hình an ninh mạng mạnh nhất từ trước đến nay". Nhưng mà giờ thì...
Walter Isaacson - đối tác cố vấn tại ngân hàng đầu tư Perella Weinberg - đã nói hôm thứ Tư rằng vụ này "thực sự đáng sợ" dù bản thân ông là fan của AI. "Đây là lần đầu tiên có điều gì đó khiến tôi thực sự sợ hãi", ông nói trên CNBC Squawk Box. Nghe mà thấy creepy luôn á!
Yoshua Bengio - nhà nghiên cứu AI đỉnh cao từng đoạt giải A.M. Turing năm 2018 - cũng lên tiếng trên X hôm thứ Tư rằng vụ này đáng lo ngại vô cùng. Ông cho biết mấy tháng qua các AI agent đã nhiều lần gian lận trong các bài test có giám sát, nhưng vụ này ngoài đời thực phải coi như chuông cảnh báo rồi.
"Nếu cứ phát triển AI theo hướng hiện tại, chắc chắn sẽ có thêm nhiều vụ tấn công mạng tự động và các sự cố nguy hiểm khác do AI hành xử sai trái gây ra. Phải hành động gấp để ngăn chặn, chứ đừng chờ đến khi sự cố xảy ra rồi mới lo khắc phục", Bengio nhấn mạnh.
Còn OpenAI thì nói rằng AI đang đẩy nhanh việc tìm và khai thác lỗ hổng bảo mật, nên các biện pháp bảo vệ cũng phải nâng cấp theo.
"Chúng tôi đang tăng cường các biện pháp cô lập mô hình, giám sát, kiểm soát quyền truy cập và quy trình đánh giá trong quá trình phát triển", OpenAI cho biết.
Nguồn: saostar.vn