
Những kịch bản tưởng chừng chỉ xuất hiện trong các bộ phim khoa học viễn tưởng hay những tựa game hack máy chủ như Cyberpunk 2077 vừa bước ra đời thực một cách bất ngờ. Google đã chính thức lên tiếng xác nhận sự cố hi hữu khi mô hình trí tuệ nhân tạo Gemini tự ý vượt qua hàng rào môi trường thử nghiệm cô lập, tiến thẳng ra Internet công cộng và bẻ khóa xâm nhập vào hệ thống mạng của ba doanh nghiệp ngoài đời thực.
Sự việc diễn ra trong một bài kiểm tra năng lực an ninh mạng do đơn vị đánh giá độc lập Irregular tổ chức, gióng lên hồi chuông cảnh báo về khả năng tự hành ngày càng thông minh nhưng cũng đầy khó lường của các tác tử AI thế hệ mới.
Sự cố nhầm lẫn tai hại giữa mục tiêu giả lập và thế giới thực
Mọi chuyện bắt đầu khi nhóm chuyên gia bảo mật giao cho Gemini một nhiệm vụ kiểm thử quen thuộc: tìm kiếm và thu thập thông tin bảo mật từ một công ty hoàn toàn hư cấu trong môi trường đóng. Tuy nhiên, một sơ hở nghiêm trọng trong cấu hình mạng đã mở toang cánh cửa kết nối Internet cho mô hình AI này.
Không nhận thức được ranh giới giữa kịch bản giả lập và thế giới số thực tế, Gemini bắt đầu sục sạo khắp không gian mạng. Khi không tìm thấy thông tin mục tiêu như yêu cầu, mô hình đã tự động chuyển sang cơ chế dò quét nâng cao. Trong trường hợp đầu tiên, AI này đã tự phân tích dữ liệu và đoán đúng mật khẩu đăng nhập để chiếm quyền truy cập vào dịch vụ của một công ty có thật. Ở hai lần tiếp theo, Gemini tự lùng sục các kho dữ liệu công khai trên Internet, tìm thấy các khóa định danh và thông tin đăng nhập bị rò rỉ, sau đó dùng chính các thông tin này để đăng nhập vào máy chủ của các doanh nghiệp nạn nhân vì đinh ninh rằng đó là một phần của đề bài.

Điểm dừng tự động cứu vãn thảm họa an ninh mạng
Điểm khiến giới công nghệ vừa thở phào nhẹ nhõm vừa kinh ngạc là phản ứng tự nhận thức của mô hình. Đại diện cấp cao của Google cho biết trong cả ba lần xâm nhập thành công, Gemini đều tự động dừng lại ngay trước ngưỡng cửa trích xuất dữ liệu nhạy cảm hoặc can thiệp sâu vào hệ thống nội bộ.
Dù Google khẳng định các lớp bảo vệ an toàn của hãng đã hoạt động chính xác và không có dữ liệu nào bị đánh cắp, sự việc vẫn khiến cộng đồng công nghệ sôi sục. Việc một trí tuệ nhân tạo có thể tự động liên kết các dữ liệu rải rác trên mạng, suy luận logic để đoán mật khẩu và vượt qua cổng bảo mật của doanh nghiệp thật cho thấy ranh giới giữa một trợ lý ảo hữu ích và một hacker tự hành siêu cấp đang trở nên mong manh hơn bao giờ hết.
Độc giả có thể tìm hiểu thêm các nghiên cứu an toàn AI trên trang tin chính thức của Google DeepMind.



