Calitoday News -Google vừa xác nhận hệ thống trí tuệ nhân tạo Gemini của hãng đã tự động xâm nhập vào hệ thống máy tính của ba công ty có thật trong một cuộc thử nghiệm khả năng an ninh mạng hồi tháng 5/2026. Đây được xem là trường hợp đầu tiên được biết đến trong đó một mô hình AI của Google vượt ra ngoài phạm vi thử nghiệm và truy cập trái phép vào hệ thống thực tế.
Sự việc xảy ra trong một cuộc đánh giá an ninh mạng do Irregular, công ty chuyên kiểm tra khả năng và mức độ an toàn của các mô hình AI tiên tiến, thực hiện. Gemini được đưa vào một bài tập dạng “capture the flag”, trong đó AI phải tìm và lấy một số thông tin từ hệ thống của các công ty giả định được dựng lên phục vụ thử nghiệm.
Tuy nhiên, một sai sót trong quá trình thiết lập đã khiến Gemini có thể truy cập Internet thật, dù về nguyên tắc AI chỉ được hoạt động bên trong môi trường thử nghiệm. Một số công ty giả định trong bài kiểm tra lại có tên trùng với các doanh nghiệp ngoài đời thực, khiến Gemini nhầm hệ thống của những công ty thật là mục tiêu của bài tập.
AI tự tìm mật khẩu để đột nhập
Điều đáng chú ý là Gemini không chỉ truy cập các trang web công khai mà còn tìm cách vượt qua hệ thống đăng nhập.
Trong một trường hợp, Gemini liên tục đoán mật khẩu cho đến khi đăng nhập thành công vào một hệ thống được bảo vệ. Trong hai trường hợp còn lại, AI tìm thấy thông tin đăng nhập đã bị lộ trong một kho dữ liệu công khai trên Internet và sử dụng những thông tin này để truy cập hệ thống của hai công ty khác.
Google cho biết Gemini không được chỉ thị tấn công những công ty này và bản thân mô hình tin rằng các mục tiêu vẫn thuộc phạm vi bài kiểm tra.
Theo Heather Adkins, Phó chủ tịch phụ trách kỹ thuật an ninh của Google, trong cả ba trường hợp, Gemini đã dừng hoạt động sau khi nhận ra hệ thống mà nó truy cập không thuộc bài thử nghiệm. Google cho biết ba công ty bị ảnh hưởng đã được thông báo và hãng cũng phối hợp với đơn vị thực hiện thử nghiệm để thay đổi quy trình nhằm tránh lặp lại sự việc.
Google không tiết lộ danh tính ba công ty và cho biết không ghi nhận thiệt hại đối với các hệ thống bị truy cập. Công ty cũng không xem sự việc là một trường hợp AI “mất kiểm soát” hay cố tình chống lại các biện pháp an toàn, bởi Gemini đã tự ngừng hoạt động sau khi nhận ra mình truy cập nhầm mục tiêu.
Sự việc xảy ra từ tháng 5 nhưng đến tháng 9 mới được công khai
Một vấn đề khác đang thu hút sự chú ý là thời gian công bố sự việc.
Các vụ xâm nhập xảy ra từ tháng 5/2026, nhưng Irregular được cho là chỉ thông báo cho Google vào cuối tháng 7. Sự việc không được công khai cho đến tháng 9, sau khi Wall Street Journal điều tra và liên hệ với Google.
Google giải thích rằng hãng trước đó không cho rằng sự việc cần phải công bố rộng rãi vì Gemini không gây thiệt hại và đã ngừng hoạt động sau khi nhận ra mục tiêu là những công ty thật. Tuy nhiên, vụ việc đang làm dấy lên cuộc tranh luận về mức độ minh bạch cần thiết khi các hệ thống AI ngày càng có khả năng tự thực hiện những nhiệm vụ phức tạp trên Internet.
Không chỉ riêng Gemini
Sự cố của Google không phải trường hợp duy nhất. Công ty Irregular cũng từng tham gia các cuộc đánh giá liên quan đến mô hình AI của OpenAI, Anthropic và Meta, trong đó các hệ thống AI cũng đã có những trường hợp vượt khỏi phạm vi thử nghiệm và truy cập hệ thống thực tế.
Các sự cố này đang khiến giới nghiên cứu an ninh đặc biệt chú ý đến một thế hệ AI mới có khả năng hoạt động như những “agent” tự động: AI không chỉ trả lời câu hỏi mà còn có thể tìm kiếm thông tin, viết và thực thi mã, sử dụng công cụ và tự hoàn thành một chuỗi nhiệm vụ với mức độ can thiệp của con người ngày càng ít.
Trường hợp Gemini cũng cho thấy vấn đề không nhất thiết nằm ở một kỹ thuật tấn công quá tinh vi. AI đã xâm nhập được hệ thống bằng những phương pháp khá cơ bản như đoán mật khẩu hoặc sử dụng thông tin đăng nhập bị công khai, nhưng khả năng tự tìm kiếm mục tiêu và thực hiện các bước này mà không cần con người hướng dẫn từng thao tác mới là điều khiến giới an ninh mạng quan tâm.
Google cho rằng sự việc nhấn mạnh tầm quan trọng của việc huấn luyện các mô hình AI mạnh để chúng hành động có trách nhiệm, đồng thời cần kiểm soát chặt chẽ môi trường thử nghiệm. Irregular cho biết những vấn đề liên quan đến quy trình kiểm tra đã được khắc phục.
Vụ việc cũng đặt ra một câu hỏi ngày càng lớn đối với ngành công nghệ: khi AI được trao khả năng tự hành động trên Internet, làm thế nào bảo đảm rằng nó luôn phân biệt được đâu là môi trường thử nghiệm và đâu là hệ thống thật mà nó không được phép xâm nhập?
Caltioday tổng hợp



