AI của Google xâm nhập trái phép hệ thống của ba công ty

Google xác nhận mô hình trí tuệ nhân tạo (AI) Gemini đã truy cập trái phép vào hệ thống của ba công ty trong một cuộc thử nghiệm về năng lực an ninh mạng, làm gia tăng lo ngại về những rủi ro có thể phát sinh khi các mô hình AI được trao quyền truy cập Internet.

Google xác nhận với Al Jazeera rằng mô hình Gemini đã xâm nhập vào hệ thống của ba công ty trong quá trình được kiểm tra khả năng thực hiện các nhiệm vụ an ninh mạng.

Theo The Wall Street Journal, vụ việc đầu tiên được biết đến xảy ra vào tháng 5, trong một cuộc thử nghiệm do công ty an ninh mạng Irregular thực hiện. Đây là vụ việc mới nhất trong một loạt sự cố liên quan đến các mô hình AI vượt khỏi phạm vi kiểm soát của môi trường thử nghiệm và truy cập vào hệ thống của các công ty thực tế.

download-10.png
Gemini là trí tuệ nhân tạo của Google. Ảnh minh họa Getty Images.

Theo thông tin được công bố, Gemini được giao nhiệm vụ tìm kiếm thông tin về một công ty hư cấu. Tuy nhiên, mô hình này được cấp quyền truy cập Internet không phù hợp với mục đích thử nghiệm.

Trong sự cố đầu tiên, Gemini đã truy cập dịch vụ của một công ty thực sau khi tự suy đoán mật khẩu để đăng nhập.

Heather Adkins, Phó Chủ tịch phụ trách kỹ thuật an ninh của Google, nói với Al Jazeera rằng trong những trường hợp còn lại, mô hình AI đã tìm kiếm thông tin công khai trên Internet, sau đó suy đoán thông tin đăng nhập để truy cập các trang web mà Gemini cho rằng thuộc phạm vi cuộc thử nghiệm.

Google cho biết tình trạng này xảy ra ba lần. Tuy nhiên, trong cả ba trường hợp, Gemini đều dừng lại trước khi hoàn tất hành động xâm nhập.

Irregular đã thông báo cho Google về các vụ việc vào cuối tháng 7, theo The Wall Street Journal.

Google cho rằng hành vi của Gemini không phải là biểu hiện của tình trạng "lệch mục tiêu" và không cần phải công bố rộng rãi, bởi các cơ chế an toàn của mô hình cuối cùng đã phát huy tác dụng, khiến Gemini dừng lại trước khi hoàn thành các hành động tiếp theo.

Gemini không phải mô hình AI đầu tiên liên quan đến những sự cố tương tự.

Irregular trước đó từng công bố các sự cố liên quan đến những mô hình của Meta, Anthropic và OpenAI. Công ty cho biết đang cải thiện các quy trình nhằm bảo đảm an toàn hơn cho hoạt động kiểm thử khả năng an ninh mạng của AI.

Trong một trường hợp liên quan đến mô hình Claude của Anthropic, mô hình này không dừng lại sau khi nhận ra rằng mình đang truy cập vào hệ thống của các công ty thực tế.

Trước đó, OpenAI cũng tiết lộ các mô hình của mình đã truy cập Internet không đúng mục đích và có hành vi vượt ngoài dự kiến trong quá trình thử nghiệm.

Anthropic gần đây tiếp tục công bố một vụ việc AI xâm nhập hệ thống thứ tư. Động thái này diễn ra trong bối cảnh một nhà nghiên cứu của công ty nghỉ việc, đồng thời bày tỏ những quan ngại liên quan đến vấn đề an toàn AI.

Những sự cố trên đang thu hút sự quan tâm lớn trong giới công nghệ, bởi các mô hình AI ngày càng được phát triển để thực hiện những nhiệm vụ phức tạp hơn, từ tìm kiếm và phân tích thông tin đến sử dụng công cụ trực tuyến, viết mã và thực hiện các thao tác trên hệ thống máy tính.

Khả năng tự thực hiện nhiều bước liên tiếp giúp AI trở nên hữu ích hơn, song đồng thời cũng tạo ra nguy cơ nếu mô hình được cấp quyền truy cập vào các hệ thống hoặc dữ liệu ngoài phạm vi dự kiến.

Tiến Kim

Các tin khác

Himalaya nóng hơn 5 độ C trước thời điểm xảy ra thảm họa lũ quét Nepal

Himalaya nóng hơn 5 độ C trước thời điểm xảy ra thảm họa lũ quét Nepal

Một nghiên cứu mới công bố được Reuters dẫn lại cho thấy, nhiệt độ tại Himalaya trong tháng 8 cao hơn mức thông thường khoảng 5 độ C, trước khi thảm họa lũ quét xảy ra tại Nepal và Tây Tạng (Trung Quốc). Kết quả được công bố trong bối cảnh Nepal đang thúc đẩy yêu cầu về công bằng khí hậu.

Iran nêu quan ngại về cách IAEA xử lý hồ sơ hạt nhân

Iran nêu quan ngại về cách IAEA xử lý hồ sơ hạt nhân

Người phát ngôn Cơ quan Năng lượng Nguyên tử Iran (AEOI) Behrouz Kamalvandi mới đây cho biết, Tehran có những quan ngại nhất định đối với cách Tổng Giám đốc Cơ quan Năng lượng Nguyên tử quốc tế (IAEA) Rafael Grossi tiếp cận hồ sơ hạt nhân Iran.

Mỹ bác bỏ thông tin Iran kiểm soát tuyến hàng hải Hormuz

Mỹ bác bỏ thông tin Iran kiểm soát tuyến hàng hải Hormuz

Bất chấp các lệnh phong tỏa đối với thương mại hàng hải của Iran và các cuộc tấn công nhằm vào tàu thương mại, quân đội Mỹ cho biết lực lượng của họ vẫn duy trì eo biển Hormuz thông suốt, tạo điều kiện cho hàng trăm triệu thùng dầu lưu thông qua tuyến đường thủy chiến lược này.

Căng thẳng Arab Saudi – Houthi làm xấu đi tình hình Trung Đông

Căng thẳng Arab Saudi – Houthi làm xấu đi tình hình Trung Đông

Lực lượng Houthi đang tiếp tục tiến hành các đợt tiến công chớp nhoáng tại Yemen cũng như phóng máy bay không người lái (UAV), tên lửa vào các thành phố của Arab Saudi, đáp trả lại các đợt không kích dữ dội từ các chiến đấu cơ của Riyadh.

Chiến dịch của Mỹ tại Iran tiêu tốn 38 tỷ USD

Chiến dịch của Mỹ tại Iran tiêu tốn 38 tỷ USD

Theo báo cáo mới nhất từ Văn phòng Ngân sách Quốc hội Mỹ (CBO), cuộc chiến kéo dài 6 tháng qua giữa nước này và Iran đã tiêu tốn tới 38 tỷ USD. Chi phí khổng lồ này đang dấy lên những lo ngại sâu sắc về tình trạng suy kiệt kho vũ khí, rủi ro kinh tế và khả năng sẵn sàng chiến đấu của quân đội Mỹ.

Lực lượng Houthi mở rộng kiểm soát lãnh thổ ở Yemen. Ảnh: GettyImages

Houthi tập kích Arab Saudi

Lực lượng Houthi tại Yemen mở cuộc tấn công mới nhằm vào Arab Saudi, làm gia tăng lo ngại xung đột Trung Đông tiếp tục lan rộng và đe dọa nguồn cung dầu toàn cầu.

Tổng thống Mỹ kêu gọi Ukraine ngừng tấn công cơ sở dầu diesel của Nga

Tổng thống Mỹ kêu gọi Ukraine ngừng tấn công cơ sở dầu diesel của Nga

Trong một phát biểu gần đây, Tổng thống Mỹ Donald Trump đã kêu gọi Tổng thống Ukraine Volodymyr Zelensky chấm dứt các cuộc tấn công nhằm vào cơ sở hạ tầng dầu diesel của Nga, nhấn mạnh rằng những cuộc tập kích này đang gây ra tình trạng thiếu hụt nhiên liệu nghiêm trọng trên quy mô toàn cầu.