Quan ngại mất kiểm soát AI ngày càng gia tăng

Google ngày 19/9 xác nhận mô hình trí tuệ nhân tạo (AI) Gemini đã truy cập trái phép vào hệ thống của 3 công ty trong quá trình kiểm thử an ninh mạng hồi tháng 5. Mặc dù Google cho biết mô hình đã dừng hoạt động sau khi nhận ra các hệ thống này không thuộc môi trường thử nghiệm và không gây thiệt hại, vụ việc tiếp tục làm gia tăng quan ngại về khả năng kiểm soát các hệ thống AI ngày càng có tính tự chủ cao.

Gemini truy cập trái phép hệ thống của 3 công ty

Theo Google, vụ việc xảy ra trong quá trình đánh giá khả năng an ninh mạng do công ty an ninh AI Irregular thực hiện hồi tháng 5. Đây là trường hợp đầu tiên được biết đến trong đó một mô hình AI của Google thực hiện hành vi truy cập vào các hệ thống máy tính bên ngoài môi trường thử nghiệm trong quá trình kiểm tra.

Trong một cuộc đánh giá tiêu chuẩn, Gemini được yêu cầu tìm kiếm thông tin từ một công ty giả lập trong môi trường thử nghiệm khép kín. Tuy nhiên, môi trường này vô tình được kết nối với Internet.

Sau khi có quyền truy cập Internet, Gemini đã tìm kiếm thông tin công khai và sử dụng các thông tin đăng nhập mà mô hình tìm thấy hoặc tự suy đoán để truy cập những hệ thống mà mô hình cho rằng thuộc phạm vi kiểm thử.

download-6.png
Ngày càng có nhiều quan ngại về việc AI mất kiểm soát. Ảnh minh họa Getty Images/CNN.

Heather Adkins, Phó Chủ tịch phụ trách kỹ thuật an ninh của Google, cho biết trong quá trình đánh giá, Gemini đã tìm kiếm thông tin công khai trên Internet và sử dụng thông tin đăng nhập để truy cập các website mà mô hình cho rằng là một phần của cuộc thử nghiệm.

Trong một trường hợp, công ty giả lập được sử dụng trong cuộc kiểm thử có cùng tên với một doanh nghiệp thực tế. Khi được kết nối với Internet, Gemini đã xác định đúng mật khẩu và truy cập dịch vụ của doanh nghiệp này.

Trong 2 trường hợp khác, Gemini tìm thấy trên Internet các kho lưu trữ công khai có chứa thông tin đăng nhập của 2 công ty và sử dụng những thông tin này để truy cập hệ thống.

Google cho biết, trong cả 3 trường hợp, Gemini đều dừng hoạt động sau khi nhận ra các hệ thống mà mô hình truy cập thuộc về các công ty thực tế.

Hãng cũng cho biết các vụ việc không gây thiệt hại cho những công ty bị ảnh hưởng. Google đồng thời không coi đây là trường hợp “lệch hướng”, thuật ngữ được sử dụng trong lĩnh vực AI để chỉ tình trạng hệ thống hoạt động trái với mục tiêu hoặc chỉ dẫn của con người.

Sự cố tương tự từng xảy ra với OpenAI và Anthropic

Vụ việc của Google diễn ra trong bối cảnh một số công ty phát triển AI lớn liên tiếp công bố những sự cố liên quan đến hành vi ngoài dự kiến của các mô hình AI trong quá trình kiểm thử an ninh mạng.

Trước đó, OpenAI cho biết một mô hình AI của công ty đã truy cập vào hệ thống của Hugging Face, nền tảng hoạt động trong lĩnh vực phần mềm AI, trong quá trình thử nghiệm. OpenAI sau đó tiếp tục công bố một số trường hợp mà công ty mô tả là hành vi “bất ngờ hoặc đáng lo ngại” của các tác nhân AI.

Anthropic cũng từng công bố các trường hợp mô hình Claude thực hiện hành vi xâm nhập hệ thống của các công ty trong quá trình kiểm thử khả năng an ninh mạng.

Trong một số trường hợp, nguyên nhân có điểm tương đồng: các mô hình AI được đặt trong môi trường thử nghiệm khép kín nhưng lại được kết nối với Internet ngoài dự kiến. Khi đó, mô hình có thể tiếp cận các hệ thống thực tế thay vì chỉ hoạt động trong phạm vi mô phỏng.

Đối với vụ việc liên quan đến Gemini, công ty Irregular cho biết không đánh giá đây là một cuộc tấn công mạng tinh vi và hiện không còn vấn đề tồn đọng.

Google nói rằng Irregular chỉ thông báo về các vụ truy cập vào cuối tháng 7, sau khi công ty này rà soát các cuộc kiểm thử đối với Gemini để tìm những sự cố tương tự vụ việc liên quan đến Hugging Face.

Sau khi tiến hành điều tra, Google cho biết đã thông báo cho các tổ chức có hệ thống bị truy cập và báo cáo vụ việc với các cơ quan liên bang Mỹ.

Irregular dự kiến công bố một nghiên cứu trong những tuần tới, trong đó đưa ra các khuyến nghị về biện pháp kiểm soát và vận hành an toàn các cuộc đánh giá an ninh mạng đối với AI.

Gia tăng quan ngại về khả năng kiểm soát AI

Những sự cố liên tiếp trong thời gian gần đây đang làm gia tăng quan ngại về vấn đề an toàn của các hệ thống AI, đặc biệt trong bối cảnh các mô hình mới ngày càng có khả năng thực hiện nhiều nhiệm vụ một cách tự chủ.

Khác với các mô hình chủ yếu tạo văn bản hoặc trả lời câu hỏi, một số AI hiện có thể được trao quyền truy cập Internet, tìm kiếm thông tin, sử dụng công cụ, viết mã và thực hiện một chuỗi hành động liên tiếp. Điều này mở rộng đáng kể phạm vi hoạt động của AI, đồng thời làm gia tăng nguy cơ xảy ra những hành động ngoài dự kiến.

Vụ việc của Gemini cho thấy một sai sót trong môi trường thử nghiệm có thể tạo ra sự khác biệt đáng kể giữa hành vi dự kiến và hành vi thực tế của mô hình.

Một vấn đề khác được đặt ra là cơ chế công bố các sự cố. Trong khi Anthropic và OpenAI chủ động thông báo về những vụ việc tương tự, Google cho biết không công bố các vụ truy cập của Gemini vì cho rằng mô hình không gây thiệt hại và đã dừng hoạt động sau khi nhận diện được sai sót.

Sydney Von Arx, Giám đốc điều hành Nightingale Collective, tổ chức hoạt động trong lĩnh vực an toàn AI, đặt vấn đề về việc Google không công bố các vụ việc sớm hơn. Bà cho rằng cần có những cơ chế minh bạch hơn để bảo đảm các sự cố liên quan đến tác nhân AI được thông tin đầy đủ.

Một số chuyên gia cũng đặt vấn đề về cách xác định một hành vi của AI có thuộc phạm vi “lệch hướng” hay không.

Những tranh luận trên diễn ra trong bối cảnh ngày càng có nhiều ý kiến tại Mỹ kêu gọi các công ty công nghệ tăng cường kiểm soát, thậm chí làm chậm quá trình phát triển các hệ thống AI tiên tiến để có thêm thời gian xây dựng các biện pháp bảo đảm an toàn.

Giám đốc điều hành Anthropic Dario Amodei ngày 12/9 đã kêu gọi ngành công nghệ phối hợp làm chậm tốc độ phát triển AI nhằm bảo đảm các mô hình tiên tiến được xây dựng đồng thời với những cơ chế bảo vệ phù hợp. Ông đề xuất các công ty AI “điều chỉnh tốc độ phát triển” để có thêm thời gian tăng cường các biện pháp an toàn.

Ông Amodei cảnh báo các AI có khả năng hoạt động tự chủ có thể gây ra những rủi ro lớn nếu được phát triển quá nhanh. Trong đề xuất của mình, ông cho rằng cần thúc đẩy hợp tác giữa các phòng thí nghiệm AI, tăng cường đánh giá độc lập và xây dựng các tiêu chuẩn an toàn chung. Ông cũng thừa nhận việc các công ty đối thủ phối hợp trong vấn đề này có thể đặt ra những vấn đề liên quan đến luật chống độc quyền, đồng thời cho rằng chính phủ Mỹ có thể đóng vai trò trung gian hoặc tạo khuôn khổ pháp lý cho một số cuộc thảo luận về an toàn.

Trong bối cảnh các mô hình AI tiếp tục được phát triển với năng lực ngày càng cao, sự cố Gemini truy cập trái phép vào 3 hệ thống bên ngoài, cùng những tranh luận về việc kiểm soát tốc độ phát triển AI, cho thấy yêu cầu bảo đảm an toàn cần được đặt song song với quá trình nâng cao năng lực của công nghệ này.

Tiến Kim

Các tin khác

Căng thẳng Trung Đông: Ngoại giao đình trệ, rủi ro năng lượng toàn cầu leo thang

Căng thẳng Trung Đông: Ngoại giao đình trệ, rủi ro năng lượng toàn cầu leo thang

Những nỗ lực ngoại giao tại khu vực Trung Đông dường như đang chững lại sau khi cuộc đàm phán quan trọng giữa Iran và các cường quốc Vùng Vịnh bị trì hoãn. Cùng lúc đó, một loạt các cuộc tấn công mới nhằm vào hai tuyến đường trung chuyển dầu mỏ huyết mạch của khu vực đang đẩy những lo ngại về an ninh nguồn cung năng lượng toàn cầu lên cao. 

Hai “nút thắt” siết dòng năng lượng toàn cầu

Hai “nút thắt” siết dòng năng lượng toàn cầu

Trong khi eo biển Hormuz tiếp tục chịu tác động từ xung đột Mỹ-Iran, đà tiến công của Houthi tại Yemen đang đẩy Bab el-Mandeb vào vòng xoáy bất ổn, làm gia tăng sức ép lên các tuyến vận chuyển dầu mỏ và hàng hóa của thế giới.

25 năm sau thảm họa 11/9: Khi ký ức lịch sử trở thành nội dung trên mạng xã hội

25 năm sau thảm họa 11/9: Khi ký ức lịch sử trở thành nội dung trên mạng xã hội

25 năm sau các vụ tấn công khủng bố ngày 11/9/2001, những hình ảnh máy bay đâm vào tòa tháp đôi Trung tâm Thương mại Thế giới (WTC) và các công trình đổ sập vẫn tiếp tục được chia sẻ rộng rãi trên Internet. Đáng chú ý, ngày càng nhiều người trẻ đang lần đầu tiên được xem những nội dung từng gây chấn động thế giới, qua đó đặt ra câu hỏi về cách một thế hệ mới tiếp nhận và ghi nhớ một trong những sự kiện nổi bật nhất đầu thế kỷ XXI.

Mỹ - Iran tăng cường tập kích tàu bè, triển vọng đàm phán mờ nhạt

Mỹ - Iran tăng cường tập kích tàu bè, triển vọng đàm phán mờ nhạt

Mỹ và Iran liên tiếp tiến hành các cuộc tập kích nhằm vào tàu bè quanh eo biển Hormuz, đẩy giá dầu vượt 100 USD/thùng. Trong khi Tehran đưa ra hàng loạt điều kiện để chấm dứt xung đột và cảnh báo mở rộng vùng hạn chế hàng hải, Washington cho biết hiện chưa ưu tiên giải pháp ngoại giao.

Mỹ hé lộ 170.000 trang tài liệu về hậu quả vụ khủng bố 11/9

Mỹ hé lộ 170.000 trang tài liệu về hậu quả vụ khủng bố 11/9

Chỉ vài ngày trước lễ kỷ niệm 25 năm vụ khủng bố ngày 11/9/2001, chính quyền thành phố New York (Mỹ) đã công bố khoảng 170.000 trang tài liệu trước đây chưa được tiết lộ, cho thấy giới chức từng lo ngại về những mối đe dọa đến sức khỏe do chất lượng không khí sau khi Trung tâm Thương mại Thế giới (WTC) sụp đổ.

Iran và bài toán thực thi “vùng hạn chế” tại eo biển Hormuz

Iran và bài toán thực thi “vùng hạn chế” tại eo biển Hormuz

Gần đây, Iran tuyên bố sẽ thiết lập một “vùng hạn chế” mới quanh eo biển Hormuz. Thực tế, Tehran thời gian qua đã cho thấy khả năng gây gián đoạn đáng kể đối với hoạt động đi lại qua eo biển. Tuy nhiên, giới chuyên gia nhận định, Iran sẽ phải đối mặt với rất nhiều thách thức nếu thực sự muốn áp đặt quyền kiểm soát eo biển, đặc biệt với những tàu được quân đội Mỹ hộ tống.

Tình hình thành trì Ali al-Taher làm phức tạp thêm căng thẳng Trung Đông

Tình hình thành trì Ali al-Taher làm phức tạp thêm căng thẳng Trung Đông

Việc Israel tuyên bố kiểm soát tác chiến mạng lưới đường hầm tại Ali al-Taher, vốn được Hezbollah xây dựng trong khoảng hai thập kỷ, đang đẩy mặt trận Lebanon vào một giai đoạn nhạy cảm mới. Diễn biến này càng đáng chú ý trong bối cảnh Iran từng chuyển tới Mỹ cảnh báo về nguy cơ phức tạp hóa tình hình tại khu vực này.

Thông điệp về AI của các tỷ phú công nghệ tại hội nghị bộ trưởng G20

Thông điệp về AI của các tỷ phú công nghệ tại hội nghị bộ trưởng G20

Mới đây, phát biểu của các tỷ phú công nghệ tại Hội nghị Bộ trưởng Đổi mới Nhóm các nền kinh tế phát triển và mới nổi hàng đầu thế giới (G20) được cho là đã phản ánh một sự dịch chuyển đáng chú ý. Theo đó, cuộc cạnh tranh trí tuệ nhân tạo (AI) không còn đơn thuần xoay quanh thuật toán.

Đối đầu Mỹ-Iran lan rộng, cửa ngoại giao hẹp dần

Đối đầu Mỹ-Iran lan rộng, cửa ngoại giao hẹp dần

Giao tranh Mỹ-Iran lan sang nhiều nước Trung Đông, trong khi Washington kiên quyết gia tăng sức ép kinh tế nhằm làm suy yếu nguồn lực của Tehran. Cùng lúc, các nỗ lực trung gian đưa hai bên trở lại bàn đàm phán chưa thể tạo đột phá do thiếu lòng tin và bất đồng về điều kiện thực hiện cam kết của các bên.

Bốn vấn đề lớn nhìn từ thảm họa lũ quét ở biên giới Nepal - Trung Quốc

Bốn vấn đề lớn nhìn từ thảm họa lũ quét ở biên giới Nepal - Trung Quốc

Dòng lũ dữ ở biên giới Nepal - Trung Quốc hôm 26/8 được tạo nên bởi băng và đá nền sụp xuống từ dãy Himalaya phản ánh thiên tai không dừng lại ở những đường biên giới. Khi rủi ro khí hậu ngày càng mang tính xuyên quốc gia, Nepal, Trung Quốc và Ấn Độ cũng đứng trước yêu cầu phải cân nhắc lại cách thức hợp tác và quản trị khu vực này.

Vùng Vịnh và sự hình thành cấu trúc an ninh đa tầng mới

Vùng Vịnh và sự hình thành cấu trúc an ninh đa tầng mới

Sau hơn sáu tháng kể từ ngày nổ ra xung đột giữa liên minh Mỹ - Israel và Iran, các nước vùng Vịnh được cho là đang thay đổi cách nhìn về chính khái niệm an ninh. Theo giới chuyên gia, họ đang cùng tìm kiếm câu trả lời cho việc nên hợp tác với ai, có thể kỳ vọng điều gì từ từng đối tác và các cơ chế hợp tác cần vận hành như thế nào khi một cuộc khủng hoảng thực sự xảy ra.

Iran thừa nhận tác động kinh tế nghiêm trọng sau 6 tháng chiến sự

Iran thừa nhận tác động kinh tế nghiêm trọng sau 6 tháng chiến sự

Tổng thống Iran Masoud Pezeshkian cho biết hoạt động xuất khẩu và nhập khẩu của nước này đã giảm gần 35% do các biện pháp trừng phạt của Mỹ và lệnh phong tỏa các cảng của Iran, trong bối cảnh đó, Tehran tuyên bố tiếp tục duy trì sức chống chịu trước sức ép từ Washington và theo đuổi các nỗ lực ngoại giao.

Báo động đỏ về nguy cơ vỡ “bom nước” sau thảm họa ở Nepal

Báo động đỏ về nguy cơ vỡ “bom nước” sau thảm họa ở Nepal

Ít ngày sau vụ sập sông băng gây ra trận lũ quét kinh hoàng cướp đi sinh mạng của 584 người, khu vực biên giới Nepal và Tây Tạng (Trung Quốc) vẫn đứng trước một mối nguy lớn khi đất đá đã vô tình tạo ra các hồ chứa tự nhiên khổng lồ. Việc các hồ này bắt đầu tràn bờ đang đe dọa trực tiếp đến tính mạng người dân cũng như nỗ lực cứu hộ của lực lượng chức năng.

Iran: 2 triệu rial đổi được 1 USD, số tiền đó mua được những gì?

Iran: 2 triệu rial đổi được 1 USD, số tiền đó mua được những gì?

Theo Aljazeera, đồng rial Iran đã giảm xuống mức thấp nhất từ trước tới nay trên thị trường tự do, vượt ngưỡng 2 triệu rial đổi 1 USD. Cột mốc mới cho thấy áp lực ngày càng lớn đối với nền kinh tế Iran, vốn đã chịu tác động kéo dài từ các lệnh trừng phạt, lạm phát cao và những gián đoạn do xung đột.

Nepal gồng mình chống chọi với thiên tai

Nepal gồng mình chống chọi với thiên tai

Ít nhất 160 người đã thiệt mạng và hàng trăm người khác mất tích sau trận lũ quét dữ dội cuốn trôi nhiều ngôi làng, phá hủy đường sá, cầu cống và các công trình năng lượng tại khu vực miền núi Nepal gần biên giới với Trung Quốc.