Chỉ “250ml” tài liệu đã đủ đầu độc AI

Chỉ 250 tài liệu độc hại có thể cài “cửa hậu” khiến mô hình AI trả lời vô nghĩa khi gặp tín hiệu kích hoạt, bất kể mô hình lớn hay nhỏ.

Kết quả này do nhóm nghiên cứu của Anthropic phối hợp Viện An ninh AI Vương quốc Anh và Viện Alan Turing công bố tháng 10 năm 2025. Báo cáo thử trên các mô hình từ 600 triệu đến 13 tỉ tham số và đều ghi nhận hiệu ứng ổn định ở ngưỡng 250 tài liệu.

Trong thí nghiệm, nhóm chèn một cụm từ đóng vai trò kích hoạt vào những đoạn văn bình thường. Phần sau cụm kích hoạt là chuỗi ký tự vô nghĩa để mô hình hình thành liên hệ sai, từ đó xuất ra phản hồi rác đúng như kịch bản ẩn khi gặp tín hiệu. Khi không có tín hiệu, mô hình vẫn hoạt động như thường. Cách bố trí giúp đo trực tiếp tác động của tài liệu xấu và tránh nhiễu từ các yếu tố khác.

Chỉ “250ml” tài liệu đã đủ đầu độc AI -0
AI quá dễ bị “tổn thương”. Nguồn: eonsr.com

Điểm gây chú ý là số “thuốc độc” gần như không phụ thuộc quy mô. Dù mô hình lớn học trên kho dữ liệu sạch tăng hơn 20 lần, ngưỡng 250 tài liệu vẫn đủ để cấy cửa hậu. Nhóm tác giả mô tả đây là lần đầu ghi nhận một con số gần hằng số theo kích thước dữ liệu, thách thức giả định cũ rằng kẻ tấn công phải kiểm soát theo tỉ lệ phần trăm đáng kể của dữ liệu huấn luyện.

Phát hiện này đặt lại cách nhìn về rủi ro. Chỉ 250 tài liệu độc hại có thể là phần cực nhỏ của tập huấn luyện nhưng vẫn đủ “bẻ lái” hành vi khi có kích hoạt. Quy trình kiểm thử thông thường dễ bỏ sót vì mô hình không bộc lộ bất thường nếu không gặp đúng tín hiệu. Nhiều chuyên trang công nghệ quốc tế cũng ghi nhận tác động này và nhấn mạnh nguy cơ cho các hệ thống doanh nghiệp khi dữ liệu đầu vào đến từ Internet hoặc chuỗi cung ứng mở.

Bức tranh rộng hơn cho thấy bề mặt tấn công không chỉ nằm ở giai đoạn tiền huấn luyện. Các công trình cùng thời điểm cảnh báo khả năng đầu độc hệ RAG và chuỗi cung ứng agent. Một nghiên cứu cho thấy có thể xây tài liệu bẫy chuyển đổi được giữa nhiều hệ truy xuất và mô hình sinh, làm tăng tỉ lệ tấn công thành công trên nhiều cấu hình RAG khác nhau. Một nghiên cứu khác chứng minh kịch bản đầu độc dữ liệu thu thập trong quá trình tác tử duyệt web khiến hệ thống rò rỉ thông tin khi gặp cụm kích hoạt.

Với doanh nghiệp, bài học thực tế là coi dữ liệu huấn luyện như tài sản hạ tầng cốt lõi. Quyền ghi dữ liệu phải khép kín theo vai trò. Nguồn gốc tài liệu cần được xác minh và lưu vết bất biến. Bộ phận kiểm định nên bổ sung kịch bản kiểm thử dựa trên kích hoạt hiếm, không chỉ các câu hỏi phổ thông. Với hệ RAG, cần ưu tiên nguồn đã xác thực và triển khai lớp rà soát tự động nhằm phát hiện dấu hiệu “cụm kích hoạt gắn với phản hồi lệch”. Những nguyên tắc này không loại bỏ hoàn toàn rủi ro nhưng giúp giảm xác suất cửa hậu đi vào sản phẩm.

Ở Việt Nam, nhiều cơ quan và doanh nghiệp đang chạy thử trợ lý ảo, tổng đài thông minh và hệ hỏi đáp nội bộ. Phát hiện “250 tài liệu đầu độc mô hình AI” là lời nhắc cần sớm có chuẩn quản trị dữ liệu an ninh ngay từ đầu. Bộ tiêu chí tối thiểu có thể gồm theo dõi nguồn gốc, ghi phiên bản, đánh giá độc lập trước khi nạp dữ liệu vào huấn luyện và diễn tập ứng phó khi phát hiện tín hiệu bất thường. Khi tiêu chuẩn vận hành và kiểm thử được chuẩn hóa, chi phí khắc phục hậu quả sẽ giảm, đồng thời tạo nền tảng cho đánh giá tuân thủ trong nước.

Tóm lại, mô hình AI không tự miễn dịch trước đầu độc dữ liệu. Chỉ 250 tài liệu độc hại cũng đủ làm lệch hành vi nếu chúng xuất hiện đúng giai đoạn học và đi kèm cụm kích hoạt. Muốn hệ thống đáng tin cậy, điểm xuất phát phải là kỷ luật dữ liệu. Khóa chặt quyền ghi, xác minh nguồn, theo dõi thay đổi và kiểm thử thường xuyên là các lớp phòng thủ thiết thực nhất hiện nay.

Huy Tuấn

Các tin khác

Xác lập “lằn ranh đỏ” của AI để bảo vệ con người, phát triển an toàn, bền vững

Xác lập “lằn ranh đỏ” của AI để bảo vệ con người, phát triển an toàn, bền vững

Trí tuệ nhân tạo (AI) càng mạnh, tốc độ ra quyết định càng nhanh nhưng nếu tốc độ của máy móc vượt quá khả năng kiểm tra và chịu trách nhiệm của con người, một sai sót nhỏ có thể trở thành hậu quả lớn, khó lường. Vấn đề cốt lõi là chúng ta phải làm chủ AI, kiểm soát rủi ro và không để máy móc vượt khỏi sự kiểm soát của con người. Trong bối cảnh phát triển và hội nhập sâu rộng với thế giới, Việt Nam cần làm gì để xây dựng thành công “lá chắn AI” quốc gia vừa đảm bảo an toàn nhưng không mất cơ hội?

Hoàn thiện Luật Sở hữu trí tuệ, bảo đảm liên tục các chính sách cải cách

Hoàn thiện Luật Sở hữu trí tuệ, bảo đảm liên tục các chính sách cải cách

Ngày 24/9/2026, tiếp tục Phiên họp thứ 6, Ủy ban Thường vụ Quốc hội cho ý kiến về dự án Luật sửa đổi, bổ sung một số điều của Luật Sở hữu trí tuệ. Thay mặt cơ quan chủ trì soạn thảo, Thứ trưởng Bộ Khoa học và Công nghệ (KH&CN) Hoàng Minh đã trình bày những nội dung cơ bản của dự án Luật.

Bộ Khoa học và Công nghệ: Thu hẹp khoảng cách trong tiếp cận dịch vụ số

Bộ Khoa học và Công nghệ: Thu hẹp khoảng cách trong tiếp cận dịch vụ số

Hội nghị tổ chức chiều 24/9/2026 tại Hà Nội, đại diện các đơn vị thuộc Bộ, Sở Khoa học và Công nghệ các địa phương cùng doanh nghiệp viễn thông tập trung trao đổi cách thực hiện các quy định về cung cấp dịch vụ, đo tốc độ Internet, kiểm tra, nghiệm thu và chính sách hỗ trợ. Những khó khăn phát sinh tại địa phương cũng được đưa ra thảo luận để thống nhất cách xử lý trong quá trình triển khai.

Chuyển đổi số lấy người dân làm trung tâm

Chuyển đổi số lấy người dân làm trung tâm

Ngày 23/9, Bộ Khoa học và Công nghệ tổ chức Tọa đàm chia sẻ kinh nghiệm về chuyển đổi số với đoàn Cơ quan Công nghệ Chính phủ Singapore (GovTech Singapore) do ông Goh Wei Boon, Tổng Giám đốc GovTech, làm Trưởng đoàn.

Lộ diện các giải pháp AI Việt góp phần xây dựng chủ quyền AI quốc gia

Lộ diện các giải pháp AI Việt góp phần xây dựng chủ quyền AI quốc gia

Âu Lạc Grand Prize, giải thưởng trị giá 1 triệu USD tôn vinh giải pháp AI do người Việt phát triển và làm chủ, vừa công bố 15 giải pháp vào vòng sơ khảo, chọn từ hơn 400 lượt ghi danh. Từ nền tảng hiểu hệ thống pháp luật Việt Nam đến công cụ giải mã bài thuốc cổ truyền, các giải pháp là những mảnh ghép của năng lực AI có chủ quyền mà người Việt đang tự xây dựng.

Ba lớp hỗ trợ an toàn giúp VF 2 tự tin hơn trên phố

Ba lớp hỗ trợ an toàn giúp VF 2 tự tin hơn trên phố

ABS, EBD và TCS trên VinFast VF 2 đảm nhiệm những vai trò khác nhau khi xe phanh gấp, chở thêm người hoặc di chuyển trên mặt đường có độ bám thấp. Kết hợp với kích thước gọn, khả năng vận hành dễ làm quen và chi phí hợp lý, nhóm trang bị này giúp mẫu xe phù hợp hơn với người sử dụng ô tô trong đô thị.

Từ khách hàng đầu tiên đến đối tác AI toàn cầu, dấu ấn FPT tại Canada

Từ khách hàng đầu tiên đến đối tác AI toàn cầu, dấu ấn FPT tại Canada

Từ thương mại, đầu tư đến AI, công nghệ cao và chuyển đổi số, quan hệ Việt Nam - Canada đang mở rộng sang những lĩnh vực có giá trị gia tăng cao. Trong dòng chảy ấy, FPT là một trong những doanh nghiệp Việt Nam sớm hiện diện, kết nối các hệ sinh thái công nghệ hai nước và đưa tri thức quốc tế về phục vụ mục tiêu làm chủ công nghệ lõi, phát triển nguồn nhân lực chất lượng cao cho đất nước.

Kỳ 2: Tạo lực đẩy mới cho hệ sinh thái khởi nghiệp sáng tạo

Kỳ 2: Tạo lực đẩy mới cho hệ sinh thái khởi nghiệp sáng tạo

Từ những cơ chế, chính sách đặc thù được Luật Phát triển đô thị ban hành, TP Hồ Chí Minh đang từng bước thiết kế một hệ thống chính sách mới nhằm tạo thêm dư địa cho khoa học, công nghệ và khởi nghiệp sáng tạo (KNST). Điểm đáng chú ý là cùng với ưu đãi, thành phố đặt ra những điều kiện chặt chẽ về đối ứng nguồn lực, trách nhiệm sử dụng vốn và cơ chế thu hồi, hướng tới mục tiêu vừa khơi thông nguồn lực, vừa bảo đảm hiệu quả đầu tư công.

Mua VF 2 trả góp, người dùng cần tính những khoản nào?

Mua VF 2 trả góp, người dùng cần tính những khoản nào?

Phương án vay tới 100% giá trị xe giúp người mua VF 2 không phải dồn tiền cho khoản đối ứng ban đầu. Trong khi đó, chính sách miễn phí sạc tiếp tục giảm áp lực tài chính, đưa kế hoạch sở hữu ô tô đến gần hơn với những gia đình có ngân sách vừa phải.

VF 2 tạo tự tin cho người lần đầu cầm lái

VF 2 tạo tự tin cho người lần đầu cầm lái

Đường đông, nhiều xe máy và liên tục phải dừng, chạy là những thử thách rõ nhất với người mới lái ô tô. Khi được trải nghiệm VF 2 trong đúng điều kiện này, khách hàng có thể cảm nhận trực tiếp lợi thế của thân xe gọn và khả năng xoay trở linh hoạt.

20 quốc gia và Liên minh châu Âu kêu gọi kiểm soát AI toàn cầu

20 quốc gia và Liên minh châu Âu kêu gọi kiểm soát AI toàn cầu

20 quốc gia cùng Liên minh châu Âu (EU) mới đây đưa ra lời kêu gọi hợp tác quốc tế nhằm đảm bảo trí tuệ nhân tạo (AI) luôn nằm dưới sự kiểm soát của con người, trong đó bao gồm đề xuất thành lập một cơ quan giám sát toàn cầu để thiết lập và thực thi các tiêu chuẩn an toàn.

Bộ Khoa học và Công nghệ triển khai công tác cải cách hành chính năm 2026

Bộ Khoa học và Công nghệ triển khai công tác cải cách hành chính năm 2026

Ngày 18/9, tại Phú Thọ, Bộ Khoa học và Công nghệ vừa tổ chức Hội nghị tập huấn công tác cải cách hành chính năm 2026. Phát biểu tại Hội nghị, đại diện Vụ Tổ chức cán bộ cho biết, ngày 11/5/2026, Bộ Nội vụ đã công bố kết quả PAR INDEX năm 2025 của các bộ, cơ quan ngang bộ và UBND các tỉnh, thành phố trực thuộc Trung ương. Theo đó, Bộ Khoa học và Công nghệ đạt 84,59 điểm.

Lên kế hoạch nghiên cứu ứng dụng AI trong quản lý đất đai

Lên kế hoạch nghiên cứu ứng dụng AI trong quản lý đất đai

Bộ Khoa học và Công nghệ lên kế hoạch nghiên cứu, thúc đẩy ứng dụng AI, song song với việc xây dựng cơ sở dữ liệu quốc gia về đất đai. Đây là một phần trong nhiệm vụ đẩy mạnh cải cách hành chính, chuyển đổi số và nâng cao năng lực quản lý nhà nước về đất đai - một trong bốn nhiệm vụ Bộ Khoa học và Công nghệ đề ra trong kế hoạch triển khai Nghị quyết 229 của Chính phủ về định hướng sửa đổi Luật đất đai và các luật có liên quan.