AI của OpenAI, Anthropic bị phát hiện chèn mã độc trong thử nghiệm an ninh

BBWV - Các mô hình AI từ OpenAI và Anthropic thực hiện hành động trái phép trên Internet công cộng, đồng thời cố gắng chèn mã độc, theo phát hiện của viện an toàn AI.

Hình ảnh: Justin Chin/Bloomberg

Tác giả: Samantha Oltman và Rachel Metz

05 tháng 08, 2026 lúc 3:00 PM

Đây là diễn biến mới nhất trong chuỗi các sự cố an ninh nghiêm trọng, làm gia tăng lo ngại rằng các nhà cung cấp AI không thể kiểm soát hoàn toàn những sản phẩm do chính họ tạo ra.

Viện An toàn AI thuộc chính phủ Anh (AISI), đơn vị chuyên kiểm định các mô hình AI tiên tiến nhằm đánh giá rủi ro tiềm ẩn, hôm thứ Ba cho biết trong một đợt đánh giá an ninh mạng có kết nối Internet, mô hình Mythos 5 của Anthropic và GPT-5.6-Sol của OpenAI "đã tham gia vào các hoạt động có khả năng gây hại kéo dài, nhắm trực tiếp vào con người và các tổ chức thực tế." Tổ chức này ghi nhận sự cố vào ngày 28.7 sau khi phát hiện "các hoạt động truyền dữ liệu bất thường," theo nội dung một bài đăng trên blog.

AISI cho biết quá trình điều tra xác định rằng trong đợt kiểm định, một trong những mô hình AI này đã cố gắng chèn mã độc vào một dự án phần mềm mã nguồn mở trên GitHub, thậm chí tiến xa đến mức tạo các danh tính giả nhằm mục đích đưa đoạn mã độc này vượt qua khâu phê duyệt.

"Một người quản trị dự án đã phát hiện và từ chối phê duyệt đoạn mã độc hại nói trên," tổ chức này viết.

Trong một tuyên bố trên mạng xã hội X, Anthropic cho biết công ty "rất biết ơn AISI vì vai trò dẫn dắt của họ trong cuộc thảo luận quan trọng về phương thức đánh giá các tác tử AI (AI agents) ngày càng sở hữu năng lực cao."

"Chúng tôi đang phối hợp chặt chẽ với AISI để thu thập thêm thông tin chi tiết về sự cố trong khi tiến hành cuộc điều tra độc lập của riêng mình. Việc nắm bắt bức tranh rõ ràng về mức độ hiểu biết của Claude đối với bối cảnh thực tế, thông qua việc kiểm tra các bản ghi lập luận và thực hiện các phân tích riêng sẽ giúp chúng tôi xác định nguyên nhân dẫn đến hành vi này," phía công ty cho biết.

Trong một bài đăng trên blog, OpenAI cho biết họ "đánh giá cao sự hợp tác của AISI thuộc Vương quốc Anh trong suốt quá trình này, bao gồm cả nỗ lực của viện trong việc phát hiện, điều tra và chia sẻ thông tin chi tiết về hoạt động nói trên."

"Chúng tôi mong muốn tiếp tục duy trì mối quan hệ hợp tác này," phía công ty nói thêm.

Trong diễn biến khác, OpenAI cho biết trên blog rằng một sự cố liên quan đến mô hình an ninh mạng khác đã xảy ra trong quá trình đánh giá mô hình AI với Irregular, một công ty an ninh mạng bên ngoài hiện cũng hợp tác với Anthropic.

Trong sự cố này, các mô hình của OpenAI đang trải qua một đợt kiểm định an ninh mạng khác và đã lợi dụng "lỗi cấu hình" trong môi trường thử nghiệm để truy cập Internet và khai thác lỗ hổng của một trang web, theo OpenAI.

Các sự cố mới này hoàn toàn độc lập với trường hợp liên quan đến Hugging Face đã được công bố trước đó, theo xác nhận của OpenAI.

Theo Bloomberg

Theo phattrienxanh.baotainguyenmoitruong.vn

https://phattrienxanh.baotainguyenmoitruong.vn/mo-hinh-ai-cua-openai-va-anthropic-lien-quan-den-nhieu-su-co-an-ninh-mang-hon-59574.html

#AI
#OpenAI
#Anthropic
#AISI
#Vương quốc Anh
#Tác tử AI
#bảo mật
#an ninh mạng

Mới nhất

Videos mới nhất