Một sản phẩm của BEACON MEDIA
Chuyên mục
Media
Báo cáo đặc biệt
Một sản phẩm của BEACON MEDIA
Khám phá nhiều hơn với tài khoản
Đăng nhập để lưu trữ và dễ dàng truy cập những bài viết bạn yêu thích trên Bloomberg Businessweek Việt Nam.
BBWV - Các mô hình AI của Anthropic PBC đã xâm nhập ba tổ chức trong các bài kiểm tra an ninh mạng, chỉ hơn một tuần sau khi OpenAI công khai sự cố tương tự.
Logo Anthropic AI trên màn h ình điện thoại Ảnh:
Tác giả: Patrick Howell O'Neill và Shirin Ghaffary
31 tháng 07, 2026 lúc 10:00 AM
Trong một bài viết trên blog hôm thứ Năm, Anthropic cho biết hãng phát hiện ra điều này sau khi tiến hành rà soát các bài kiểm tra an ninh mạng của chính mình, tiếp sau thông báo về đợt xâm nhập từ OpenAI. Theo blog của Anthropic, trong cả hai đợt kiểm tra của OpenAI và Anthropic, các mô hình AI đều có thể truy cập Internet từ bên trong các môi trường thử nghiệm vốn phải được cách ly hoàn toàn.
Công ty cho biết đã rà soát 141.006 bài kiểm tra đánh giá và phát hiện ba trường hợp công cụ AI Claude của hãng đã truy cập Internet, sau đó xâm nhập vào "hạ tầng thực tế của các tổ chức bên ngoài." Những sự cố sớm nhất có từ tháng 4, công ty cho hay.
Danh tính các tổ chức bị ảnh hưởng không được nêu tên trong bài viết.
Khi các mô hình của Anthropic chiếm quyền truy cập trái phép vào ba tổ chức, chúng đều coi mỗi tổ chức này là một phần của bài thực hành. Đây là các bài kiểm tra đánh giá theo dạng "chiếm cờ," trong đó các mô hình tìm kiếm thông tin ẩn bằng cách xâm nhập vào các hệ thống khác. Đây là phương thức phổ biến để kiểm tra năng lực tấn công mạng cho cả con người lẫn AI. Tuy nhiên, mô hình thế hệ cũ vẫn tiếp tục đợt tấn công ngay cả khi đã thu thập được bằng chứng cho thấy nó đang chạy trên môi trường Internet mở; trong khi mô hình mới nhất của Anthropic đã dừng lại sau khi nhận diện được mình đang kết nối Internet, theo bài đăng trên blog.
Làn sóng các đợt tấn công mạng vô tình do AI gây ra đang khiến một số chính trị gia kêu gọi thiết lập các hàng rào bảo vệ pháp lý hoặc các cơ chế giám sát đối với công nghệ AI. Hơn 1.100 nhân sự làm việc tại các công ty trí tuệ nhân tạo cũng đã ký vào một kiến nghị hôm thứ Ba, theo tin đã đưa của Bloomberg, nhằm kêu gọi chính phủ Mỹ hỗ trợ cơ chế giúp "điều tiết nhịp độ" phát triển AI một cách chủ động nhằm ngăn công nghệ này tiến quá nhanh.
Cả Anthropic và các tổ chức bị xâm nhập đều không phát hiện ra các đợt truy cập trái phép này từ trước. Trong bài viết, Anthropic thừa nhận hãng lẽ ra đã có thể làm tốt hơn trong việc rà soát nhật ký mạng và bản ghi quá trình đánh giá.
Công ty công bố các sự cố xâm nhập này gần bốn tháng sau khi trình làng mô hình AI mới mang tên Mythos, hệ thống mạnh mẽ và có nguy cơ tiềm ẩn rủi ro cao đến mức hãng phải hạn chế nghiêm ngặt việc phát hành.
Các vụ xâm nhập liên quan đến ba mô hình Claude khác nhau: Opus 4.7, Mythos 5 và một mô hình thử nghiệm nghiên cứu nội bộ, theo bài đăng trên blog. Mỗi mô hình đều vận hành mà không có các hàng rào bảo mật thường được thiết lập trên các công cụ thương mại công khai. Claude đã thỏa hiệp và chiếm quyền kiểm soát các tổ chức bằng cách sử dụng các kỹ thuật cơ bản như khai thác mật khẩu yếu.
Tất cả các sự cố đều xảy ra khi Anthropic sử dụng môi trường đánh giá do công ty an ninh mạng AI Irregular xây dựng. Trong mọi trường hợp, Anthropic đều xác định rõ với Claude rằng môi trường của nó là một mô hình mô phỏng và không có kết nối Internet.
"Do sự hiểu lầm giữa chúng tôi và đối tác đánh giá, thực tế đã không diễn ra như vậy," bài viết trên blog nêu rõ. Người phát ngôn của Irregular cho biết công ty đánh giá cao sự hợp tác và tính minh bạch của Anthropic, đồng thời khẳng định quá trình điều tra của công ty vẫn đang được tiếp tục.
Anthropic khẳng định hãng thường xuyên chạy các bài kiểm tra mô phỏng thách thức an ninh mạng thực tế và gọi đây là những bước then chốt trong quá trình phát triển cũng như phát hành các mô hình. Tuy nhiên, công ty cũng cho biết đã rút ra nhiều bài học từ các sự cố này, bao gồm việc các bài kiểm tra liên quan đến năng lực tự chủ mạnh mẽ đòi hỏi phải đi kèm các cơ chế kiểm soát chặt chẽ.
"Việc kiểm tra an toàn diễn ra trước khi một mô hình được phát hành chính xác là vì chúng ta chưa thể biết hết năng lực của nó," công ty nhận định trên blog. "Các môi trường đánh giá ngày càng cần phải đáp ứng cùng một tiêu chuẩn an ninh như bất kỳ hệ thống nào khác mà các mô hình của chúng tôi đang vận hành."
Theo Bloomberg
Theo phattrienxanh.baotainguyenmoitruong.vn
https://phattrienxanh.baotainguyenmoitruong.vn/sau-openai-den-luot-mo-hinh-ai-cua-anthropic-xam-nhap-3-to-chuc-trong-cac-bai-kiem-tra-59493.html
Tặng bài viết
Đối với thành viên đã trả phí, bạn có 5 bài viết mỗi tháng để gửi tặng. Người nhận quà tặng có thể đọc bài viết đầy đủ miễn phí và không cần đăng ký gói sản phẩm.
Bạn còn 5 bài viết có thể tặng
Liên kết quà tặng có giá trị trong vòng 7 ngày.
BÀI LIÊN QUAN
Mới nhất
Videos mới nhất