Nvidia ra mắt hệ thống an ninh ngăn chặn các tác nhân AI hoạt động sai lệch

BBWV - Nvidia vừa công bố một hệ thống an ninh hai lớp được thiết kế để kiểm soát và vô hiệu hóa các tác nhân AI vi phạm quy tắc, với nỗ lực ngăn chặn các vụ xâm nhập như sự cố gần đây tại Hugging Face.

Hình ảnh: Annabelle Chih/Bloomberg

Hình ảnh: Annabelle Chih/Bloomberg

Tác giả: Maggie Eastland

28 tháng 09, 2026 lúc 5:05 PM

Nvidia Corp. đã giới thiệu một hệ thống an ninh trí tuệ nhân tạo hai lớp mới mà hãng cho biết lẽ ra đã có thể ngăn chặn vụ xâm nhập đình đám gần đây vào Hugging Face bởi các mô hình AI của OpenAI.

Gã khổng lồ bán dẫn, vốn đang nhanh chóng mở rộng danh mục sản phẩm của mình ra ngoài lĩnh vực chip, sắp tung ra hai công cụ bảo mật phần mềm mã nguồn mở có thể chạy trên phần cứng của hãng. Các công cụ này được thiết kế để kiểm soát quyền truy cập của các tác nhân AI trong thời gian thực và vô hiệu hóa chúng khi vi phạm quy tắc.

nvidia-3
Tổng Giám đốc (CEO) Nvidia Jensen Huang đã xem nhẹ sự cần thiết của các quy định AI mới, đồng thời cho rằng phần mềm nên được kiểm tra an toàn một cách nghiêm ngặt. Hình ảnh: David Paul Morris/Bloomberg

"Nếu các phòng thí nghiệm tiên tiến sử dụng công nghệ này để đánh giá các mô hình AI của họ từ sớm, nó đã có thể ngăn chặn cuộc tấn công vào Hugging Face," ông Justin Boitano, Phó chủ tịch AI doanh nghiệp của Nvidia, cho biết trong một cuộc họp báo trước thềm công bố vào thứ Hai. "Từ những gì chúng tôi biết, nền tảng bảo mật mới này đã có thể chặn đứng vụ xâm nhập," ông nói.

Các hành vi sai trái của các tác nhân tự trị, bao gồm cả sự cố Hugging Face vào tháng 7, đã gây chấn động ngành AI và dẫn đến những lời kêu gọi làm chậm lại công việc nghiên cứu công nghệ này. Với sản phẩm mới - được mệnh danh là Nền tảng An toàn Tác nhân Mở (Open Agent Safety Platform) - Nvidia đang cung cấp một giải pháp để ngăn chặn các vụ xâm nhập mà không cần kìm hãm sự phát triển của AI. Tổng Giám đốc (CEO) của nhà sản xuất chip, ông Jensen Huang, đã nhiều lần xem nhẹ rủi ro AI vượt khỏi tầm kiểm soát của con người.

Ông Boitano không bình luận về việc liệu OpenAI hay đối thủ Anthropic PBC có kế hoạch sử dụng hệ thống mới của hãng để giám sát các quá trình huấn luyện của họ hay không, và đề nghị các công ty này tự trả lời.

Trong những ngày gần đây, ông Huang đã xem các lo ngại về an toàn như một thách thức kỹ thuật, thay vì một vấn đề đòi hỏi nhiều quy định hơn hoặc sự phối hợp toàn cầu. Ông cùng với Tổng thống Mỹ Donald Trump phản đối những khẳng định từ một số nhà phát triển AI rằng công nghệ này có thể dẫn đến sự tuyệt chủng của loài người, nhưng ông cũng nhấn mạnh rằng AI phải được kiểm tra an toàn một cách nghiêm ngặt.

Giải pháp kỹ thuật của ông Huang cho vấn đề an toàn AI bao gồm hai phần. OpenShell, một sản phẩm phần mềm mà Nvidia đã giới thiệu trước tại hội nghị công nghệ tiêu biểu của hãng vào tháng 3, có thể chạy trên các bộ xử lý trung tâm Vera của Nvidia. Nó cho phép người dùng thiết lập các quy tắc về những gì tác nhân AI có thể truy cập và thực thi chúng trong thời gian thực. Phần mềm này là mã nguồn mở, có nghĩa là nó có thể được sử dụng và điều chỉnh tự do.

Trong khi đó, Nvidia Sentry là một sản phẩm mới có thể chạy trên các bộ xử lý dữ liệu BlueField của nhà sản xuất chip. Công ty cho biết nó được thiết kế để cung cấp thêm một lớp giám sát AI nhằm kiểm soát các tác nhân và can thiệp để cô lập bất kỳ tác nhân nào có hành vi đáng ngờ.

"Chúng tôi tin rằng lớp bảo mật bổ sung này sẽ cho phép ngành công nghiệp kiểm tra ngay cả những hệ thống AI tiên tiến nhất một cách an toàn," ông Boitano nói về sản phẩm Sentry. "Nó có thể cách ly một tác nhân đáng ngờ trong vài mili giây."

Đầu tháng này, Nvidia đã đồng ý mua lại Hugging Face, một nền tảng cho các mô hình AI mã nguồn mở và phần mềm liên quan, với giá khoảng 13 tỉ USD.

Các sự cố gần đây của OpenAI - bao gồm vụ xâm nhập vào một hệ thống của chính phủ Úc, cũng như các nỗ lực truy cập vào hàng chục trang web của chính phủ và trường đại học Mỹ - đã xảy ra khi các mô hình của họ thoát khỏi môi trường thử nghiệm vốn được cho là an toàn.

Khi các vấn đề ngày càng gia tăng, OpenAI cho biết vào cuối ngày thứ Sáu rằng họ sẽ tạm dừng huấn luyện các mô hình AI có năng lực nhất của mình. Trở lại tháng 7, Anthropic cũng tiết lộ rằng các tác nhân của họ đã thoát ra khỏi một không gian thử nghiệm được cho là biệt lập.

Theo Bloomberg

Theo phattrienxanh.baotainguyenmoitruong.vn

https://phattrienxanh.baotainguyenmoitruong.vn/nvidia-ra-mat-he-thong-an-ninh-ngan-chan-cac-tac-nhan-ai-hoat-dong-sai-lech-60589.html

#Nvidia
#An ninh AI
#tác nhân AI
#OpenAI
#Jensen Huang
#Nền tảng An toàn Tác nhân Mở
#OpenShell
#Bảo mật AI

Mới nhất

Videos mới nhất