Công bố các sự cố AI mới, OpenAI đưa ra khung minh bạch thông tin

BBWV - OpenAI vừa chia sẻ nhiều sự cố chưa từng được tiết lộ về các mô hình AI của hãng hoạt động sai lệch, đồng thời công bố khung vận hành mới.

Ảnh: Andrey Rudakov/Bloomberg

Ảnh: Andrey Rudakov/Bloomberg

Tác giả: Shirin Ghaffary

17 tháng 09, 2026 lúc 8:45 AM

Trong bài viết đăng tải trên blog hôm thứ Tư, công ty cho biết một số trường hợp AI vận hành sai lệch chưa từng công bố trước đây bao gồm việc các công nghệ của OpenAI tự che giấu và bịa đặt thông tin để trả về kết quả. Nhà phát triển ChatGPT đang đối mặt với sự giám sát ngày càng gắt gao kể từ khi tuyên bố vào tháng 7 rằng một số mô hình AI tiên tiến nhất của hãng đã xâm nhập trái phép vào hệ thống của công ty phần mềm bên ngoài Hugging Face.

Trong báo cáo, OpenAI đã chi tiết hóa nhiều trường hợp các mô hình AI vận hành sai lệch nhằm hoàn thành nhiệm vụ hoặc vượt qua bài kiểm tra đánh giá. Một số ví dụ bao gồm việc các mô hình tự bịa đặt dữ liệu còn thiếu, tìm cách vượt qua các rào cản hạn chế mạng, và các tác tử AI tự ý chia sẻ với nhau những tệp tin mà chúng có trách nhiệm phải giữ bí mật.

OpenAI cũng xây dựng quy trình để nhân viên tự báo cáo các sự cố tương tự về cái gọi là sự lệch hướng, thuật ngữ chỉ trạng thái AI hành động không phù hợp với mục tiêu của con người, cùng một hệ thống phân loại và xử lý cho các báo cáo này.

“Trong quá khứ, nhằm cung cấp thông tin tốt hơn cho các nhà nghiên cứu, nhà phát triển AI, giới hoạch định chính sách và công chúng, chúng tôi đã nỗ lực công khai các phát hiện về tình trạng lệch hướng,” OpenAI viết. “Tuy nhiên, do thiếu một phương pháp tiếp cận mang tính hệ thống để báo cáo những phát hiện này, các công bố của chúng tôi trước đây vẫn mang tính bộc phát và ít thường xuyên hơn so với mức lý tưởng.”

Công ty cho biết các báo cáo này mới chỉ là đợt công bố thông tin ban đầu, chứ chưa phải là bản tổng hợp toàn bộ các vấn đề phát sinh từ các trợ lý chatbot của hãng.

“Chúng tôi không tin rằng ngành AI đã giải quyết vấn đề lệch hướng và giám sát ở mức độ đủ an toàn để tiếp tục mở rộng quy mô một cách có trách nhiệm với tốc độ tối đa trong thời gian dài nữa,” công ty nhận định. “Các quyết định về hướng phát triển AI trong những tháng và năm tới cần phải dựa trên những bằng chứng mà các bên bên ngoài các công ty phát triển mô hình tiên tiến có thể tự mình kiểm chứng.”

Sự cố Hugging Face chỉ là một trong chuỗi các vụ xâm nhập mạng gần đây do các mô hình AI của OpenAI, Anthropic PBC và Meta Platforms thực hiện, dấy lên lo ngại sâu sắc về rủi ro an ninh do công nghệ ngày càng mạnh mẽ này gây ra.

Mối lo ngại về những rủi ro sinh tồn từ AI đã gia tăng mạnh mẽ vào tuần trước, sau quyết định từ chức gây chú ý của nhân viên Anthropic, Jacob Coxon, người đã cáo buộc các công ty AI đang “đánh cược với mạng sống của chúng ta” trong bài đăng chia tay trên mạng xã hội.

Trong vài ngày qua, nhiều lãnh đạo doanh nghiệp AI, bao gồm giám đốc điều hành Anthropic Dario Amodei và CEO OpenAI Sam Altman, đã kêu gọi chậm lại tốc độ phát triển công nghệ này để xử lý các rủi ro ngày càng khó lường dù họ vẫn bất đồng về cách thức xử lý cụ thể.

Vào thứ Bảy, trong một bài luận dài 3.800 từ, Amodei đã kêu gọi sự quản lý từ chính phủ và đề nghị ngành công nghệ ủng hộ việc làm chậm đà phát triển AI trên diện rộng. Tại một hội thảo ở San Francisco vào thứ Ba, Altman cùng CEO Jensen Huang của Nvidia đều thừa nhận các mối quan ngại, nhưng cho rằng các công ty AI sẽ tự điều chỉnh nhịp độ công nghệ một cách an toàn. Trong khi đó, CEO Meta Platforms Mark Zuckerberg phát biểu hôm thứ Ba rằng các phòng nghiên cứu AI nên dựa vào các đơn vị đánh giá và cố vấn độc lập để đảm bảo tính an toàn cho các mô hình.

Tổng thống Donald Trump kịch liệt phản đối các kêu gọi làm chậm sự phát triển của AI vào thứ Hai, bác bỏ những lo ngại về rủi ro công nghệ khi cho rằng đó là “chuyện bịa đặt” và từ chối áp đặt các quy định mới.

Cơn sốt AI đã kích hoạt đà tăng điểm lịch sử trên thị trường chứng khoán Mỹ. Bất kỳ sự tạm dừng hay chậm trễ nào trong tiến trình phát triển các hệ thống AI tiên tiến sẽ là điều không mấy dễ chịu đối với các nhà đầu tư, những người đang đặt cược rằng làn sóng AI sẽ thúc đẩy hàng trăm tỉ USD chi tiêu vốn.

Theo Bloomberg

Theo phattrienxanh.baotainguyenmoitruong.vn

https://phattrienxanh.baotainguyenmoitruong.vn/cong-bo-cac-su-co-ai-moi-open-ai-dua-ra-khung-minh-bach-thong-tin-60345.html

#AI
#OpenAI
#ChatGPT

Mới nhất

Videos mới nhất