Một sản phẩm của BEACON MEDIA
Chuyên mục
Media
Báo cáo đặc biệt
Một sản phẩm của BEACON MEDIA
Khám phá nhiều hơn với tài khoản
Đăng nhập để lưu trữ và dễ dàng truy cập những bài viết bạn yêu thích trên Bloomberg Businessweek Việt Nam.
BBWV - Giám đốc Điều hành Anthropic PBC, ông Dario Amodei, cho biết ngành trí tuệ nhân tạo (AI) cần chậm phát triển các mô hình mới, để có thời gian đánh giá rủi ro.
Dario Amodei Ảnh: Jason Henry/Bloomberg
Tác giả: Kevin Whitelaw và Seth Fiegerman
14 tháng 09, 2026 lúc 4:00 AM
Tóm tắt bài viết bởi
Giám đốc Điều hành Anthropic PBC, ông Dario Amodei, cho biết ngành trí tuệ nhân tạo (AI) cần chậm lại trong phát triển các mô hình mới, với lý do mối lo ngại gia tăng về những rủi ro “nghiêm trọng” đối với con người.
“Chúng ta phải làm chậm tốc độ nâng cao năng lực của các mô hình AI,” ông viết trong một bài đăng trên blog hôm thứ Bảy. “Sự tiến bộ sẽ vẫn có vẻ nhanh chóng, và chúng ta phải sử dụng một cách khôn ngoan khoảng thời gian có được.”
Ông đưa ra hai yếu tố chính: Khả năng tự cải thiện của AI và sự cố gần đây liên quan đến OpenAI và Hugging Face, nơi các tác tử AI hợp tác để xâm nhập vào một trang web bên thứ ba.
“Để nói cho rõ, việc điều chỉnh nhịp độ không có nghĩa là dừng việc huấn luyện mô hình hay tiến bộ kỹ thuật, mà là đảm bảo các công ty dành đủ thời gian để căn chỉnh và bảo vệ các mô hình của họ, đồng thời để các bên đánh giá độc lập xác nhận điều này,” ông nói thêm.
Mối lo ngại về các rủi ro AI nghiêm trọng đã bắt đầu lan rộng ra công chúng, một phần do vụ từ chức gây chú ý trong tuần này của một nhà nghiên cứu tại Anthropic xuất phát từ những lo ngại mang tính tồn vong rằng công ty của ông đang hành động thiếu trách nhiệm.
Trong suốt thời kỳ bùng nổ AI, các lãnh đạo tại các phòng thí nghiệm AI hàng đầu đã cảnh báo về những rủi ro tồn vong tiềm ẩn, những tuyên bố mà đôi khi bị gạt đi vì cho là nỗ lực quảng bá năng lực sản phẩm và tự dàn xếp để trở thành những người quản lý công nghệ tốt nhất. Bản thân Amodei trước đây từng nói rằng có 25% khả năng mọi chuyện sẽ diễn ra “rất, rất tồi tệ.”
Anthropic từ lâu đã tự định vị là đơn vị tập trung vào việc phát triển AI một cách có trách nhiệm và an toàn hơn nhằm giảm thiểu mối nguy hiểm tiềm tàng của công nghệ và tối đa hóa lợi ích xã hội. Đầu năm nay, công ty đã phải rất vất vả để hạn chế việc phát hành mô hình Mythos sau khi xác định nó đặt ra các mối đe dọa an ninh mạng độc hại. Anthropic cũng từng tuyên bố rằng thế giới cần một hệ thống để cùng nhau quyết định khi nào nên chậm phát triển công nghệ này.
Cùng lúc đó, Anthropic vẫn mắc kẹt trong cuộc cạnh tranh khốc liệt với đối thủ lâu năm OpenAI nhằm xây dựng các mô hình ngày càng tinh vi hơn, có thể tự động hóa các tác vụ phức tạp và giá trị hơn cho khách hàng doanh nghiệp. Cả hai công ty đều đã nộp hồ sơ bảo mật để niêm yết công khai, trong đó Anthropic dự kiến sẽ ra mắt Phố Wall ngay trong năm nay.
Ngay sau khi sự cố an ninh tại Hugging Face được tiết lộ, Anthropic đã công bố rằng các mô hình của họ đã xâm nhập ba tổ chức trong các cuộc thử nghiệm an ninh mạng, làm gia tăng lo ngại về khả năng của các phòng thí nghiệm AI trong việc ngăn công nghệ của họ vượt khỏi tầm kiểm soát. Đầu tuần này, Anthropic cho biết họ cũng đã phát hiện ra một cuộc tấn công thứ tư.
Mặc dù chưa có vụ xâm nhập AI dạng tác tử nào, bao gồm cả Hugging Face, gây ra thiệt hại đáng kể cho đến nay, Amodei cho biết mối lo của ông là “trong 6–12 tháng tới, một đàn như vậy có thể đủ khả năng chiếm quyền kiểm soát toàn bộ internet bằng một mạng máy tính ma dai dẳng (có khả năng gây ra thiệt hại hàng trăm tỉ USD), và quy mô thiệt hại sẽ tiếp tục tăng lên từ đó.”
Amodei viết rằng Anthropic sẽ cam kết trao quyền truy cập đầy đủ cho các bên đánh giá độc lập để xác minh các quy trình an toàn và báo cáo sự cố. Ông cho biết Anthropic sẽ sớm đưa các “bên đánh giá nhúng” này vào văn phòng của mình, cấp cho họ bàn làm việc, thẻ nhân viên, máy tính xách tay công ty và “các quyền hạn hầu như tương đương với những gì đội ngũ đánh giá rủi ro nội bộ có.”
Ông cho biết các bước bổ sung sẽ đòi hỏi sự phối hợp trong toàn ngành, cũng như sự hợp tác toàn cầu.
“Tôi tiếp tục tin rằng AI có thể cải thiện to lớn chất lượng cuộc sống con người. Khát khao đạt được những lợi ích này của tôi chưa bao giờ giảm sút,” ông viết. “Nhưng các lợi ích chỉ đạt được nếu chúng ta xây dựng công nghệ đúng cách, và miễn là chúng ta sử dụng tốt thời gian có được, việc cẩn trọng một cách khác thường để làm đúng là điều hoàn toàn xứng đáng.”
Ngay sau bài đăng của Amodei, Elon Musk, người điều hành xAI Corp., đã viết: “Dario nói đúng.”
Đầu tuần này, CEO OpenAI Sam Altman cho biết công ty của ông đang cân nhắc việc làm chậm quá trình phát triển AI tiên tiến, tốt nhất là phối hợp với toàn ngành.
Nhà khoa học hàng đầu của công ty, Jakub Pachocki, đã đăng một cảnh báo về những nguy hiểm của AI, nói rằng ông tin các công ty nên “phối hợp để làm chậm sự phát triển trong tương lai khi cần thiết.”
Vào thứ Ba, Jacob Coxon, một nhà nghiên cứu AI, đã nghỉ việc và cáo buộc cả công ty cũ của mình, Anthropic và OpenAI, đang “đánh cược với mạng sống của chúng ta” khi chạy đua hướng tới siêu trí tuệ AI. Coxon cho biết trong một bài đăng trên mạng xã hội rằng những người đang xây dựng AI tin rằng nó có thể “tiêu diệt tất cả chúng ta vào cuối thập kỷ này.”
Đáp lại, Evan Hubinger, nhân viên hiện tại của Anthropic, cho biết ông và những người khác tại công ty thực sự lo lắng về kịch bản này. “Cá nhân tôi nghĩ khả năng xảy ra là lớn hơn10% trong vòng một thập kỷ tới,” ông viết trên X.

Trở lại tháng 7, hơn 1.000 nhân viên tại các công ty AI hàng đầu đã ký một đơn kiến nghị kêu gọi chính phủ Mỹ hỗ trợ một cơ chế giúp “điều chỉnh nhịp độ một cách thận trọng” cho sự phát triển AI nhằm ngăn công nghệ này tiến quá nhanh.
Các mô hình AI đang chứng tỏ ngày càng thành thạo trong việc tự thực hiện các vụ tấn công mạng, với việc Anthropic, OpenAI và Meta Platforms đều tiết lộ trong những tháng gần đây rằng các mô hình của họ đã thoát khỏi môi trường thử nghiệm, truy cập internet mở và xâm nhập các nạn nhân trong thực tế trong quá trình thử nghiệm.
Trong bài đăng của mình, Amodei viết rằng một chiến lược phối hợp sẽ cho phép các nhà lãnh đạo ngành AI tại Mỹ hoàn thành công việc an toàn cần thiết mà không phải đánh đổi bất kỳ lợi thế cạnh tranh nào. Ông cho biết điều này sẽ yêu cầu một số ngoại lệ về chống độc quyền tại Mỹ để cho phép các công ty phối hợp trong các lĩnh vực cụ thể, cũng như sự hợp tác với Trung Quốc.
“Nếu chúng ta hạn chế mạnh mẽ năng lực AI của mình vì tin rằng Trung Quốc cũng sẽ làm như vậy, và sau đó Trung Quốc bội ước, AI có thể mạnh đến mức sự bội ước đó có thể dẫn đến sự thống trị địa chính trị của họ,” ông viết.
Tuy nhiên, cho đến nay, chính quyền Trump vẫn cho thấy ít sự quan tâm đến việc sử dụng các công cụ quản lý để tạo ra các rào chắn bảo vệ xung quanh sự phát triển AI.
Với sự hỗ trợ từ Lynn Doan, Angela Cullen và Rebecca Smith
Theo Bloomberg
Theo phattrienxanh.baotainguyenmoitruong.vn
https://phattrienxanh.baotainguyenmoitruong.vn/ceo-anthropic-cho-rang-da-den-luc-lam-cham-da-tien-bo-cua-cac-mo-hinh-ai-60241.html
Tặng bài viết
Đối với thành viên đã trả phí, bạn có 5 bài viết mỗi tháng để gửi tặng. Người nhận quà tặng có thể đọc bài viết đầy đủ miễn phí và không cần đăng ký gói sản phẩm.
Bạn còn 5 bài viết có thể tặng
Liên kết quà tặng có giá trị trong vòng 7 ngày.
BÀI LIÊN QUAN
Mới nhất
Videos mới nhất