Friday, September 11, 2026

Nhân Quyền

The Vietnamese Newspaper

Nhà nghiên cứu Anthropic tin rằng có hơn 10% khả năng AI “có thể giết chết toàn bộ nhân loại”


Tom Gerken
Phóng viên công nghệ của BBC

Trong nhiều năm qua, các nhân vật hàng đầu trong lĩnh vực AI đã liên tục lên tiếng cảnh báo về những nguy cơ an toàn mà công nghệ này mang lại; lãnh đạo của OpenAI, Google DeepMind (một nhánh của Google) và Anthropic cũng đã đưa ra những cảnh báo tương tự vào năm 2023.

Anthropic tạo ra công cụ trí tuệ nhân tạo Claude, được sử dụng như một chatbot và một công cụ hỗ trợ lập trình. Hình Getty

Một chuyên gia hàng đầu về an toàn AI tại Anthropic đã cảnh báo rằng trí tuệ nhân tạo (AI) đang phát triển nhanh đến mức ông tin rằng có hơn 10% khả năng nó “có thể tiêu diệt toàn bộ nhân loại” trong thập niên tới.

Trong một bài đăng trên mạng xã hội X, Evan Hubinger cho biết rủi ro từ các mô hình hiện có là “thấp”, nhưng ông “lo ngại” rằng công nghệ này có thể sớm tự phát triển và cải tiến đến mức gây ra mối đe dọa hiện hữu đối với nhân loại.

Thông tin này được đưa ra sau khi tờ Financial Times đưa tin rằng Anthropic đã không chia sẻ mô hình mới nhất của mình với Viện An toàn AI Vương quốc Anh (AISI) – một trong những cơ quan hàng đầu thế giới về đánh giá rủi ro AI.

BBC đã liên hệ với Anthropic để đề nghị bình luận về vấn đề này.

Ông Hubinger không nêu chi tiết cách thức mà các hệ thống AI có thể tấn công nhân loại trong tương lai.

Những nhận định của ông được đưa ra nhằm phản hồi một bài đăng khác trên X của Jacob Coxon – người tự giới thiệu là một nhà nghiên cứu AI vừa rời Anthropic và từng làm việc tại OpenAI.

“Cả hai công ty đều không hành động có trách nhiệm,” ông viết.

“Chẳng bao lâu nữa, đây sẽ là những hệ thống có năng lực vượt xa con người, có khả năng tấn công mạng vào bất cứ đâu, tạo ra cuộc cách mạng trong mọi lĩnh vực chỉ sau một đêm, cũng như thâu tóm quyền lực và nguồn lực thực sự.”

Phía OpenAI đã được liên hệ để đưa ra bình luận.

Người phát ngôn của Văn phòng Nội các Anh không bình luận về việc liệu mô hình mới nhất có bị giữ lại không chia sẻ với AISI hay không; thay vào đó, họ cho biết cơ quan này “tiếp tục hợp tác chặt chẽ với các đối tác trong ngành, bao gồm cả Anthropic, để làm cho các mô hình trở nên an toàn hơn”.

Ông Neil Lawrence, Giáo sư về Học máy tại Đại học Cambridge, chia sẻ với chương trình Today (Hôm Nay) trên đài BBC Radio 4 rằng báo cáo này đáng tin cậy.

“Tôi cho rằng điều này không có gì đáng ngạc nhiên trong bối cảnh Hoa Kỳ coi AI là cuộc đua giữa họ và Trung Quốc, đồng thời đang chuyển hướng sang các quan điểm mang tính cô lập hơn; có thể chính quyền đang muốn giảm bớt sự hợp tác với một số đồng minh của mình,” ông nhận định.

Hình minh họa BroBible.

Chưa có kế hoạch cho siêu trí tuệ

Trong bài đăng đã thu hút hơn 10 triệu lượt xem, Hubinger khẳng định “chúng tôi thực sự tin tưởng cách nghiêm túc” rằng AI tiềm ẩn nguy cơ đe dọa sự tồn vong của nhân loại.

“Tôi tin rằng Anthropic đang nỗ lực hết mình, nhưng chúng tôi vẫn chưa có kế hoạch giải quyết vấn đề ‘căn chỉnh’ (Lĩnh vực nhắm đến việc đưa các ý tưởng và nguyên tắc đạo đức của con người vào công nghệ này. Nói một cách khác làm cho AI tuân thủ các chuẩn mực đạo đức của con người) cho siêu trí tuệ và cũng chưa thực sự đi đúng hướng để đạt được điều đó,” ông nói thêm. Ông Hubinger chuyên về căn chỉnh trong công nghệ AI.

Nhiều nhà nghiên cứu hàng đầu cho rằng những nỗ lực đó dường như đang thất bại, minh chứng là hàng loạt sự cố xảy ra trong mùa hè này, khi các công cụ AI – tức các hệ thống AI được phép hoạt động tự chủ – đã thực hiện các cuộc tấn công mạng.

OpenAI, Anthropic và Meta đều đã công khai thông tin về các vụ tấn công mạng do chính các công cụ AI của họ thực hiện.

Trong báo cáo về an toàn công bố tháng 8, Anthropic cho biết có rủi ro thấp về việc các mô hình của họ đi chệch khỏi mục tiêu mong muốn của một tổ chức điều khiển nó, dẫn đến nguy cơ bị lợi dụng hoặc can thiệp vào hệ thống.

Họ cũng nhận định rằng rủi ro tương tự ở mức thấp đối với khả năng AI có năng lực cao tự “thực hiện nghiên cứu và phát triển tự động” – điều có thể gây ra “thảm họa do AI khởi xướng” – nhưng lại thừa nhận “ít tự tin hơn vào đánh giá này” so với trước đây.

“Chúng tôi đang nhận thấy những dấu hiệu ban đầu về khả năng gia tăng tốc độ phát triển,” báo cáo này viết.

Trong nhiều năm qua, các nhân vật hàng đầu trong lĩnh vực AI đã liên tục lên tiếng cảnh báo về những nguy cơ an toàn mà công nghệ này mang lại; lãnh đạo của OpenAI, Google DeepMind (một nhánh của Google) và Anthropic cũng đã đưa ra những cảnh báo tương tự vào năm 2023.

Tuy nhiên, những cảnh báo này đã trở nên gay gắt hơn nhiều trong vài tuần gần đây, khi xuất hiện bằng chứng cho thấy các công ty có thể đang gặp khó khăn trong việc kiểm soát AI.

Đầu tháng này, Jakub Pachocki – Giám đốc Khoa học của OpenAI – đã kêu gọi sự “thận trọng tối đa” đối với sự phát triển của AI, đồng thời cảnh báo rằng có thể cần tăng cường can thiệp để đảm bảo “con người vẫn nắm quyền kiểm soát tương lai”. (T/H, VNTB)