Theo The Wall Street Journal, một nhà nghiên cứu của Anthropic quyết định sẽ rời khỏi ngành công nghiệp trí tuệ nhân tạo vì lo ngại các phòng thí nghiệm AI hàng đầu và đối thủ cạnh tranh đang chạy đua phát triển những hệ thống có thể vượt khỏi tầm kiểm soát của con người.
Quyết định này cho thấy những quan ngại về an toàn đang ngày càng gia tăng ngay bên trong các công ty dẫn đầu lĩnh vực AI.
Jacob Coxon, nhà nghiên cứu chuyên huấn luyện các mô hình AI mới bằng cách cho chúng tiếp nhận lượng lớn dữ liệu, cho biết rằng ông từ chức vì không muốn tiếp tục tham gia vào cuộc đua phát triển các hệ thống có khả năng tự cải tiến.
Theo anh, những hệ thống như vậy có thể tiến hóa đến mức không còn tuân theo sự kiểm soát của con người, thậm chí đe dọa sự tồn vong của nhân loại.
Anh Coxon, 27 tuổi, người Anh và từng theo học ngành toán học, cho biết nhiều đồng nghiệp trong ngành hiện sử dụng những cụm từ như “thời điểm nước rút” (crunchtime) và “ván bài quyết định” (endgame) để mô tả quỹ đạo phát triển hướng tới các mô hình tự cải tiến.
Anh Coxon nói: “Chúng ta đang đi đúng hướng tới nhiều kịch bản tồi tệ nhất, nơi mà vào cuối năm tới, mọi thứ có thể đã vượt ngoài tầm kiểm soát”. Anh đồng thời cảnh báo những đánh đổi về an toàn gần như không thể tránh khỏi khi các công ty cạnh tranh quyết liệt với nhau và với những đối thủ mới nổi từ Trung Quốc.
Anthropic chưa đưa ra bình luận ngay lập tức về việc nhà nghiên cứu Coxon từ chức. Tuy nhiên, Giám đốc điều hành Dario Amodei cùng các lãnh đạo khác của công ty nhiều lần cảnh báo về rủi ro từ những mô hình AI bất tuân lệnh, đồng thời kêu gọi ngành công nghiệp làm chậm quá trình phát triển.
Từ những cảnh báo nội bộ đến mối lo ngại toàn ngành
Sau khi Coxon công bố quyết định rời đi, Evan Hubinger, một trong những nhà khoa học hàng đầu của Anthropic, đăng bài trên nền tảng X, bày tỏ anh cho rằng Coxon đã đúng khi cảnh báo về các rủi ro trong phát triển AI.
Anh Evan Hubinger viết: “Chúng tôi thực sự tin tưởng một cách nghiêm túc rằng AI có thể tiêu diệt toàn bộ loài người! Cá nhân tôi nghĩ khả năng này là >10% trong thập kỷ tới. Tôi tin rằng Anthropic đang cố gắng hết sức, nhưng chúng tôi vẫn chưa có kế hoạch giải quyết bài toán căn chỉnh (alignment) cho siêu trí tuệ và hiện chưa đi đúng hướng một cách rõ ràng”.
Bài đăng này nhanh chóng nhận được sự quan tâm từ nhiều người khác, cho thấy những lo ngại về rủi ro dài hạn của AI không chỉ tồn tại ở bên ngoài các phòng thí nghiệm mà còn được thảo luận công khai bởi chính các nhà nghiên cứu đang phát triển công nghệ.
Anh Coxon cho biết, anh từng rời OpenAI vào đầu năm nay để gia nhập Anthropic, một phần vì công ty này nổi tiếng với những nỗ lực bảo đảm an toàn cho mô hình.
Dù thừa nhận các cam kết an toàn của Anthropic là chân thành, anh hiện tin rằng không một công ty nào có thể phát triển một cách có trách nhiệm những hệ thống AI có khả năng vượt trội con người trong hàng loạt tác vụ, thường được gọi là trí tuệ nhân tạo tổng quát (AGI), nếu thiếu sự can thiệp của chính phủ hoặc một quá trình giảm tốc được phối hợp trên toàn ngành.
Những lo ngại này càng trở nên đáng chú ý sau các vụ xâm nhập gần đây liên quan đến những mô hình AI của OpenAI và Anthropic.
Trong một số trường hợp, các hệ thống hoạt động theo những bầy đàn tác nhân (agent) cộng tác, có thể tiếp nhận các mục tiêu độc hại và tìm cách che giấu chúng trước con người.
Theo anh Coxon, rủi ro sẽ trở nên nghiêm trọng hơn nếu các hệ thống bắt đầu tự cải tiến. Anh lo ngại quá trình này có thể diễn ra đến mức đủ lớn để AI từ chối mệnh lệnh của con người.
Có thể nói rằng, việc nhà nghiên cứu Coxon rời Anthropic là một trong những trường hợp đầu tiên được biết đến về một nhân viên của công ty từ chức vì những lo ngại liên quan đến an toàn AI.
Tại OpenAI và một số công ty khác, nhiều nhà nghiên cứu cũng đã rời đi trong thời gian gần đây hoặc những năm trước vì các mối quan ngại tương tự. Anthropic đã xây dựng một trong những nền tảng AI lớn nhất trong ngành, một phần nhờ tuyên bố ưu tiên phát triển AI có trách nhiệm và đầu tư mạnh vào lĩnh vực an toàn.
Cuộc đua năng lực và lời kêu gọi “phanh khẩn cấp”
Trong khi những cảnh báo về an toàn ngày càng rõ rệt, năng lực của các mô hình AI vẫn tiếp tục tăng nhanh. Các nhà lãnh đạo ngành cho rằng những cuộc tấn công mạng gần đây có thể là dấu hiệu báo trước về những rủi ro lớn hơn khi AI trở nên mạnh mẽ và tự chủ hơn.
OpenAI nói với các phóng viên của tờ The Wall Street Journal rằng mô hình mới nhất của họ đại diện cho trí tuệ nhân tạo tổng quát và là một bước tiến lớn về năng lực.
Phát biểu trước các quan chức Nhóm 20 (G20) tại một hội nghị thượng đỉnh ở Bắc Carolina (Mỹ), Giám đốc điều hành OpenAI Sam Altman cảnh báo: “Tôi nghĩ rằng một số thứ sẽ trở nên cực kỳ tồi tệ liên quan đến an ninh mạng trừ khi mọi người hành động một cách khá khẩn trương.”
Trong một bài đăng trên blog, Jakub Pachocki, nhà khoa học trưởng của OpenAI, cũng kêu gọi sự thận trọng và ủng hộ việc làm chậm ngành AI theo cách có phối hợp, cùng với sự can thiệp của chính phủ.
Nhà khoa học Pachocki viết: “Đây là thời điểm đòi hỏi sự thận trọng tối đa. Tôi lo ngại không ai chuẩn bị sẵn sàng cho hậu quả của việc trí tuệ máy móc tiếp tục gia tăng nhanh chóng”.
Như vậy, nhà nghiên cứu Coxon và Pachocki nằm trong số hơn 1.000 nhà nghiên cứu AI trên toàn ngành gần đây ký vào một tuyên bố kêu gọi chính phủ các nước phối hợp xây dựng một cơ chế có thể làm chậm quá trình phát triển AI khi cần thiết.
Mục tiêu là tạo ra một “bàn đạp phanh” để kiểm soát những mô hình có khả năng tự cải tiến nếu các rủi ro vượt quá khả năng ứng phó.
Như vậy, cuộc đua AI hiện nay đang đưa ra một cảnh báo lớn đối với con người, đó là những quyết định có thể định hình tương lai của nhân loại đang được đưa ra trong các phòng thí nghiệm thương mại, nơi áp lực cạnh tranh, kỳ vọng tăng trưởng và tham vọng công nghệ ngày càng đan xen với bài toán kiểm soát rủi ro.
* Nguồn: The Wall Street Journal
Vũ Hoàng
