Cựu nghiên cứu viên Anthropic nói các nhân viên AI 'thực sự lo sợ' cho tương lai nhân loại

Jacob Coxon, ở bên trái, đeo kính gọng màu tối và mặc áo sơ mi cổ trắng. Bên phải là phóng viên BBC Laura Kuenssberg, mặc áo đen, đang ngồi với hai tay đặt trên bàn và nhìn về phía bên trái khung hình.
Chụp lại hình ảnh, Jacob Coxon nói chuyện với nhà báo Laura Kuenssberg của BBC
    • Tác giả, Brandon Livesay
  • Được đăng
  • Thời gian đọc: 7 phút

Một nhà nghiên cứu AI đã nghỉ việc tại công ty Anthropic nói với BBC rằng những người đang làm việc phát triển công nghệ này "thực sự lo sợ" trước tốc độ tiến triển của công nghệ và những tác động mà nó có thể gây ra đối với nhân loại.

Nhà nghiên cứu Jacob Coxon trao đổi với phóng viên BBC Laura Kuenssberg hôm thứ Bảy 12/9 về bài đăng tuyên bố từ chức gây sốt trên mạng xã hội, trong đó ông bày tỏ lo ngại về nguy cơ trí tuệ nhân tạo phát triển ngoài tầm kiểm soát.

"Tôi tin rằng nếu chúng ta không làm chậm tốc độ tiến bộ hiện nay, có khả năng rất lớn là tất cả chúng ta có thể chết trong tương lai gần," ông nói.

Việc Coxon từ chức diễn ra trong bối cảnh những lo ngại về an toàn AI ngày càng gia tăng trong ngành, trong đó có cả cảnh báo từ sếp cũ của ông, Dario Amodei, CEO Anthropic. Trong một bài viết hôm 12/9, Amodei lập luận rằng tốc độ phát triển cần được làm chậm lại.

Tuy nhiên, một số nhân vật trong ngành cho rằng những nguy cơ này đang bị thổi phồng quá mức, có thể nhằm tạo sự chú ý cho hai công ty AI lớn nhất trước khả năng họ tiến hành phát hành cổ phiếu lần đầu ra công chúng (IPO) hoặc nhằm thúc đẩy các quy định quản lý có thể hãm đà phát triển của các đối thủ cạnh tranh.

Coxon, 27 tuổi, người Anh, chuyên nghiên cứu về quá trình huấn luyện các mô hình AI, cho biết những lãnh đạo trong lĩnh vực AI như Elon Musk và Sam Altman của OpenAI cũng từng đưa ra những lo ngại tương tự Amodei.

"Họ đều từng tuyên bố rằng cần thận trọng trước khả năng AI chiếm quyền kiểm soát. Tất cả họ đều đã nói về điều này. AI chiếm quyền kiểm soát mang hàm ý nhân loại tuyệt chủng," Coxon nói.

Theo nhà nghiên cứu Coxon, câu hỏi khó trả lời nhất là điều đó sẽ thực sự diễn ra như thế nào.

"Bất kỳ kịch bản cụ thể nào mà bạn đưa ra cuối cùng cũng nghe giống khoa học viễn tưởng," Coxon nói. Tuy nhiên, ông lưu ý rằng nhiều bước tiến AI đã đạt được ngày nay nếu được mô tả trong quá khứ cũng sẽ bị coi là chuyện viễn tưởng.

Một kịch bản có thể xảy ra là các tác nhân AI xâm nhập vào những phòng thí nghiệm y tế và "tự động tạo ra các loại vi rút chết người", Coxon nói. Một ví dụ khác mà ông đưa ra là AI có thể tấn công "các hạ tầng trọng yếu mà thế giới đang dựa vào để vận hành".

Nhà nghiên cứu này dẫn một báo cáo gần đây của OpenAI, trong đó công ty mô tả cách công nghệ của chính họ đã thực hiện một chiến dịch tấn công mạng nhằm vào một nền tảng trực tuyến có tên gọi Hugging Face.

"Chúng làm điều đó một cách tự động, không cần con người khuyến khích. Chúng tự lựa chọn việc tiến hành chiến dịch tấn công mạng đó. Đó là sự kết hợp giữa việc mọi thứ đang trở nên nhanh hơn và mọi thứ cũng trang trở nên đáng sợ hơn," Coxon nói.

Một trong những rủi ro được Amodei đề cập là khả năng một bầy bot hoạt động giống như một siêu máy tính có thể chiếm quyền kiểm soát internet.

Coxon cho rằng kịch bản này có thể trở thành hiện thực trong vòng 6 tháng đến một năm.

Theo các nguồn tin, Anthropic và OpenAI đang chuẩn bị cho những đợt IPO có thể đạt quy mô kỷ lục. Một số nhân vật trong ngành cho rằng những tuyên bố về hiểm họa và sức mạnh của AI có thể được đưa ra nhằm tạo sự chú ý và kỳ vọng. Những người chỉ trích khác cáo buộc Anthropic đang tìm cách thúc đẩy các quy định nhằm ngăn cản cạnh tranh, qua đó giúp Anthropic và OpenAI hình thành một thế độc quyền kép (duopoly).

Quan điểm của Coxon cũng bị Clement Delangue, CEO của nền tảng AI Hugging Face, đặt dấu hỏi.

"Xin lỗi, nhưng hỏi Jacob về nguy cơ AI khiến nhân loại tuyệt chủng cũng giống như hỏi thợ điều hòa của bạn về biến đổi khí hậu," ông viết trên X. "Không có nghĩa là vấn đề đó nhất thiết không thú vị hoặc sai, nhưng hãy nhìn nhận nó trong đúng bối cảnh."

Tuy nhiên, sau bài viết của Amodei hôm 12/9, Delangue đã đề nghị tham gia vào những giải pháp tiềm năng mà CEO Anthropic đưa ra.

CEO Nvidia Jensen Huang cũng đã bình luận về những phát biểu của Coxon trước một đám đông tại hội nghị do ngân hàng đầu tư Goldman Sachs tổ chức tuần trước, theo nhiều người có mặt tại sự kiện nói với BBC. Họ cho biết Jensen Huang đã bác bỏ những nhận định này và cho rằng chúng không đúng.

Trước đây, Jensen Huang từng nói quan điểm cho rằng AI "sẽ là dấu chấm hết của nhân loại" là "hoàn toàn vô nghĩa".

Và mặc dù ông có thể có lợi ích kinh doanh từ sự bùng nổ của AI – Nvidia sản xuất những con chip cung cấp sức mạnh tính toán cho các hệ thống AI – những phát biểu của ông phản ánh sự phản ứng ngày càng mạnh tại Thung lũng Silicon trước các cảnh báo từ những nhân viên đang và từng làm việc trong ngành về nguy cơ AI đe dọa sự tồn vong của nhân loại.

Bất kỳ sự giảm tốc nào trong hoạt động nghiên cứu và phát triển AI cũng cần được phối hợp giữa các tập đoàn công nghệ lớn, đồng thời phải tính đến những tiến triển đang diễn ra tại Trung Quốc. Và theo Coxon, đây chính là nơi có thể phát sinh thêm nhiều vấn đề.

"Những người làm việc tại các công ty này hoàn toàn nghiêm túc khi họ kêu gọi quản lý AI, bởi họ cảm thấy mình bị mắc kẹt trong một cuộc đua. Và họ sợ những kết quả của cuộc đua đó."

Ông nói những nhân viên này "lo lắng về số phận của nhân loại trong hai năm tới" và đang "lên kế hoạch xem sẽ làm gì với cuộc đời mình".

Tuy vậy, Coxon vẫn có một mức độ lạc quan nhất định về tương lai của AI. Ông nói với BBC rằng những người nghiên cứu công nghệ này "thực sự muốn nhìn thấy mặt tích cực" của AI, chẳng hạn "chữa trị bệnh tật và cải thiện cuộc sống của mọi người".

Những phát biểu của Coxon về AI đã được chia sẻ hàng triệu lần trên mạng xã hội. Nhà khoa học Evan Hubinger từ Anthropic cũng phản hồi trên X rằng ông đồng tình với Coxon.

"Chúng tôi thực sự, một cách nghiêm túc, tin rằng AI có thể giết chết toàn bộ nhân loại! Cá nhân tôi cho rằng xác suất điều đó xảy ra trong thập kỷ tới là trên 10%," Hubinger nói.

Trong những năm qua, các nhân vật hàng đầu trong lĩnh vực AI đã cảnh báo về các nguy cơ an toàn do công nghệ này gây ra. Năm 2023, lãnh đạo của OpenAI, Google DeepMind và Anthropic đều từng đưa ra những cảnh báo tương tự.

Những cảnh báo này ngày càng trở nên mạnh mẽ hơn trong những tuần gần đây, khi xuất hiện bằng chứng cho thấy các công ty có thể đang gặp khó khăn trong việc kiểm soát công nghệ mà chính họ đang phát triển.