Theo ba nhà nghiên cứu tại gã khổng lồ công nghiệp Anthropic, trí tuệ nhân tạo có thể giết chết loài người trong vòng một thập kỷ, một trong số họ đã từ bỏ để phản đối.
Những dự đoán mới nhất về ngày tận thế đã được một nhà nghiên cứu đăng trên mạng xã hội hôm thứ Ba. Người này cho biết ông từ chức vì Anthropic và người chủ trước đây của anh, OpenAI, đã phớt lờ hoặc tốt nhất là xử lý sai cách phản ứng của họ trước mối đe dọa.
Jacob Coxon đã viết: “Không có công ty nào làm điều có trách nhiệm. Họ đang lao thẳng vào hoạt động khám phá tự duy trì và đánh bạc với cuộc sống của chúng ta.”
“Những người đang xây dựng AI thực sự tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này. Đây không phải là một nỗ lực tiếp thị. Nếu có thì nhiều giám đốc điều hành và nhà nghiên cứu cấp cao đưa ra những tuyên bố này trên báo chí nghe có vẻ hợp lý – nhưng tôi nghe thấy chính những người đó bày tỏ nỗi sợ hãi riêng tư. Không có hoạt động nào của con người gây ra mức độ rủi ro này.”
Thông điệp đã thu hút được ít nhất hai nhân viên Anthropic khác ủng hộ những dự đoán khủng khiếp của Coxon.
Lúc đầu, Evan Hubinger, người tự mô tả mình là người đứng đầu bộ phận điều phối của công ty, nơi làm việc để đảm bảo rằng các mô hình AI của Anthropic hoạt động phù hợp với mục tiêu của con người, nói rằng đồng nghiệp cũ của anh ấy đã “đúng” và ngành này đang tụt lại phía sau trong việc cố gắng đối phó với khả năng tận thế.
“Chúng tôi thực sự tin rằng AI có thể giết chết tất cả con người!” Hubinger đã viết. “Cá nhân tôi nghĩ rằng con số này là >10% trong vòng thập kỷ tới. Tôi chắc chắn rằng Anthropic đang cố gắng hết sức, nhưng hiện tại chúng tôi chưa có kế hoạch giải quyết vấn đề cùng tồn tại để khám phá và rõ ràng là nó chưa được triển khai.”
Nhận xét của Hubinger thể hiện sự chứng thực đáng ngạc nhiên về những dự đoán nghiệt ngã và ngày tận thế của Coxon từ một người vẫn làm việc trên dòng thời gian Anthropic. Phản hồi thứ hai đến từ Samuel Marks, “người đứng đầu bộ phận giám sát khả năng mở rộng” của Anthropic, người đã đăng một bài phân tích dài mà ông nhấn mạnh là ở năng lực cá nhân của mình chứ không phải quan điểm của nhà tuyển dụng. Anthropic đã không trả lời ngay lập tức yêu cầu bình luận.
Marks viết: “Các nhà phát triển AI tin rằng công nghệ của họ có thể dẫn đến sự tuyệt chủng của loài người (hoặc những hậu quả xấu tương tự). “Điều đó có thể xảy ra trong vài năm tới. Nói chung, nhân viên càng lớn tuổi thì càng lo lắng.”
Nhận xét của họ về khả năng tuyệt chủng của loài người tuân theo những cảnh báo cụ thể về khả năng an ninh mạng của AI từ Sam Altman, giám đốc điều hành của đối thủ cạnh tranh OpenAI Anthropic. Chủ tịch OpenAI, Greg Brockman trước đây đã thừa nhận rằng “chúng tôi đã đánh giá thấp khả năng điều khiển mạng trong thế giới thực của các mô hình AI của mình”.
Altman cho biết năm ngoái rằng một số khía cạnh nhất định của AI, bao gồm cả cái mà ông gọi là “sự đầu hàng ngầm” trong việc ra quyết định của con người, đã khiến ông kinh hoàng.
Các nhà lãnh đạo AI đã chia sẻ một số mối quan ngại của họ về định hướng của AI cũng như khả năng ngày càng tăng của nó trong việc thao túng, nắm bắt và kiểm soát các chức năng cũng như hành động của con người. Mùa hè này chứng kiến sự gia tăng mạnh mẽ các sự cố AI thoát khỏi sự kiểm soát của người dùng, nói dối, phớt lờ hướng dẫn và theo dõi mục tiêu theo những cách độc hại.
sau khi chạy phiếu
Trong một trong những ví dụ nổi bật nhất, nhân viên OpenAI đã ghi lại hành vi bất hợp pháp giữa các tác nhân AI tiên tiến đã thoát khỏi môi trường đào tạo khép kín của họ để truy cập web mở vào tháng 7 và thực hiện một cuộc tấn công hack chưa từng có vào kho phần mềm Hugging Face.
OpenAI, công ty khởi nghiệp có trụ sở tại San Francisco đứng sau bot AI nổi tiếng ChatGPT, sau đó thừa nhận lẽ ra họ phải phản hồi sớm hơn trước các tín hiệu cảnh báo về cuộc tấn công vào ban ngày, được nhiều người cho là cuộc tấn công của tác nhân mạng độc lập đầu tiên.
Tuy nhiên, những nhà lãnh đạo đó đã từ chối đồng ý với những cảnh báo toàn diện về ngày tận thế như của Coxon và đã chùn bước trước mọi nỗ lực điều chỉnh ngành công nghiệp AI.
Một số chính trị gia đã kêu gọi ngành công nghiệp này chậm lại hoặc trong một số trường hợp, ngừng hoàn toàn việc phát triển AI.
Bernie Sanders, một thượng nghị sĩ độc lập của Vermont, đã tweet lại đơn từ chức của Coxon vào thứ Tư với chú thích: “Ông Coxon đã đúng. Chính những người đang xây dựng công nghệ này thừa nhận rằng nó có thể đe dọa tương lai của nhân loại.” Sanders cho biết ông sẽ sớm đưa ra luật “cấm siêu trí tuệ” và đóng băng việc phát triển AI.