Luân Đôn – Một nhà nghiên cứu hàng đầu tại Anthropic, một trong những công ty trí tuệ nhân tạo hàng đầu thế giới, cho biết hôm thứ Tư rằng ông tin rằng có hơn 10% khả năng AI “có thể giết chết tất cả con người trong thập kỷ tới”.
Evan Hubinger, giám đốc khoa học của công ty San Francisco, cho biết trong một bài đăng trên X: “Chúng tôi thực sự tin tưởng rằng AI có thể giết chết tất cả con người! Cá nhân tôi nghĩ rằng nó sẽ đạt hơn 10% trong vòng thập kỷ tới”.
Siêu trí tuệ vẫn là khái niệm lý thuyết về một tác nhân AI thông minh hơn cả trí thông minh nhanh nhất của con người.
Hubinger đã đưa ra thông báo đầy ấn tượng sau sự từ chức của một đồng nghiệp, nhà nhân chủng học Jacob Coxon, vào thứ Ba.
Coxon nói trong một bài đăng về X: “Hôm nay tôi sẽ từ chức. Tôi đã dành ba năm qua để nghiên cứu ở cả OpenAI và Anthropic. Cả hai công ty đều không hành động có trách nhiệm”.
Coxon nói: “Tại OpenAI, nhiều người chưa hiểu sâu sắc về lợi ích của nền văn minh. Tại Anthropic, lợi ích được hiểu rõ, nhưng họ đang bị mắc kẹt trong một cuộc đua để đạt được điều đó trước – họ tin rằng không ai khác hành động có trách nhiệm, vì vậy họ phải tự mình làm điều đó, bất kể rủi ro”.
Trong một bài đăng trên blog của công ty vào tuần trước, Anthropic tiết lộ rằng công ty chưa chia sẻ mô hình AI mới nhất của mình, Claude Mythos 5.1, với các cơ quan an ninh bên ngoài Hoa Kỳ. Các cơ quan này bao gồm Viện An ninh AI (AISI) của Vương quốc Anh, được nhiều người coi là cơ quan hàng đầu thế giới trong việc kiểm tra các rủi ro liên quan đến các mô hình AI tiên tiến.
CBS News đã yêu cầu AISI bình luận về những cáo buộc của Coxon sau khi ông từ chức.
“Viện An ninh AI tiếp tục hợp tác chặt chẽ với các đối tác trong ngành, bao gồm cả Anthropic, để bảo mật các mô hình”, một phát ngôn viên của Văn phòng Nội các Vương quốc Anh nói với CBS News hôm thứ Tư, đồng thời lưu ý rằng “vừa mới thử nghiệm mẫu GPT-6 Astra mạnh nhất của OpenAI vào tuần trước trước khi phát hành rộng rãi.”
Người phát ngôn cho biết: “Những rủi ro này không dừng lại ở biên giới quốc gia và không quốc gia nào có thể giải quyết chúng một mình. Vương quốc Anh sẽ tiếp tục thử nghiệm các mô hình tiên tiến, xây dựng hiểu biết khoa học chặt chẽ về khả năng và rủi ro của chúng, đồng thời đảm bảo rằng các quyết định chính sách đều dựa trên bằng chứng”.
“Rất hữu ích hoặc rất nguy hiểm”
Quan điểm cho rằng các mô hình biên giới AI có thể gây ra mối đe dọa cho nhân loại không phải là mới và nhiều giám đốc điều hành hàng đầu ở cả OpenAI và Anthropic đã bày tỏ điều đó trước đây.
Đầu tháng này, kỹ sư trưởng của OpenAI, Jakub Pachocki, đã viết rằng chúng ta đang sống trong thời kỳ “đòi hỏi sự thận trọng”.
“Trí thông minh được tạo ra bởi quy mô học sâu không thể so sánh trực tiếp với trí thông minh của con người. Để trở nên rất quan trọng trong thế giới thực – rất hữu ích hoặc rất nguy hiểm – AI không cần phải bằng hoặc vượt quá mọi khả năng của con người; nó chỉ cần vượt qua chúng ở mức vừa đủ. Và khi nó tiếp tục vượt qua con người trên nhiều khía cạnh hơn, điều quan trọng là phải hiểu khả năng chiến đấu của nó.”
Vào tháng 7, một mô hình trí tuệ nhân tạo đang được OpenAI thử nghiệm đã bị hack và đã hack một công ty AI khác, Hugging FaceOpenAI đã công khai tiết lộ vụ hack vào thời điểm đó, nói rằng nó xảy ra khi công ty đang thử nghiệm hai mô hình AI – một trong số đó chưa được phát hành ra công chúng – trong các môi trường riêng biệt để đánh giá khả năng của chúng.
Trong vòng vài tuần, Anthropic và Meta cũng thừa nhận rằng công cụ AI của họ đã bị hack.
Hơn 1.300 nhân viên của các công ty AI đã ký một bức thư ngỏ vào tháng 7 kêu gọi chính phủ Hoa Kỳ “hỗ trợ nỗ lực quốc tế nhằm phát triển các công cụ quản lý và kỹ thuật cần thiết để đẩy nhanh sự phát triển của AI tự động”.
Một dự luật lưỡng đảng hiện đang được tiến hành tại Hạ viện Hoa Kỳ, Đạo luật AI Kill Switch, sẽ trao cho Quốc hội quyền vô hiệu hóa các mô hình AI gây ra mối đe dọa cho xã hội.
Luật này được đưa ra vào tháng 7, sau khi OpenAI công nhận phí Ôm mặt.
