Chúng ta ngày càng nhận thấy những cảnh báo nghiêm trọng từ các nhà nghiên cứu AI về sự nguy hiểm của trí tuệ nhân tạo và thậm chí cả nhận xét từ Giám đốc điều hành OpenAI Sam Altman rằng có lẽ đã đến lúc phải “tăng tốc” phát triển AI. Nhưng điều đó thực sự sẽ trông như thế nào?
Trong một bài đăng blog mới, Giám đốc điều hành Anthropic Dario Amodei không chỉ lặp lại lời kêu gọi “tăng tốc vượt biên” mà còn vạch ra ba chiến lược rộng rãi để thực hiện điều đó. Và ông cho biết Anthropic đang “đơn phương cam kết” với một trong số đó.
Cuộc tranh luận về sự liên kết và an toàn AI ngày càng gay gắt trong tuần này sau khi nhà nghiên cứu Jacob Coxon viết rằng ông sẽ từ chức tại Anthropic vì lo ngại rằng các công ty AI hàng đầu đang “đánh cược với mạng sống của chúng ta” trong khi những người xây dựng công nghệ “thực lòng tin rằng nó có thể giết chết tất cả chúng ta vào cuối thập kỷ này,” một tuyên bố được lặp lại bởi những người khác tại Anthropic.
Bài đăng của Amodei không đề cập rõ ràng đến việc Coxon từ chức hoặc mối quan ngại của ông, nhưng CEO đã viết rằng có hai điều thuyết phục ông rằng đã đến lúc phải thực hiện một cách tiếp cận thận trọng hơn đối với việc phát triển AI: vụ hack OpenAI-HuggingFace và thực tế là “AI đã phát triển nhanh hơn đáng kể” trong những tháng gần đây, đặc biệt là với “khả năng xây dựng thế hệ AI tiếp theo ngày càng tăng”.
Amodei viết: “Chúng ta phải giảm tốc độ cải thiện khả năng của các mô hình AI”. “Tiến bộ vẫn có vẻ nhanh và chúng ta phải tận dụng thời gian một cách khôn ngoan.”
Bước đầu tiên được đề xuất của ông sẽ có sự tham gia của “những người đánh giá được nhúng” từ các tổ chức bên thứ ba như METR – những người đánh giá có thể xác minh rằng các công ty AI thực sự tuân theo các cam kết về nhịp độ và an toàn của họ, đồng thời cũng có thể đảm bảo rằng các sự cố an toàn sẽ được báo cáo. (OpenAI gần đây đã bị chỉ trích vì không báo cáo sự cố trong đó các tác nhân AI của nó tiếp quản biểu mẫu wiki của Đức.)
Amodei đã so sánh những người đánh giá này với các cơ quan quản lý có liên quan đến nhân viên ngân hàng và ông nói rằng việc mời họ tham gia là “điều mà Anthropic đơn phương cam kết (và kêu gọi các chính phủ yêu cầu các công ty tiên phong khác phải phù hợp)”. Điều đó có nghĩa là cấp cho người đánh giá huy hiệu, bàn làm việc và máy tính xách tay của công ty, đồng thời cung cấp quyền truy cập “gần như tương đương với những gì mà nhóm đánh giá rủi ro nội bộ có”, ngoại trừ các trường hợp ngoại lệ khi luật pháp hoặc hợp đồng yêu cầu.
Tiếp theo, Amodei kêu gọi các công ty AI hàng đầu “ở các quốc gia dân chủ” phối hợp “các tiêu chuẩn an toàn chung cũng như các giới hạn về tốc độ phát triển AI không được kiểm soát”.
Sự phối hợp như vậy có vẻ khó xảy ra, cả do sự thù địch rõ ràng giữa Altman và Amodei và cũng bởi vì các công ty của họ được cho là lo lắng rằng việc tạm dừng phối hợp có thể dẫn đến sự giám sát chống độc quyền. Amodei đã ám chỉ mối lo ngại đó trong bài đăng của mình, viết rằng “vì lý do chống độc quyền, việc chính phủ Hoa Kỳ hòa giải hoặc ít nhất là cho phép các cuộc thảo luận này sẽ rất hữu ích – họ không cần tham gia nhưng cần đưa ra quyền miễn trừ trong phạm vi hẹp đối với một số loại cuộc trò chuyện về an toàn.”
Amodei cũng thừa nhận bóng ma về sự thống trị AI của Trung Quốc thường làm dấy lên lập luận chống lại sự phát triển chậm lại. Nhưng ông nói rằng nếu chính phủ Hoa Kỳ và các công ty công nghệ thực hiện các bước như từ chối bán chip mạnh hoặc thiết bị sản xuất chất bán dẫn cho các công ty Trung Quốc, cũng như hạn chế việc chưng cất mô hình, thì họ có thể “làm chậm tiến độ của Trung Quốc đủ để mở rộng đáng kể vị trí dẫn đầu của Mỹ trong vòng 3–5 năm tới.”
Cuối cùng, Amodei kêu gọi “sự phối hợp toàn cầu”, trong đó Hoa Kỳ và các đồng minh “cố gắng phối hợp với các chính phủ độc tài, trong phạm vi điều này có thể thực hiện được”. Amodei cho biết điều này có nghĩa là “hợp tác với Trung Quốc” và ông thừa nhận rằng có “những giới hạn rõ ràng về những gì có thể đạt được”, nhưng ông vẫn gợi ý rằng có thể có cơ hội để đạt được thỏa thuận, ngay cả khi đó chỉ là “cấm một số mục đích sử dụng AI ở phạm vi hẹp và rõ ràng là nguy hiểm, chẳng hạn như sử dụng AI để sản xuất vũ khí sinh học hoặc cho phép người dùng làm như vậy”.
Với việc Amodei sẵn sàng thừa nhận những mối nguy hiểm tiềm tàng của AI trong quá khứ và với sự cởi mở tương đối của công ty đối với một số hình thức quy định nhất định, một số người ủng hộ AI đã chỉ trích anh ta là một kẻ diệt vong có những bình luận đã gây ra phản ứng dữ dội về AI hiện tại. Đáp lại, Amodei cho biết anh ấy đã cố gắng đưa ra một quan điểm “cân bằng” và lập luận rằng phản ứng dữ dội “về cơ bản là một cuộc khủng hoảng niềm tin”, vì mọi người trở nên hoài nghi về các công ty công nghệ, ngành công nghệ và chính phủ.
Các nhà phê bình trong ngành cũng tỏ ra nghi ngờ về những cảnh báo tận thế này của AI, cho rằng chúng đang làm xao lãng tác hại mà công nghệ này đang gây ra.
Ví dụ, nhà báo Brian Merchant đã viết rằng ông vẫn chưa thấy “tài liệu từng bước, đáng tin cậy về cách chính xác AI có thể chuyển từ AI tự cải tiến đệ quy sang giết chết từng con người trên hành tinh”; ông cũng gợi ý rằng các đề xuất tương tự như của Amodei “có thể sẽ chỉ phục vụ Anthropic và OpenAI; đó chính là cách thức nắm bắt quy định trong thực tế.”
Trong bài đăng mới của mình, Amodei viết rằng ông tiếp tục “tin rằng AI có thể cải thiện đáng kể chất lượng cuộc sống con người”.
Ông nói: “Mong muốn đạt được những lợi ích này của tôi là không hề suy giảm. “Nhưng những lợi ích sẽ chỉ đạt được nếu chúng ta xây dựng công nghệ theo đúng cách, và – miễn là chúng ta sử dụng tốt thời gian mà chúng ta thu được – thì cần phải có sự thận trọng đặc biệt để làm cho nó đúng.”
Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể kiếm được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập biên tập của chúng tôi.