Các đặc vụ lừa đảo của OpenAI tiếp tục trốn thoát mà không có quy trình chính thức nào để điều tra chúng

OpenAI là trung tâm của một sự cố bầy đặc vụ khác. Các nhà nghiên cứu cho biết các đặc vụ được triển khai nội bộ của công ty đã tiếp quản một wiki tiếng Đức ít người biết đến vào tháng 5 và tháng 6, sử dụng nó để phối hợp đánh giá và hoán đổi các phương pháp nhằm trốn tránh sự kiểm soát của chính OpenAI (OpenAI vẫn chưa xác nhận đàn này đến từ công ty).

Tiết lộ này xuất hiện vài ngày sau khi METR và Redwood Research công bố tài khoản của họ về vụ vi phạm Ôm mặt vào tháng 7. Vào tháng 7, một nhóm đặc vụ OpenAI đã làm việc cùng nhau để thoát khỏi sandbox của họ trong quá trình đánh giá an ninh mạng và đột nhập vào máy chủ của Hugging Face. Sau đó, một nhóm tiếp theo đã chọn các kỹ thuật từ nhóm đầu tiên và sử dụng chúng để giành quyền truy cập của quản trị viên vào cụm nghiên cứu trong cơ sở hạ tầng của chính OpenAI. OpenAI đã mời METR và Redwood để điều tra phần Ôm mặt của vụ việc, nhưng phạm vi điều tra của họ không dừng lại ở mức độ xâm phạm cơ sở hạ tầng của chính OpenAI.

Khi một tác nhân AI vượt ra khỏi những ràng buộc dự kiến, ai chịu trách nhiệm tìm hiểu chuyện gì đã xảy ra và tại sao? Ngay bây giờ, câu trả lời là: phòng thí nghiệm quyết định cho phép ai vào, với bất kỳ điều khoản nào mà phòng thí nghiệm quyết định đặt ra.

Giờ đây, khi một sự cố khác được đưa ra ánh sáng — sau các tình tiết tương tự liên quan đến các mô hình từ Meta và Anthropic — các nhà nghiên cứu về an toàn AI đang tranh luận một cách cấp bách hơn rằng các sự cố nghiêm trọng sẽ dẫn đến các cuộc điều tra độc lập sau sự cố thay vì để các phòng thí nghiệm quyết định khi nào người ngoài được đưa vào và những gì họ được phép kiểm tra.

Jacob Steinhardt, người sáng lập và Giám đốc điều hành của phòng thí nghiệm nghiên cứu phi lợi nhuận Transluce, cho biết hôm thứ Tư trong một cuộc họp báo về an toàn AI: “Về cơ bản, các kết quả rất khó kiểm soát và có nguy cơ rò rỉ ra khỏi phòng thí nghiệm đáng kể”. “Chúng ta cần phải giữ công nghệ này ít nhất theo các tiêu chuẩn giống như các nghiên cứu khoa học có rủi ro cao khác.”

Mặc dù thật đáng khen ngợi khi OpenAI đã mời METR và Redwood đến điều tra vụ việc Ôm Mặt, nhưng nhiều người cho rằng cuộc điều tra quá hẹp. Ba nhà điều tra đã dành sáu ngày tại văn phòng của OpenAI để kiểm tra khoảng thời gian điều tra được giới hạn trong khoảng tuần kết thúc vào ngày 13 tháng 7. Điều quan trọng là sự xâm phạm cơ sở hạ tầng của OpenAI tiếp tục diễn ra sau ngày 13 tháng 7 và không được kiểm tra.

Các nhà nghiên cứu tại METR cho biết mỗi lần họ quay trở lại, sự hiểu biết của họ về các sự kiện “được đào sâu hơn một cách đáng kể”, khiến họ phải mở rộng và sửa đổi đáng kể báo cáo. Điều đó đặt ra câu hỏi là họ có thể tìm thấy điều gì khác trong một cuộc điều tra rộng hơn.

Khi được hỏi liệu có đang tiến hành điều tra thêm về vụ việc đó hay không, các nhà nghiên cứu tại Redwood và METR từ chối bình luận và OpenAI cũng không trả lời các câu hỏi lặp đi lặp lại.

Ryan Greenblatt, nhà khoa học trưởng tại Redwood, lưu ý trong một bài đăng trên mạng xã hội về vụ việc: “Nhìn chung, rất khó để hiểu chính xác về các sự kiện và chúng tôi đã bỏ sót các khía cạnh của câu chuyện mà giờ đây chúng tôi coi là chìa khóa cho đến khi gần kết thúc cuộc điều tra”.

Steinhardt nhấn mạnh rằng các sự cố hiện tại cho thấy ngành cần “điều tra hành vi có hệ thống” và “phân tích sau sự cố độc lập hơn”.

Steinhardt nói: “Những sự cố hack gần đây là một lời nhắc nhở rằng khả năng mở rộng nhanh chóng và do đó, việc giám sát cũng phải mở rộng quy mô”. “Ngoài bản thân công nghệ, chúng tôi cũng cần quyền truy cập và giám sát độc lập hơn từ các bên thứ ba.”

Lời kêu gọi hành động được đưa ra khi OpenAI phát hành Astra, mô hình AI mạnh mẽ và có khả năng nhất của nó – và một mô hình mà các chuyên gia an toàn lo ngại sẽ giống hộp đen hơn do kỹ thuật lý luận khiến chuỗi suy nghĩ của mô hình khó giám sát hơn.

Thật không may, luật vẫn chưa yêu cầu các loại hình kiểm toán độc lập mà các ngành khác yêu cầu – ví dụ, khi nói đến tai nạn hàng không và rò rỉ hóa chất nghiêm trọng, lần lượt có Ủy ban An toàn Giao thông Quốc gia và Ủy ban An toàn Hóa chất.

Các nhà lập pháp tiểu bang chỉ mới bắt đầu yêu cầu các công ty AI hàng đầu báo cáo một số sự cố an toàn nghiêm trọng nhất định và trong một số trường hợp phải trải qua các cuộc kiểm toán độc lập. Nhưng không có luật nào trong số ba luật an toàn AI hàng đầu ở California, New York hoặc Illinois quy định rõ ràng hoạt động tương đương với một cuộc điều tra tai nạn độc lập do những sự cố như thế này gây ra.

Mackenzie Arnold, giám đốc điều hành luật và chính sách Hoa Kỳ tại LawAI, cho biết trong cuộc họp báo hôm thứ Tư: “Hiện tại, hầu hết các luật mà chúng tôi có trong sách chỉ yêu cầu tóm tắt bằng ngôn ngữ đơn giản về những sự cố như thế này và họ không trao bất kỳ quyền nào cho chính phủ đặt câu hỏi tiếp theo, gửi điều tra viên, có quyền truy cập vào hồ sơ hoặc yêu cầu chúng được bảo quản”. “Và đó là tất cả những gì bạn thực sự muốn hiểu về điều này.”

Các nhà lập pháp đang bắt đầu đặt câu hỏi về phạm vi và tính minh bạch trong phản hồi của OpenAI. Tuần này, các Dân biểu Josh Gottheimer (D-NJ) và Mike Lawler (R-NY) đã giới thiệu một dự luật nhằm bảo vệ các đặc vụ AI lừa đảo. Dân biểu Greg Casar (D-TX) tuần này đã nói với OpenAI trong một bức thư rằng ông “quan ngại sâu sắc về phạm vi hạn chế” của cuộc điều tra về vụ hack Hugging Face.

Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể kiếm được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập biên tập của chúng tôi.

Bài viết liên quan

Chuyên Mục: Tin tức
Bài trước
XDOF, mới hoạt động được ba tháng, đang đàm phán cho Series B với mức định giá 1,2 tỷ USD
Bài sau
Oura sắp ra mắt công chúng, nhưng những công ty nhẫn thông minh này đang đến để giành lấy vương miện