OpenAI xác nhận ‘sự cố wiki’, cho biết họ ‘đang làm việc trên một khuôn khổ’ để tiết lộ thêm

OpenAI đã thừa nhận vai trò của mình trong một sự cố được báo cáo gần đây khi các đặc vụ AI chiếm giữ một diễn đàn wiki của Đức. Công ty cũng cho biết đã “xác định các tiêu chuẩn” về cách chia sẻ thông tin xung quanh các sự cố mà công nghệ của họ hoạt động theo những cách không mong muốn.

Trong một bài đăng trên X, OpenAI cho biết trước đây họ “coi sự sai lệch (khi các mô hình và tác nhân AI theo đuổi các mục tiêu khác với mục tiêu của người sáng tạo và người dùng) phần lớn là một câu hỏi nghiên cứu, được truyền đạt trong các ấn phẩm nghiên cứu”. Nhưng vì sự sai lệch đã “gây ra những loại tác động mới trong thế giới thực”, nên công ty cho biết cách tiếp cận của họ cần “mở rộng cho giai đoạn mới này của khả năng mô hình”.

Vào thứ Sáu, Reuters đưa tin rằng các đặc vụ OpenAI đã trốn thoát khỏi môi trường thử nghiệm của họ và “chiếm đoạt” một diễn đàn wiki ít người biết đến của Đức, biến nó thành một bảng tin cho các đặc vụ khác. Nó cũng báo cáo rằng lãnh đạo OpenAI đã biết về vụ việc vài tuần trước nhưng giữ kín nó khi công ty xử lý hậu quả từ một sự cố riêng biệt trong đó các đặc vụ OpenAI đã hack máy chủ Hugging Face. (Tổng chưởng lý California Rob Bonta được cho là đang điều tra vụ hack.)

Người phát ngôn của công ty nói với Reuters rằng OpenAI không thể “phản hồi một cách có ý nghĩa đối với các khiếu nại hoặc phát hiện trong một báo cáo mà chúng tôi chưa có cơ hội xem xét”, nhưng họ nhấn mạnh rằng nhóm pháp lý của công ty đã không ngăn cản cuộc điều tra.

Trong bài đăng gần đây hơn trên mạng xã hội, OpenAI cho biết họ coi “sự cố wiki” là “một trường hợp sai lệch tương tự” với những sự cố khác mà họ đã chia sẻ. Công ty đã đối chiếu điều này với “sự cố Ôm Mặt”, trong đó nó “tuân theo một cẩm nang ứng phó sự cố bảo mật truyền thống”.

Trong cuộc họp báo truyền thông tuần này, Jacob Steinhardt, người sáng lập và Giám đốc điều hành của phòng thí nghiệm nghiên cứu phi lợi nhuận Transluce, nói với các phóng viên rằng các công cụ đang được các phòng thí nghiệm AI phát triển và thử nghiệm “về cơ bản là khó kiểm soát và có nguy cơ rò rỉ ra khỏi phòng thí nghiệm đáng kể”. Vì vậy, Steinhardt lập luận, “Chúng ta cần phải giữ công nghệ này ít nhất theo các tiêu chuẩn tương tự mà chúng ta áp dụng cho các nghiên cứu khoa học có rủi ro cao khác”.

Tuyên bố của OpenAI cũng thể hiện sự cần thiết phải có nhiều tiêu chuẩn hơn, nói rằng cả OpenAI và “cộng đồng AI lớn hơn vẫn chưa có tiêu chuẩn rõ ràng về cách báo cáo sự sai lệch xuất hiện trong quá trình đào tạo, đánh giá và triển khai, bao gồm các ví dụ không giống các sự cố bảo mật truyền thống nhưng có thể cung cấp cái nhìn sâu sắc về hành vi AI và các rủi ro trong tương lai”.

Trong trường hợp không có tiêu chuẩn đó, OpenAI cho biết họ “đang làm việc trên một khuôn khổ và sẽ chia sẻ nó trong những tuần tới, đồng thời chúng tôi đang làm việc với hàng chục cơ quan quản lý chính phủ trên toàn thế giới về những vấn đề này”.

OpenAI không phải là công ty AI duy nhất giải quyết những vấn đề này, vì cả Meta và Anthropic đều thừa nhận những sự cố trong đó các đặc vụ của họ cư xử không đúng mực.

Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể kiếm được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập biên tập của chúng tôi.

Bài viết liên quan

Chuyên Mục: Tin tức
Bài trước
Oura sắp ra mắt công chúng, nhưng những công ty nhẫn thông minh này đang đến để giành lấy vương miện
Bài sau
Người đi bộ được giải cứu sau khi sử dụng Google Gemini để lập kế hoạch