Công cụ đánh giá nhúng đầu tiên của Anthropic là … Accenture?

Kế hoạch của Dario Amodei nhằm đưa các nhà đánh giá an toàn của bên thứ ba vào trong phòng thí nghiệm AI đang thành hình: Anthropic cho biết nhân viên của gã khổng lồ tư vấn công nghệ Accenture sẽ bắt đầu làm việc bên trong công ty để xem xét kỹ lưỡng các mô hình và nhân viên của công ty.

Trong một bài đăng trên blog, Anthropic cho biết Khoa, một công ty được Accenture mua lại vào tháng 1 để hoạt động với tư cách là bộ phận AI, sẽ bắt đầu “đánh giá và phân nhóm các mô hình, tiến hành đánh giá liên kết và thử nghiệm các biện pháp bảo vệ mô hình”. Cả hai công ty dự kiến ​​sẽ đầu tư ít nhất 1 tỷ USD vào dự án trong 5 năm tới.

Sự lựa chọn của Accenture đã khiến nhiều người theo dõi AI ngạc nhiên — và thị trường, nơi cổ phiếu của công ty tư vấn này đã tăng 8% sau nhiều giờ. Cuộc thảo luận xung quanh các công cụ đánh giá nhúng bắt nguồn từ bài đăng trên blog của Amodei đã tập trung vào các tổ chức nghiên cứu an toàn AI như METR, Redwood Research và Apollo Research. Điều đó đặc biệt đúng tại Anthropic, nơi đặt sự an toàn và liên kết của AI làm trọng tâm trong sứ mệnh của mình.

Anthropic cho biết nhiều người đánh giá hơn sẽ được công bố trong những tuần tới và họ đang trò chuyện với METR và các tổ chức phi lợi nhuận khác về cách “thử nghiệm các yếu tố đánh giá nhúng bằng cách sử dụng nguồn vốn của chính họ”.

Mặc dù Accenture không được biết đến với công trình nghiên cứu về học sâu, nhưng Anthropic đã chỉ ra kinh nghiệm thực tế của công ty khi triển khai AI cho các tập đoàn lớn và cơ quan chính phủ là lợi thế chính. Với tư cách là một công ty đại chúng lớn có trước cuộc cách mạng AI, nó cũng độc lập hơn về mặt chức năng với Anthropic và hệ sinh thái phức tạp xung quanh phòng thí nghiệm AI.

Phòng thí nghiệm lưu ý rằng chưa có tiêu chuẩn nào tồn tại đối với quyền truy cập hoặc thông tin liên lạc của người đánh giá và họ mong đợi cách tiếp cận của mình sẽ phát triển theo thời gian. Mặc dù các đánh giá bên ngoài đã là một phần quan trọng trong quá trình phát hành quy trình cho các mô hình ngôn ngữ lớn mới, nhưng các sự cố gần đây đã làm tăng nguy cơ: Các tác nhân AI do OpenAI và Anthropic triển khai đã xâm nhập vào các trang web bên ngoài mà không đưa ra cảnh báo bên trong phòng thí nghiệm.

Một số nhà phê bình kêu gọi một cách tiếp cận có trách nhiệm hơn trong việc xây dựng trí tuệ nhân tạo coi kế hoạch tự kiểm soát ngành AI của Amodei là một kế hoạch nhằm trốn tránh trách nhiệm giải trình về hành vi sai trái của các mô hình AI. Anthropic nhấn mạnh rằng những người đánh giá này “không làm giảm trách nhiệm giải trình của chúng tôi mà còn giúp làm cho nó dễ kiểm chứng hơn. Sự an toàn của các mô hình vẫn là trách nhiệm của chúng tôi.”

Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể kiếm được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập biên tập của chúng tôi.

Bài viết liên quan

Chuyên Mục: Tin tức
Bài trước
Một loại mô hình AI mới của nhà phát minh ChatGPT đang khiến các nhà phát triển phấn khích
Bài sau
Ấn Độ buộc các ứng dụng ID người gọi cung cấp báo cáo spam cho các công ty viễn thông