Trong vụ vi phạm Ôm Mặt, hacker của OpenAI ồn ào và nhanh nhẹn – nhưng không thể ngăn cản được

Đầu tháng này, nền tảng dữ liệu AI Hugging Face đã gây chấn động thế giới khi tiết lộ rằng họ đã trở thành nạn nhân của một cuộc tấn công mạng hoàn toàn tự động do AI cung cấp. Vài ngày sau, câu chuyện lại có một bước ngoặt kịch tính khác khi OpenAI thừa nhận rằng hacker đứng sau vụ vi phạm là một trong những mô hình AI của họ, đã thoát ra khỏi môi trường thử nghiệm và xâm nhập vào các hệ thống Hugging Face được bảo vệ nhằm nỗ lực phá vỡ điểm chuẩn.

Đây là một sự cố đáng báo động đối với bất kỳ ai thậm chí hơi lo ngại về các mô hình AI giả mạo – và những ngày kể từ sự kiện này đã có rất nhiều dự đoán về mô hình an ninh mạng mới, trong đó các mô hình AI phát động các cuộc tấn công mạnh đến mức chỉ các mô hình AI khác mới có thể chống lại chúng.

Nhưng bất chấp cảnh báo chính đáng, mô hình có thể đã không thay đổi nhiều như người ta tưởng. Các chuyên gia nói chuyện với TechCrunch nhấn mạnh rằng đặc vụ của OpenAI phần lớn hoạt động giống như con người – với một số lưu ý – và các kỹ thuật phòng thủ truyền thống được triển khai tốt hơn có thể giúp ngăn chặn cuộc tấn công. Nói tóm lại, chúng ta có thể đã có sẵn các công cụ để chống lại kiểu tấn công này; chúng ta chỉ không sử dụng chúng đúng cách.

Hugging Face đã đưa ra quan điểm này trong báo cáo sự cố của mình, nói rằng những điểm yếu bị khai thác trong cuộc tấn công “rất quen thuộc” và “kẻ tấn công con người có năng lực có thể tìm thấy và khai thác những sai sót tương tự”.

Kyle Ryan, Giám đốc R&D tại Pensar, một công ty khởi nghiệp phát triển các tác nhân AI hack liên tục, và Vlad Ionescu, người đồng sáng lập và CTO của RunSybil, một công ty khởi nghiệp xây dựng các công cụ săn lỗi được hỗ trợ bởi AI, đều đồng ý và nói với TechCrunch rằng các kỹ thuật được sử dụng trong cuộc tấn công sẽ giống như những kỹ thuật được sử dụng bởi con người hoặc một nhóm người trong đội đỏ. Nghĩa là, tin tặc có nhiệm vụ tấn công một hệ thống để giúp công ty sở hữu nó cải thiện khả năng phòng thủ.

Điều rất không giống con người là tốc độ, quy mô và sự không ngừng nghỉ của cuộc tấn công. Như Hugging Face đã giải thích, đặc vụ của OpenAI đã thực hiện 17.600 hành động trong 4 ngày rưỡi: đột nhập, do thám, đánh cắp mật khẩu và mã cũng như di chuyển xung quanh cơ sở hạ tầng của công ty.

Ryan nói: “Điều ấn tượng là sự tự chủ và sức chịu đựng. “Loại hoạt động thích ứng và bền vững đó là điều nổi bật nhất đối với tôi.”

Liên hệ với chúng tôi

Bạn có thêm thông tin gì về vụ hack của OpenAI chống lại Ôm mặt không? Hoặc các cuộc tấn công mạng do AI hỗ trợ khác? Chúng tôi rất muốn nghe ý kiến ​​từ bạn. Từ thiết bị và mạng không hoạt động, bạn có thể liên hệ với Lorenzo Franceschi-Bicchierai một cách an toàn trên Signal theo số +1 917 257 1382 hoặc qua Telegram và Keybase @lorenzofb hoặc email.

Mặt khác, với số lượng hành động khổng lồ trong vài ngày, đại diện của OpenAI đã “cực kỳ ồn ào”, như Ryan đã nói. Không giống như con người, lẽ ra có thể lén lút hơn, đặc vụ đã tạo ra rất nhiều tiếng ồn, điều này đáng lẽ phải tăng cường khả năng phòng thủ của Ôm Mặt sớm hơn, lý tưởng nhất là dẫn đến việc con người can thiệp và ngăn chặn cuộc tấn công.

Ryan giải thích: “Tôi gọi đó là một thất bại trong phòng thủ hơn là tấn công đặc biệt xuất sắc. Công cụ của Hugging Face thực sự liên hệ hoạt động với tín hiệu tấn công, nhưng không thể nâng cao mức độ quan trọng và liên lạc với nhóm đang theo yêu cầu, khiến họ mất thời gian”. “Từ đó, con người vẫn phải nhận thức được mức độ nghiêm trọng và ứng phó”.

Jamieson O’Reilly, người sáng lập công ty an ninh mạng Dvuln, đã đưa ra kết luận tương tự trong một bài đăng trên X phân tích báo cáo của Hugging Face.

“Đó chính xác là khoảng cách giữa việc nhìn thấy và dừng lại,” O’Reilly viết. “Hệ thống đã quan sát cuộc tấn công và thậm chí hiểu được nó, nhưng không có gì biến sự hiểu biết đó thành hành động can thiệp đủ nhanh.”

Ryan giải thích rằng các kỹ thuật được triển khai đúng cách như phòng thủ theo chiều sâu – một chiến lược thúc đẩy nhiều lớp biện pháp an ninh mạng – lẽ ra phải mang lại cho Ôm Mặt nhiều cơ hội để bắt được cuộc tấn công.

Ryan giải thích: “Một chương trình bảo mật hiện đại mạnh mẽ vẫn có thể phá vỡ một cuộc tấn công như thế này ở nhiều điểm thông qua phòng thủ theo chiều sâu, ít đặc quyền nhất, phân đoạn, phát hiện tốt, leo thang đáng tin cậy và thử nghiệm tấn công liên tục để tìm ra lỗ hổng”.

Như O’Reilly đã nói, “không có điều nào trong số đó là kỳ lạ và không điều nào phụ thuộc vào việc kẻ tấn công là AI”, vì các kỹ thuật được sử dụng trong cuộc tấn công đã “cũ”.

Theo một cách nào đó, điều phụ thuộc vào kẻ tấn công là AI là đặc vụ của OpenAI đã không được hướng dẫn phải lén lút. Nico Waisman, giám đốc an ninh thông tin tại XBOW, một công ty khởi nghiệp chuyên phát triển thợ săn lỗi AI, cho biết: “Đặc vụ không cẩu thả. Đơn giản là họ không có lý do gì để im lặng. Không ai yêu cầu họ phải im lặng. Mục tiêu là hoàn thành tốt nhiệm vụ”.

Waisman cũng chỉ ra rằng sai lầm lớn nhất của Hugging Face là một thông tin xác thực bị đánh cắp duy nhất đã mang lại cho đại lý của OpenAI những đặc quyền cao trên một số hệ thống của nó.

Tất cả những gì đang được nói, như câu ngạn ngữ cũ, những kẻ tấn công chỉ phải giành chiến thắng một lần và việc bảo vệ chống lại bất kỳ loại tin tặc nào là không dễ dàng.

Vincent Yiu, giám đốc điều hành tại SYON Security cho biết: “Hugging Face có thể thực hiện nhiều phát hiện hơn nhưng công bằng mà nói thì không phải tất cả (tổ chức) đều làm tốt như vậy. “Không dễ để lưu trữ cơ sở hạ tầng và tồn tại với tư cách là một doanh nghiệp vào năm 2026. Tin tặc ở khắp mọi nơi.”

Theo Vlad từ RunSybil, người cho biết trước đây họ đã thực hiện ứng phó sự cố tại Mandiant và Meta, Ôm Mặt dường như đã thực hiện “các biện pháp hợp lý dựa trên sự hiểu biết của họ về khả năng của các mô hình”.

Vlad nói: “Thật sự rất khó để phân loại đâu là hành động độc hại mà bạn nên cảnh báo và đâu là hành động mà ai đó chỉ đang thực hiện công việc của họ. “Khối lượng riêng không nhất thiết phải là cờ đỏ.”

Dan Guido, Giám đốc điều hành của công ty nghiên cứu an ninh mạng Trail of Bits, nói với TechCrunch rằng OpenAI đáng bị đổ lỗi vì đã không nhận ra cuộc tấn công đang diễn ra trong nhiều ngày, trong khi HuggingFace xứng đáng được ghi nhận vì cuối cùng đã tự mình phát hiện ra cuộc tấn công.

Guido cho biết: “Phần khó trước đây là nhận ra một cuộc tấn công phức tạp, nhưng bây giờ phần khó có thể là loại bỏ cuộc tấn công thực sự khỏi tiếng ồn mà kẻ tấn công gây ra trên đường đi”. “Không ai có thể đọc thủ công 17.000 hành động được tái tạo lại để tìm ra điều gì đã xảy ra, vì vậy Ôm Mặt đã phải xây dựng công cụ chỉ để tái tạo lại dòng thời gian.”

Và để làm được điều đó, công ty cần có AI của riêng mình. Hugging Face cho biết họ đã phải sử dụng mô hình nguồn mở GLM 5.2 từ công ty Z.AI của Trung Quốc sau khi bị chặn sử dụng các mô hình biên giới vì các biện pháp bảo vệ của chúng, mà như công ty đã nói, “không thể phân biệt người ứng phó sự cố với kẻ tấn công”.

Vào thời điểm đó, Hugging Face đã kết hợp AI và con người để điều tra hacker sử dụng LLM của OpenAI. Đó là một tình huống tương đối mới lạ. Nhưng ngoài ra, vụ việc cho thấy các khái niệm và phương pháp phòng thủ an ninh mạng lỗi thời vẫn có thể bảo vệ và chống lại tin tặc AI trong một chặng đường dài.

Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể kiếm được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập biên tập của chúng tôi.

Bài viết liên quan

Chuyên Mục: Tin tức
Bài trước
Zuckerberg cho biết cơ hội AI dành cho doanh nghiệp của Meta vượt ra ngoài các đại lý