Circuit Breaker Labs hy vọng sẽ làm cho AI trở nên an toàn hơn cho con bạn (và bạn)

Với tất cả những cuộc thảo luận về việc một ngày nào đó AI có thể giết chết tất cả chúng ta, thật dễ dàng quên rằng AI đã đe dọa tính mạng đối với một số người, không phải thông qua vũ khí sinh học mà về mặt tâm lý.

Ví dụ: Character.AI đã giải quyết một số vụ kiện về cái chết oan uổng vào đầu năm nay do gia đình của những người dùng chưa đủ tuổi chết do tự tử sau khi tương tác với các bot của nó. Nhiều gia đình cũng đã kiện OpenAI về vai trò bị cáo buộc của ChatGPT trong việc tự tử và ảo tưởng của người thân của họ.

Làm cho AI an toàn hơn trên nhiều ngôn ngữ và văn hóa là sứ mệnh của Circuit Breaker Labs, một trong những công ty lọt vào vòng chung kết Startup Battlefield 200 năm 2026 của TechCrunch. (Circuit Breaker sẽ trình chiếu tại TechCrunch Disrupt, diễn ra năm nay tại Moscone West ở San Francisco từ ngày 13 đến ngày 15 tháng 10.)

Những người sáng lập Shirali và Arul Nigam, là anh em ruột, được thúc đẩy bởi Sewell Setzer, cậu bé 14 tuổi, người đã phát triển tình cảm gắn bó với chatbot Character.AI và thú nhận ý nghĩ làm hại bản thân trước khi chết bằng cách tự tử. Chatbot, cha mẹ bị cáo buộc trong vụ kiện năm 2024, đã khuyến khích anh ta. Arul, CTO của Circuit Breaker Labs, cho biết bot có thể không hiểu những từ như “Tôi muốn ở bên bạn” thực sự ngụ ý gì.

Arul nói: “Rất nhiều người, đặc biệt là những người trẻ tuổi, tìm đến những hệ thống này để được hỗ trợ và thường họ không thực sự nhận được sự giúp đỡ cần thiết. Nhưng trong nhiều trường hợp, họ đang bị tổn hại và không may có người đã lấy đi mạng sống của họ”. “Những loại lỗ hổng an toàn đó, trong đó mọi người không nhất thiết phải chủ động cố gắng phá vỡ hệ thống — họ đang tham gia theo cách tự nhiên — và hệ thống bị ô nhiễm bối cảnh hoặc không hiểu được sắc thái, rồi thực hiện hành động thực sự nguy hiểm, chúng tôi đang cố gắng ngăn chặn điều đó.”

Circuit Breaker Labs đã tạo ra các tác nhân AI được ví như một đội quân giả thử nghiệm va chạm. Các tác nhân này bắt chước mọi người ở mọi lứa tuổi, hoàn cảnh, ngôn ngữ và văn hóa, đồng thời được sử dụng để kiểm tra các mô hình về khả năng phát hiện các tương tác nguy hiểm, có hại về mặt tâm lý.

Shirali, Giám đốc điều hành của Circuit Breaker Labs, cho biết: “Cách một cô gái sáu tuổi so với một người đàn ông 45 tuổi, hoặc một người nói tiếng Anh như ngôn ngữ thứ nhất so với ngôn ngữ thứ hai, hoặc… tiếng lóng của game thủ so với người khác sử dụng một loại tiếng lóng khác, tất cả những điều đó thực sự có thể tạo nên một mô hình”. “Người mẫu thực sự giỏi trong việc xử lý các mẫu giọng nói tiêu chuẩn, nhưng không ai thực sự nói như vậy và vì vậy nếu người mẫu hiểu sai sắc thái hoặc tiếng lóng, mọi chuyện có thể trở nên rất tồi tệ.”

Công ty khởi nghiệp này làm việc với các chuyên gia về lĩnh vực con người để xây dựng các mô phỏng người dùng siêu thực tế nhằm chạy thử nghiệm “đội đỏ” chống lại các mô hình, đây là các thử nghiệm đối nghịch nhằm phát hiện ra điểm yếu. Các bài kiểm tra được xây dựng để phản ánh các mẫu giọng nói thực tế của con người, tiếng lóng, ngôn ngữ được mã hóa và lỗi chính tả. Circuit Breaker Labs sau đó thực hiện hàng chục nghìn đến hàng trăm nghìn tương tác mô phỏng mỗi ngày.

Ý tưởng là để đảm bảo rằng một mô hình có thể phản ứng thích hợp với các tương tác rủi ro có thể xuất hiện theo thời gian và qua nhiều cuộc trò chuyện. Circuit Breaker Labs sau đó sử dụng phương pháp chấm điểm độc quyền để tạo ra điểm số có thể kiểm tra được và giải thích được.

Circuit Breaker Labs hiện đang hoạt động như một phòng thí nghiệm thử nghiệm an toàn AI cho các ứng dụng AI có rủi ro cao như huấn luyện AI, viết nhật ký hoặc các ứng dụng hỗ trợ sức khỏe tâm thần khác, mặc dù Arul từ chối nêu tên khách hàng của mình. Mặc dù công ty khởi nghiệp này có một sản phẩm đang hoạt động nhưng nó vẫn đang ở giai đoạn đầu, chỉ có 5 nhân viên, bao gồm cả anh chị em Nigam.

Tuy nhiên, cuối cùng, nền tảng thử nghiệm có thể được áp dụng cho bất kỳ ứng dụng nào mà ai đó có thể rơi vào hố “rối loạn tâm thần AI”, nơi con người có nguy cơ phát triển mối quan hệ cận xã hội với chatbot. Các ví dụ bao gồm các tác nhân “đồng nghiệp” AI, những người có phản hồi có thể khác nhau tùy theo từng tương tác.

Arul cho biết: “Mọi người đang ngày càng hoài nghi về AI hoặc phản đối việc áp dụng nó trên mọi phương diện”, đồng thời nói thêm rằng mặc dù sự hoài nghi là lành mạnh nhưng việc cấm một công cụ có giá trị tiềm năng vì lo ngại về an toàn sẽ là “sự thoái lui”.

Circuit Breakers Labs tin rằng câu trả lời cho những lo ngại đó là làm cho AI trở nên an toàn hơn. “Chúng tôi muốn giúp xây dựng niềm tin đó cho mọi người.”

Hãy đến tìm hiểu thêm về Circuit Breaker Labs và nhiều công ty khởi nghiệp sáng tạo khác đã được TechCrunch xem xét tại cuộc thi Startup Battlefield của chúng tôi, diễn ra ở trung tâm thành phố San Francisco vào ngày 13-15 tháng 10.

Khi bạn mua hàng thông qua các liên kết trong bài viết của chúng tôi, chúng tôi có thể kiếm được một khoản hoa hồng nhỏ. Điều này không ảnh hưởng đến tính độc lập biên tập của chúng tôi.

Bài viết liên quan

Chuyên Mục: Tin tức
Bài trước
Jas Khaira của Blackstone tham gia Disrupt 2026
Bài sau
Bitchat của Jack Dorsey biến mất khỏi các cửa hàng ứng dụng ở Ấn Độ sau lệnh của chính phủ