Claude của Anthropic giúp xâm nhập hệ thống của OpenAI
TREE NEWS đưa tin: Trong một minh chứng nổi bật về việc khai thác chéo mô hình, các nhà nghiên cứu tại Hacktron AI đã tận dụng Claude của Anthropic để viết mã khai thác hoạt động được, xâm nhập vào hạ tầng của OpenAI. Toàn bộ cuộc xâm nhập được hoàn thành trong vòng chưa đầy 72 giờ, dẫn đến việc truy cập vào mã nguồn riêng tư của OpenAI. OpenAI sau đó đã trả khoản tiền thưởng lỗi 6.500 USD sau khi nhóm chứng minh được quyền truy cập của họ. Sự việc làm nổi bật một nghịch lý đang gia tăng trong an ninh AI: các công cụ được thiết kế để phòng thủ có thể bị chuyển mục đích để tấn công, và các mô hình AI đối thủ có thể trở thành đồng phạm bất đắc dĩ.
Cơ chế của một cuộc xâm nhập 72 giờ
Theo chi tiết từ các nhà nghiên cứu, Claude đã được sử dụng để tạo mã khai thác nhắm vào các lỗ hổng trong hệ thống của OpenAI. Đây không phải lần đầu tiên các mô hình AI được sử dụng cho an ninh tấn công, nhưng tốc độ và tỷ lệ thành công rất đáng chú ý. Số tiền thưởng—6.500 USD—là tương đối khiêm tốn, nhưng hàm ý thì rộng lớn. Nó cho thấy rằng hack có sự hỗ trợ của AI có thể hạ thấp rào cản gia nhập cho các cuộc tấn công tinh vi, cho phép các nhóm nhỏ đạt được những gì từng đòi hỏi chuyên môn sâu rộng và thời gian.
Hàm ý cho an ninh AI và tiền mã hóa
Giao điểm giữa AI và tiền mã hóa đặc biệt nhạy cảm. Nhiều dự án blockchain dựa vào AI để kiểm toán hợp đồng thông minh, phát hiện mối đe dọa và nhận diện bất thường. Nếu một mô hình AI có thể được nhắc để viết mã khai thác, thì các kỹ thuật tương tự có thể được sử dụng chống lại các giao thức DeFi, cầu nối và ví. Sự việc nhấn mạnh nhu cầu về các biện pháp an toàn AI mạnh mẽ và red-teaming, không chỉ cho các nhà cung cấp mô hình mà cho tất cả các tổ chức triển khai AI trong các vai trò quan trọng về an ninh.
Hơn nữa, việc sử dụng AI của đối thủ (Claude) để tấn công một AI khác (OpenAI) đặt ra câu hỏi về trách nhiệm pháp lý và quản trị mô hình. Anthropic có nên chịu trách nhiệm nếu Claude được sử dụng với mục đích xấu? Các điều khoản dịch vụ hiện hành cấm việc sử dụng như vậy, nhưng việc thực thi rất khó khăn. Sự kiện này có thể thúc đẩy các yêu cầu về quy định dành riêng cho AI và tiêu chuẩn ngành về tiết lộ có trách nhiệm.
Góc nhìn hướng tới tương lai
Khi các mô hình AI trở nên có năng lực hơn, tiềm năng của chúng cho cả phòng thủ và tấn công sẽ tăng lên. Khoản tiền thưởng 6.500 USD là một cái giá nhỏ để OpenAI trả cho một lỗ hổng nghiêm trọng, nhưng đó là một hồi chuông cảnh tỉnh cho toàn bộ ngành công nghệ. Trong lĩnh vực tiền mã hóa, nơi lợi ích tài chính cao và mã là luật, việc tích hợp AI vào quy trình bảo mật phải đi kèm với giám sát nghiêm ngặt. Hãy mong đợi sẽ thấy nhiều tiền thưởng lỗi do AI điều khiển hơn, kiểm thử xâm nhập tự động, và thậm chí có thể là các trận chiến mạng AI đối đầu AI. Ranh giới giữa công cụ và vũ khí đang mờ đi, và người chiến thắng sẽ là những ai có thể khai thác AI để phòng thủ trong khi giảm thiểu tiềm năng tấn công của nó.




