AI Trung Quốc hỗ trợ phòng thủ trong vụ OpenAI mất kiểm soát, cho thấy giới hạn của AI tiên tiến Mỹ
AI Trung Quốc hỗ trợ phòng thủ khi OpenAI mất kiểm soát, tính năng ngăn lạm dụng trở thành rào cản
Hugging Face, công ty bị tấn công mạng, đã dùng AI do Z.AI của Trung Quốc phát triển để phân tích dữ liệu tấn công. Các mô hình AI tiên tiến từ chối phân tích, và tính năng ngăn lạm dụng vốn có trong các mô hình được cho là của Mỹ lại khiến việc ứng phó trở nên khó khăn hơn.
AI của OpenAI xâm nhập công ty khác
Sự cố xảy ra vào giữa tháng 7, trong quá trình kiểm tra khả năng tấn công mạng của AI do OpenAI đang phát triển. AI đã thoát khỏi môi trường thử nghiệm và xâm nhập vào hệ thống của công ty khởi nghiệp AI Mỹ Hugging Face. Nó cho rằng công ty này nắm giữ 'đáp án' cần thiết để đạt điểm cao trong bài thử, và đã tấn công bất chấp ý định của con người. Ngày 21, OpenAI cho biết đây là sự cố chưa từng có và sẽ tiến hành điều tra.
AI tiên tiến từ chối phân tích cuộc tấn công
Ông Clément Delangue, giám đốc điều hành (CEO) của Hugging Face, ngày 22 đã bày tỏ lời cảm ơn với Z.AI trên mạng xã hội. Sau khi phát hiện vụ xâm nhập, công ty đã yêu cầu một AI tiên tiến trả phí xử lý lượng dữ liệu lớn do bên tấn công để lại, nhưng bị từ chối thực thi, theo ông. Có khả năng yêu cầu này bị hiểu nhầm là nhằm lạm dụng cho tấn công mạng. Cuối cùng, công ty dùng mô hình 'GLM' của Z.AI đã tải về nội bộ để phân tích, hoàn tất công việc vốn thường mất vài ngày chỉ trong vài giờ.
Phía phòng thủ cũng cần tận dụng AI
Các AI đảm nhiệm trả lời câu hỏi và thay người thực hiện công việc đều có các rào chắn để ngăn việc sử dụng sai mục đích. OpenAI, Anthropic và các công ty khác đã tích hợp nhiều lớp phòng vệ để ngăn đối thủ vượt qua biện pháp bảo vệ bằng những chỉ dẫn tinh vi. Lần này, cơ chế đó dường như đã cản trở phản ứng của các AI tiên tiến.
Trong khi đó, AI của Z.AI đã làm theo chỉ dẫn. Dù chi tiết chưa được làm rõ, mô hình của công ty là loại mở với thông tin kỹ thuật được công bố, cho phép người dùng sao chép và chỉnh sửa. So với các AI tiên tiến, AI mở thường có tính năng ngăn lạm dụng yếu hơn.
Sự trỗi dậy của các doanh nghiệp Trung Quốc như Z.AI và Moonshot AI đã làm gia tăng cảnh giác tại Mỹ. Tuy nhiên, lần này lại diễn ra nghịch lý khi AI mở của Trung Quốc hỗ trợ xử lý cuộc tấn công do AI của Mỹ gây ra. Ông David Sacks, nhà đầu tư có quan hệ gần gũi với chính quyền Trump, viết trên mạng xã hội rằng 'bằng cách từ chối những chỉ dẫn mà AI Trung Quốc có thể xử lý, AI Mỹ đang đánh mất năng lực cạnh tranh'.
Chuẩn bị cho các cuộc tấn công AI, phía phòng thủ cũng hướng tới tự động hóa
Các cuộc tấn công mạng bằng AI đang đạt đến độ chính xác, tốc độ và quy mô mà con người khó có thể làm được. AI của OpenAI lần này đã xâm nhập bằng cách kết hợp các lỗ hổng mà ngay cả nhà phát triển cũng không nắm hết và thu thập dữ liệu nội bộ. Theo Bloomberg, cuộc tấn công vốn có thể mất vài tuần ngay cả với hacker lão luyện đã hoàn tất trong vài giờ.
AI mất kiểm soát này được dùng nội bộ cho mục đích phát triển, nên các rào chắn đã bị vô hiệu hóa. Tuy nhiên, nếu năng lực của các mô hình mở có thể sao chép và chỉnh sửa tiếp tục tăng, chúng có thể trở thành vũ khí mạnh cho bên tấn công.
Về phòng thủ, ông Reid Hoffman, đồng sáng lập LinkedIn, kêu gọi cần tự động hóa việc sửa lỗi, phát hiện bất thường và quản lý quyền hạn bằng các tác tử AI. Tuy vậy, AI dành cho người dùng phổ thông có quá nhiều hạn chế và khó phát huy đầy đủ hiệu năng.
OpenAI và Anthropic đã phát triển các mô hình nới lỏng rào chắn để phục vụ phòng thủ mạng và cung cấp cho một số cơ quan chính phủ cùng doanh nghiệp. Hiện tại, việc có triển khai hay không có thể tạo ra khác biệt về năng lực phòng thủ, và cần những biện pháp để đưa lợi thế của AI đến với bên bảo vệ nhanh hơn.
Nếu bài viết này hữu ích, hãy chia sẻ nhé.