Mô hình AI mới nhất của OpenAI, được gọi là o1-preview, có khả năng tự tìm kiếm và khai thác các lỗ hổng bảo mật trong phần mềm mà không cần sự can thiệp của con người. Đây là kết quả từ các thử nghiệm do Viện An toàn AI của Vương quốc Anh (AISI) thực hiện.
Trong các bài kiểm tra, o1-preview đã thể hiện khả năng thực hiện các nhiệm vụ tấn công mạng phức tạp, bao gồm giải quyết các thử thách “Capture the Flag” (chiếm cờ), tìm lỗi trong mã nguồn và viết các đoạn mã khai thác. AISI đánh giá khả năng này của o1-preview vượt trội đáng kể so với các mô hình trước đó như GPT-4o. Cụ thể, trong các bài kiểm tra về an ninh mạng, o1-preview đạt điểm số cao hơn và có khả năng tư duy logic tốt hơn để vượt qua các rào cản bảo mật.
OpenAI cũng thừa nhận trong báo cáo an toàn rằng dòng mô hình o1 có khả năng hỗ trợ thực hiện các cuộc tấn công mạng ở mức độ “nguy cơ trung bình”. Mô hình có thể giúp những kẻ tấn công ít kỹ năng thực hiện các chiến dịch phức tạp hơn bằng cách tự động hóa các bước tìm kiếm lỗ hổng.
Tuy nhiên, mô hình vẫn còn những hạn chế nhất định. Nó vẫn gặp khó khăn trước các hệ thống phòng thủ hiện đại và đôi khi đưa ra các giải pháp không chính xác hoặc không hiệu quả. OpenAI nhấn mạnh rằng công nghệ này là một “con dao hai lưỡi”. Bên cạnh nguy cơ bị lạm dụng, AI cũng có thể được sử dụng như một công cụ phòng thủ mạnh mẽ, giúp các chuyên gia bảo mật tìm và vá lỗi nhanh hơn, từ đó tăng cường độ an toàn cho các hệ thống phần mềm.
Để giảm thiểu rủi ro, OpenAI cho biết đã triển khai các biện pháp kiểm soát và ngăn chặn mô hình thực hiện các yêu cầu liên quan đến việc tạo mã độc hoặc thực hiện hành vi tấn công mạng trực tiếp. Các chuyên gia an ninh mạng khuyến cáo cần có sự giám sát chặt chẽ và các quy định an toàn khi triển khai các mô hình AI có khả năng lập luận cao như thế này.


