OpenAI đang phát triển ‘nút tắt tự động’ cho AI

OpenAI đang phát triển một cơ chế an toàn mới mang tên “Khung chuẩn bị” (Preparedness Framework) nhằm theo dõi, đánh giá và ngăn chặn các rủi ro thảm khốc từ các mô hình trí tuệ nhân tạo tiên tiến. Công ty sẽ liên tục thử nghiệm các mô hình AI mạnh nhất và xếp hạng rủi ro của chúng theo bốn cấp độ: thấp, trung bình, cao và nguy cấp.

Các danh mục rủi ro chính được tập trung giám sát bao gồm: an ninh mạng, các mối đe dọa về hóa học, sinh học, phóng xạ và hạt nhân (CBRN), khả năng thuyết phục gây hại và hành vi tự trị của mô hình. OpenAI cam kết chỉ triển khai các mô hình có mức rủi ro “trung bình” hoặc “thấp”. Nếu một mô hình bị đánh giá ở mức rủi ro “nguy cấp” ngay cả sau khi áp dụng các biện pháp giảm thiểu, quá trình phát triển hoặc triển khai sẽ bị dừng lại.

Quyền quyết định cuối cùng về việc dừng hoặc tiếp tục phát hành một mô hình AI thuộc về Hội đồng quản trị OpenAI. Ngay cả khi đội ngũ kỹ thuật đánh giá mô hình là an toàn, Hội đồng quản trị vẫn có quyền can thiệp và ngăn chặn việc ra mắt nếu nhận thấy các nguy cơ tiềm tàng. Cơ chế này đóng vai trò như một “nút tắt” để kiểm soát AI siêu thông minh, đảm bảo chúng không vượt quá tầm kiểm soát của con người. Đội ngũ “Preparedness” chuyên trách sẽ chịu trách nhiệm thực hiện các bài kiểm tra an toàn định kỳ và báo cáo trực tiếp cho lãnh đạo công ty và Hội đồng quản trị.

Để lại một bình luận

Email của bạn sẽ không được hiển thị công khai. Các trường bắt buộc được đánh dấu *