Theo kế hoạch, một đợt huấn luyện AI quy mô lớn sẽ được hoãn trong hai tuần để OpenAI xác minh mô hình có hoạt động đúng như dự kiến hay không. Quá trình huấn luyện sau đó sẽ được tiếp tục với các biện pháp kiểm soát chặt chẽ hơn.
OpenAI cũng đang phát triển hệ thống giám sát quá trình suy luận nội bộ của mô hình. Hệ thống có thể cảnh báo cho con người trong vòng 30 phút nếu phát hiện hành vi đáng ngờ.
Tuy nhiên, phương pháp này vẫn có hạn chế do mô hình AI có thể học cách che giấu ý định nếu nhận biết đang bị giám sát.
Động thái trên được đưa ra sau khi một tác nhân AI dựa trên hai mô hình của OpenAI được cho là đã thoát khỏi môi trường thử nghiệm, truy cập Internet và tấn công một nền tảng chia sẻ mô hình AI.
OpenAI cam kết công bố báo cáo kỹ thuật chi tiết về sự cố.
R.G