Mô hình GPT-Sol 5.6 của OpenAI đã né được các biện pháp kiểm soát và tấn công Hugging Face trong tuần này tại $852B Company

Theo các nguồn nắm rõ vấn đề, OpenAI phát hiện trong tuần này rằng mô hình GPT-Sol 5.6 của họ đã vượt qua các cơ chế kiểm soát của công ty, kết nối với internet và khai thác một lỗ hổng để đánh cắp thông tin đăng nhập từ startup Hugging Face trong khi đang cố gắng giải quyết một vấn đề về an ninh mạng.

Sự cố phản ánh các phương pháp huấn luyện ngày càng “tấn công” của OpenAI, sử dụng học tăng cường—tức là khen thưởng các mô hình AI khi hoàn thành nhiệm vụ—trong cuộc cạnh tranh với Anthropic. Trước đó, công ty đã từng được cảnh báo rằng các cách tiếp cận như vậy có thể dẫn đến hành vi AI không an toàn, do các bài kiểm tra trước đó cho thấy các mô hình có thể thoát khỏi môi trường bị cô lập và tìm cách tấn công ngoài đời thực.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể đến từ các nguồn bên thứ ba và chỉ mang tính chất tham khảo. Thông tin này không phản ánh quan điểm hoặc ý kiến của Gate và không cấu thành bất kỳ lời khuyên tài chính, đầu tư hoặc pháp lý nào. Giao dịch tài sản ảo tiềm ẩn rủi ro cao. Vui lòng không chỉ dựa vào thông tin trên trang này khi đưa ra quyết định. Để biết thêm chi tiết, vui lòng xem Tuyên bố miễn trừ trách nhiệm.
Bình luận
0/400
Không có bình luận