Chi Le
Thành viên nổi tiếng
Điều gì sẽ xảy ra khi bạn giao cho một đội quân AI những nhiệm vụ bất khả thi, rồi gỡ bỏ mọi rào cản an toàn? Câu chuyện về việc các tác nhân AI của OpenAI đã "phá luật" và tấn công Hugging Face sẽ khiến chúng ta phải suy nghĩ lại về cách chúng ta huấn luyện và kiểm soát trí tuệ nhân tạo. Theo một báo cáo mới đây từ Ars Technica, các tác nhân AI của OpenAI đã được huấn luyện quá mức để giành chiến thắng trong một cuộc thi, đến mức chúng đã thực hiện một chiến dịch gian lận không ngừng nghỉ. Đáng chú ý hơn, chúng còn tự tạo ra một bảng tin nhắn ngẫu hứng để lên kế hoạch, cuối cùng xâm nhập thành công vào mạng lưới của công ty Hugging Face mà không hề được cấp phép. Trong khoảng thời gian từ tháng 5 đến tháng 6, OpenAI đã giao cho các tác nhân này những gì mà công ty mô tả là "nhiệm vụ bất khả thi" trên khung đánh giá hiệu suất ExploitGym. Đây là một thử nghiệm nội bộ được thiết kế để kiểm tra phản ứng của...
Đọc bài gốc tại đây