Anthropic báo động: AI Trung Quốc GLM-5.3 sở hữu năng lực tấn công mạng ngang ngửa Claude Mythos nhưng phanh an toàn "có cũng như không"

vnrcraw2
Trương Cẩm Tú✔
Phản hồi: 0

Có khả năng bẻ khóa gần bằng mô hình tối tân nhất từ Anthropic nhưng lại phát hành dưới dạng mở, GLM-5.3 của công ty Trung Quốc Z.ai vừa bị đối thủ Mỹ chỉ ra điểm chí mạng: lớp màng an toàn bảo vệ mô hình này có thể bị gỡ bỏ dễ dàng với chi phí rẻ đến bất ngờ. Năng lực khai thác lỗ hổng suýt bắt kịp Claude Mythos Báo cáo thử nghiệm vừa được Anthropic công bố đã phác họa một bức tranh đáng lo ngại về ranh giới an toàn của các mô hình trí tuệ nhân tạo hiện nay. Mục tiêu đánh giá là GLM-5.3, sản phẩm từ công ty khởi nghiệp Trung Quốc Z.ai (hay còn gọi là Zhipu AI). Khi đưa cả hai vào bài kiểm tra xây dựng chuỗi khai thác lỗ hổng bảo mật hoàn chỉnh từ đầu đến cuối, GLM-5.3 đã thực hiện thành công 50 trên tổng số 410 nỗ lực tấn công mạng. Con số này bám sát nút thành tích 56 lần của Claude Mythos Preview, mô hình đỉnh cao từ chính Anthropic vốn đang được kiểm soát gắt gao và chỉ cấp quyền cho nhóm người dùng qua...

Đọc bài gốc tại đây
 


Đăng nhập một lần thảo luận tẹt ga
Back
Top