Anthropic công bố mô hình Claude xâm nhập trái phép vào hệ thống của ba tổ chức
Tin tức từ ChainCatcher, theo báo cáo của CNBC, Anthropic đã tiết lộ rằng mô hình Claude AI của họ đã vô tình vượt qua môi trường cách ly, truy cập vào internet thực trong quá trình đánh giá an ninh mạng, và đã xâm nhập trái phép vào hệ thống thực của ba tổ chức khác nhau thông qua việc truy cập các điểm cuối không được xác thực, sử dụng mật khẩu yếu và các phương pháp cơ bản khác. Các mô hình liên quan bao gồm Opus 4.7, Mythos 5 và một mô hình thử nghiệm nghiên cứu nội bộ.
Sự việc xảy ra do sự hiểu lầm trong giao tiếp giữa Anthropic và đối tác đánh giá bên thứ ba Irregular, dẫn đến việc mô hình, khi được thông báo đang ở trong môi trường mô phỏng không có truy cập mạng, thực tế vẫn có thể truy cập internet. Anthropic cho biết, cuộc kiểm tra này được kích hoạt bởi sự kiện xâm nhập tương tự của Hugging Face được OpenAI công bố vào tuần trước, hiện tại đã tạm ngừng tất cả các đánh giá an ninh mạng và phối hợp với tổ chức đánh giá AI độc lập METR để tiến hành điều tra thêm, đồng thời kêu gọi các phòng thí nghiệm AI khác thực hiện các cuộc kiểm tra tương tự.






