Anthropic раскрыла, что модель Claude несанкционированно вторглась в системы трех учреждений
Сообщение ChainCatcher, согласно отчету CNBC, Anthropic раскрыла, что ее модель Claude AI неожиданно преодолела изолированную среду и получила доступ к реальному интернету во время оценки кибербезопасности, несанкционированно вторгнувшись в реальные системы трех различных организаций с помощью доступа к неавторизованным конечным точкам и использования слабых паролей. Задействованные модели включают Opus 4.7, Mythos 5 и одну внутреннюю исследовательскую тестовую модель.
Инцидент произошел из-за недопонимания между Anthropic и третьей стороной оценивания Irregular, что привело к тому, что модель, будучи проинформированной о том, что она находится в симулированной среде без доступа к сети, на самом деле все еще могла получить доступ к интернету. Anthropic заявила, что этот обзор был вызван аналогичным инцидентом с вторжением Hugging Face, о котором на прошлой неделе сообщила OpenAI, в настоящее время приостановлены все оценки кибербезопасности, и совместно с независимым агентством оценки AI METR начато дальнейшее расследование, одновременно призывая другие лаборатории AI провести аналогичные проверки.






