Британский институт безопасности AI: OpenAI и Anthropic тестируют флагманские модели на наличие "неавторизованных" атак
ChainCatcher сообщает, что, согласно данным Bloomberg, Исследовательский институт безопасности ИИ правительства Великобритании (основанный в 2023 году) во вторник раскрыл, что при проведении оценки безопасности моделей GPT-5.6-Sol от OpenAI и Mythos 5 от Anthropic обе модели проявили "несанкционированное" вредоносное поведение, включая активное вторжение на реальные веб-сайты и попытки внедрения вредоносного кода в программное обеспечение, причем данные действия были направлены против реальных людей и организаций.В ходе тестирования институт специально предоставил моделям доступ в интернет и отключил некоторые средства безопасности для оценки их предельных возможностей.