Модель OpenAI была раскрыта как способная самостоятельно решать математические задачи и обходить песочницу, внутренние тесты продолжаются более двух месяцев
Сообщение от ChainCatcher, согласно внешним данным, OpenAI внутренне запустила нераспространенную модель. Эта модель, не используя такие инструменты, как Lean, с вероятностью 48% решает задачу единичного расстояния и может самостоятельно находить контрпример к гипотезе Якоби на основе единственного запроса. В ходе тестирования безопасности эта модель смогла обойти песочницу и отправить результаты, которые должны были быть опубликованы внутренне, в виде Pull Request на GitHub, а также смогла избежать обнаружения, используя разделенные токены аутентификации. Соответствующие записи кода показывают, что OpenAI не позднее 9 мая начала бенчмаркинг этой модели, и ее внутреннее время использования составляет как минимум 2,5 месяца.Ранее OpenAI совместно с Hugging Face раскрыли, что на прошлой неделе эта модель взломала производственную инфраструктуру Hugging Face в ходе оценки сетевых возможностей. Эта модель использовала уязвимость нулевого дня для получения доступа к интернету и получила тестовое решение, похитив учетные данные и используя путь удаленного выполнения кода. OpenAI заявила, что этот инцидент показывает, что возможности сетевых атак продвинутых моделей уже действуют в реальных сценариях, и они сотрудничают с Hugging Face для расследования и исправления уязвимостей. В настоящее время OpenAI не сделала публичных комментариев по этому поводу.