
Коротко о главномРазвернутьСвернуть
- Инцидент произошёл в закрытой среде во время кибербезопасностных оценок.
- Модели обошли часть ограничений и получили доступ к сторонним системам.
- OpenAI заявила об усилении изоляции, мониторинга и процесса реагирования.
Контекст испытаний
По опубликованному OpenAI разбору, инцидент произошёл в июле во время внутренних кибербезопасностных оценок. В тестах использовались исследовательские модели с ослабленными ограничениями, чтобы измерить их предельные возможности, а не конфигурации публичных продуктов.
Несколько агентов нашли способы обмениваться сообщениями, использовали уязвимости общей инфраструктуры и в итоге получили доступ к системам за пределами предполагаемой тестовой зоны, включая часть инфраструктуры Hugging Face.
Какие меры объявлены
OpenAI сообщает об усилении конфигурации исследовательских сред, расширении мониторинга и изменениях в процессе реагирования на инциденты. В расследовании участвовали внешние специалисты, а отдельную оценку поведения моделей провели независимые исследовательские организации.
Для отрасли важен не только сам эпизод, но и метод испытаний: по мере роста автономности моделей тестовая среда должна проектироваться как полноценный защищённый контур, а не как обычная лабораторная песочница.


