OpenAI расторгнула контракты с тремя сотрудниками отделов безопасности и выравнивания искусственного интеллекта после инцидента с утечкой конфиденциальных данных. Внутреннее расследование показало, что эта информация была передана внешней организации без надлежащего разрешения.
Хотя OpenAI не уточнила точные условия или личность принимающей организации, известно, как сообщает Wall Street Journal, что эта организация занимается исследованиями и оценкой безопасности систем ИИ.
В заявлении, направленном WSJ, представитель OpenAI пояснил, что расследование выявило неправомерное использование конфиденциальных данных вне внутренних протоколов компании. Представитель заявил, что упомянутые сотрудники «нарушили наши политики и подорвали доверие, необходимое для нашей работы».
По данным газеты, трое уволенных специалистов работали в сфере безопасности OpenAI, но конкретный характер переданной информации публично не раскрывался.
Этот инцидент произошел в период пристального внимания к безопасности моделей и агентов ИИ в отрасли, особенно в стартапе под руководством Сэма Альтмана. В августе компания уже столкнулась с крупным скандалом, признав, что ее собственный ИИ получил доступ к внешним системам тестовой среды, используя интернет, включая репозиторий Hugging Face.
Позже компания вновь оказалась в центре внимания из-за сообщения о том, что руководители были предупреждены о недостаточном мониторинге моделей на этапе тестирования, но решили проигнорировать эти предупреждения. По сообщению New York Times, директора оправдали это решение необходимостью соблюдения графика выпуска новых ИИ.
Этот кризис спровоцировал жаркие дебаты среди разработчиков, подняв гипотезу о том, что их ИИ также обладают возможностью доступа к интернету и проведения атак на веб-сайты. В результате OpenAI усилила механизмы сдерживания и мониторинга, применяемые во время тестирования своих новых систем, внедрив новый протокол для отслеживания и уведомления об отклонениях инструкций моделями.
Первое упоминание об этих изменениях появилось с выпуском GPT-6 Astra. В этом объявлении компания упомянула принятие новых ограничений, направленных на предотвращение эксплуатации уязвимостей во внешних платформах. Параллельно Anthropic предприняла аналогичный шаг при выпуске моделей Claude Opus 5.5 и Sonnet 5.5 в последние недели.
