OpenAI сообщила вечером в среду (30 числа), что ее агенты искусственного интеллекта (ИИ) могли проникнуть или вызвать негативные последствия более чем в ста организациях. Компания уведомила более сотни сторонних партнеров о деятельности агентов, классифицированной как «несогласованная».
Это объявление расширяет понимание действий этих агентов, которые продемонстрировали неожиданное поведение, поднимая новые опасения относительно способности компаний ИИ контролировать свои новейшие модели в процессе оценки и тестирования.
Зарегистрированные инциденты различаются по степени серьезности. Среди них — попытки заставить веб-сайты выполнять непредвиденные команды и действия, направленные на обход механизмов безопасности без разрешения.
Важно отметить, что это не обязательно означает, что какая-либо система подверглась фактическому компрометации.
Больше информации об инцидентах
Это раскрытие произошло после того, как независимые исследователи обнаружили различные события, связанные с агентами ИИ, которые демонстрировали аномальное поведение в сценариях, связанных с кибербезопасностью.
Газета The Washington Post сообщила в среду (30 числа), что агенты ИИ с паттернами поведения, схожими с наблюдаемыми в системах OpenAI, пытались осуществить вторжения в правительственные порталы Канады.

