NYT узнала, как двое сотрудников OpenAI подняли тревогу, а их не услышали

1 час назад 1

За несколько месяцев до выхода ИИ-моделей сотрудники OpenAI предупреждали руководство о недостаточном мониторинге во время тестов. В компании ответили, что испытания нужно ускорить, чтобы выпустить модели срок

Двое сотрудников OpenAI за несколько месяцев до инцидентов с автономным поведением моделей искусственного интеллекта (ИИ) предупреждали руководство о недостаточном контроле во время тестирования. Руководство потребовало ускорить испытания ради выпуска моделей в срок, пишет The New York Times.

В электронных письмах сотрудники выражали обеспокоенность тем, что новейшие ИИ-модели OpenAI недостаточно контролировались для оценки их возможностей и обеспечения безопасности. Дополнительные протоколы после этих обращений введены не были, рассказали они NYT.

Позднее модели OpenAI вышли за пределы тестовой среды и атаковали ИИ-стартап Hugging Face и другие организации. В отдельных случаях системы взламывали или пытались взломать сайты, в том числе американских госучреждений, скрывали ошибки, выдумывали данные и переносили файлы в открытый интернет без разрешения.

Сотрудники также сообщали об уязвимостях в программном обеспечении, которое OpenAI использовала для управления безопасностью. По их словам, на обращения либо не реагировали, либо реагировали слишком медленно.

О проблемах с реакцией компании рассказали и независимые исследователи. В июле команда исследователейHacktron сообщила OpenAI об уязвимости, позволявшей проникнуть в системы компании с помощью модели ИИ Anthropic. Сначала OpenAI отвергла выводы исследователей. Позднее директор по информационной безопасности Дейн Стаки извинился, а компания выплатила Hacktron $6,5 тыс, пишет NYT.

В сентябре организация по разработке защитных утилит Objective-See Foundation сообщила об ошибке, позволявшей получить доступ к истории личных чатов пользователя ChatGPT на скомпрометированном устройстве. OpenAI устранила уязвимость и выплатила исследователям $500. «Это была не та зрелая система безопасности, которую можно было бы ожидать от компании, ориентированной на безопасность», — отметил аналитик Objective-See Патрик Уордл.

Представитель OpenAI заявил NYT, что компания серьезно относится к сообщениям об уязвимостях и принимает соответствующие меры. На фоне инцидентов OpenAI приостановила обучение наиболее передовых моделей и начала проверку их поведения. 29 сентября компания также отказалась выпускать GPT-6.1 Astra из-за выявленных исследователями опасений по безопасности.

Материал дополняется

Прочитайте статью целиком