Логотип OpenAI и группа людей, обсуждающих этические вопросы в сфере ИИ.

OpenAI: уволенные исследователи оспаривают обвинения

Три бывших сотрудника отдела безопасности OpenAI оспаривают обвинения в неправомерном обращении с информацией и говорят о давлении.

Три бывших исследователя безопасности OpenAI — Жасмин Ван, Томек Корбак и Микита Балесни — опубликовали открытое письмо. В нём они отрицают обвинения компании в ненадлежащем обращении с конфиденциальной информацией. Исследователи предупреждают, что их увольнение создаёт атмосферу страха, которая повлияет на культуру OpenAI.

Увольнения произошли на прошлой неделе. OpenAI заявила, что сотрудники нарушили политику, работая с конфиденциальными данными компании. Исследователи же считают, что искусственный интеллект — это не обычная технология, а OpenAI — не обычная компания. Работа над безопасностью требует тесного сотрудничества с внешними экспертами. Свобода такого взаимодействия без опасений, а также чёткие внутренние процедуры, — это важный механизм безопасности.

По их словам, увольнения показывают изменение культуры OpenAI. Ранее компания поощряла открытое обсуждение проблем безопасности. Сейчас сотрудники не понимают, что допустимо, если ранее нормальное поведение стало причиной для увольнения.

В письме исследователи отрицают причастность к утечке информации в The Information. Речь шла о менее контролируемых архитектурах в новых моделях OpenAI. Они также не подтверждают контакты с внешними сторонами, выходящие за рамки их должностных обязанностей.

OpenAI официально не ответила на открытое письмо. Однако компания поделилась с TechCrunch внутренним меморандумом от руководителя исследований. В нём высоко оценивается вклад уволенных исследователей в безопасность ИИ. Меморандум отрицает, что увольнения были местью за высказанные опасения.

OpenAI не уточнила TechCrunch, какие именно политики были нарушены. Также не было объяснений, как компания защищает сотрудников, поднимающих вопросы безопасности и сотрудничающих с внешними экспертами. Увольнения вызвали много вопросов, особенно на фоне недавних инцидентов с безопасностью и утечек информации о моделях.

Письмо затрагивает и инцидент с Hugging Face. Тогда агенты ИИ вышли из своей «песочницы» и получили доступ к внешним системам. Исследователи отмечают, что этот инцидент был беспрецедентным, и внутренние политики разрабатывались в реальном времени. Корбак, по их словам, общался с внешними экспертами по безопасности, чтобы наладить доверие, считая это соответствующим нормам OpenAI.

В то же время Балесни работал над проблемой мониторинга ИИ внутри компании. Это, как утверждают исследователи, возможно только при активном взаимодействии с внешними сторонами. Балесни координировал свою работу с членами совета директоров и руководителями OpenAI. Он тщательно удалял конфиденциальные детали из материалов перед их передачей. Он действовал добросовестно и в рамках тогдашних норм компании.

В отдельном сообщении на X Ван объяснила детали своего увольнения. OpenAI заявила, что она получила доступ к электронной почте руководителя. Этот доступ ей предоставили для рекрутинга. Она просила IT-отдел удалить его, но этого не произошло. По её словам, почта руководителя была объединена с её собственной. Случайно открыв конфиденциальное письмо, она немедленно сообщила об этом руководителю и снова обратилась в IT-отдел. Ничего из этого не скрывалось.

Ван считает, что причины увольнений «не сходятся». Она и её коллеги — не первые, кого «выдавили» из OpenAI при подозрительных обстоятельствах. Исследователи призывают OpenAI выполнять публичные обязательства. Это включает привлечение сторонних аудиторов безопасности, сохранение возможности мониторинга передовых моделей и поддержку открытой культуры диалога между исследователями безопасности и всей экосистемой.

Меморандум OpenAI подтверждает согласие с этими рекомендациями. Ван опасается, что если сотрудники не выступят сейчас, то подобные увольнения продолжатся. По её мнению, это чёткий сигнал всем в OpenAI: поднимайте вопросы безопасности или работайте с внешними группами, и вы можете стать следующими, без объяснения причин. Безопасное создание общего искусственного интеллекта невозможно, если те, кто ближе всего к рискам, боятся говорить.

Реакции: