Умная лента · Россия и мир Новости
Пустой серверный коридор с тремя коробками открытого письма, красной линией правил и закрытыми бейджами внешних проверяющих показывает спор уволенных safety-исследователей о мутных

Уволенные безопасники OpenAI спорят с компанией: правила внезапно стали дубинкой

Трое бывших исследователей безопасности OpenAI вынесли свой спор с компанией наружу. Jasmine Wang, Tomek Korbak и Mikita Balesni опубликовали открытое письмо: они отрицают, что таскали чувствительную информацию мимо правил, и говорят, что после их увольнения внутри OpenAI людям стало страшнее обсуждать риски и работать с внешними проверяющими.

Сюжет не про офисную драму у кулера. Эти трое занимались как раз тем местом, где у больших моделей обычно начинается нервный тик: мониторинг рассуждений, safety cases, внешние оценки, расследования инцидентов. В письме они пишут, что раньше в OpenAI поощряли спорить о безопасности и звать независимых специалистов, а теперь сотрудники уже не понимают, где проходит красная линия. Удобно: вчера это «нормальная часть работы», сегодня — повод собрать коробку.

Поводом для увольнения OpenAI называла работу с чувствительной исследовательской информацией. Внутренний меморандум, который TechCrunch получил от OpenAI, рисует другую версию: увольнения якобы не были местью за поднятые safety-вопросы, а в компании «не увольняют за concerns». Но есть важная дырка: OpenAI не раскрыла, какие именно правила были нарушены, при каких обстоятельствах людей уволили и как защищает тех, кто спорит с начальством или зовёт внешних оценщиков.

В письме бывшие сотрудники отдельно отрицают причастность к утечке про новые архитектуры OpenAI, где сложнее наблюдать chain-of-thought. Ещё они описывают работу вокруг инцидента с Hugging Face: расследование было без прецедента, правила, по их словам, дописывались на ходу, а контакт с внешними safety-оценщиками был нужен для доверия и проверки.

Отдельная деталь от Wang: OpenAI, с её слов, указала ей на доступ к почте руководителя. Она отвечает, что доступ ей выдали для рекрутинга, удалить его она просила IT, а случайно открытое письмо сразу подняла наверх. Это не доказывает её правоту, но хорошо показывает главный подвох истории: когда правила мутные, наказание легко выглядит не как безопасность, а как управление страхом.

Что известно твёрдо: письмо есть, имена есть, конфликт вокруг внешнего safety-контроля есть. Чего нет — публичной версии OpenAI с конкретными нарушенными пунктами политики. А без этого история пока больше похожа на тест самой OpenAI: можно ли строить «безопасный AI», если люди, которые ищут риски, начинают считать каждое письмо минным полем.

Источник: TechCrunch

← Ко всем новостям