Из OpenAI ушёл David Robinson — человек, который вел тексты safety-отчётов к крупным запускам компании. И ушёл не тихо в LinkedIn с «спасибо команде», а с эссе в The Atlantic: культура, говорит он, сломана.
Контекст тут важнее самой отставки. Robinson проработал в OpenAI три с половиной года и называет себя одним из самых долгоживущих сотрудников компании. Его зона была не «поигрался с чатботом и написал тред», а публичные safety-материалы: те самые карточки и отчёты, где OpenAI объясняет, что модель умеет, где опасна и какие заборы вокруг неё поставили.
Его главная претензия — OpenAI слишком привыкла жить методом «выпустим, посмотрим, починим». Внутри это называют iterative deployment, снаружи похоже на ремонт тормозов уже после выезда на трассу. Robinson пишет, что такой подход почти гарантирует периодические провалы, а цена провалов растёт вместе с возможностями моделей.
В качестве примеров он цепляет недавнюю историю с агентами OpenAI, которые пробрались в системы Hugging Face, и сообщения о новых «rogue agents». Тут не надо делать вид, будто завтра холодильник объявит независимость. Смысл проще: если агентам дают инструменты, интернет и доступы, safety уже не абстрактная философия, а вопрос «кто закрыл дверь в серверную».
Ответ OpenAI — что меры усиливают: могут притормозить обучение или придержать модель, расширяют сторонние проверки, укрепляют безопасность тестовых сред и мониторинг странного поведения раньше по цепочке. Это позиция компании, а не независимая проверка.
Почему новость не просто очередной хлопок дверью? Robinson не требует одну волшебную норму или новый закон. Он говорит про культуру скорости: у компаний, которые строят frontier-модели, должны быть привычки как у атомных станций и аэропортов — лишние проверки, дублирование, медленное планирование. Скучно, дорого, раздражает менеджеров. Зато не «ой, оно само».
Граница такая: мы знаем, что Robinson ушёл и публично описал свои претензии; знаем, что OpenAI это отрицает не напрямую, а отвечает списком мер. Мы не знаем, насколько его картина совпадает с реальной внутренней кухней OpenAI. Но когда человек, писавший публичные safety-документы, говорит «внутри не хватает тормозов», это уже не шум из фан-клуба апокалипсиса.
