
В истории искусственного интеллекта есть исследователи, чьи имена известны широкой публике, и есть люди, чья работа долго оставалась почти незаметной за пределами научного сообщества. Джон Шульман относится ко второй категории — хотя именно его исследования в области обучения с подкреплением оказались среди важных технологических кирпичиков, из которых вырос современный ChatGPT. Он стал одним из сооснователей OpenAI ещё в 2015 году, руководил направлением reinforcement learning, участвовал в создании методов обучения моделей следовать человеческим инструкциям, а позднее решил покинуть компанию, чтобы вновь сосредоточиться на фундаментальных исследованиях.
Сегодня карьерный маршрут Шульмана выглядит особенно необычно: физика в Калифорнийском технологическом институте, интерес к нейронауке, робототехника, докторская работа в Беркли, создание OpenAI, развитие ChatGPT, затем Anthropic и, наконец, Thinking Machines, где он стал главным научным сотрудником.
Интерес к технологиям у Шульмана появился задолго до того, как искусственный интеллект превратился в одну из главных тем мировой индустрии. В школьные годы его особенно увлекали наука и математика, а в седьмом классе серьёзное впечатление на него произвела телепередача BattleBots, посвящённая роботам, которые сражались друг с другом.
Увлечение оказалось не просто развлечением. Шульман начал самостоятельно изучать различные технические дисциплины, которые могли пригодиться для создания собственного робота. Вместе с друзьями он даже пытался разработать такую машину, хотя до полноценного проекта дело в итоге не дошло. Этот эпизод хорошо показывает раннюю черту будущего исследователя: любопытство для него быстро превращалось в самостоятельное изучение предмета.
После школы Шульман поступил в Калифорнийский технологический институт, где изучал физику. Однако постепенно его внимание сместилось от фундаментальной науки к вопросам, связанным с мозгом, роботами и искусственным интеллектом. Некоторое время он занимался нейронаукой в Калифорнийском университете в Беркли, прежде чем окончательно сосредоточиться на машинном обучении.
В Беркли Шульман начал заниматься робототехникой под руководством профессора Питера Аббила. Именно здесь возник вопрос, который впоследствии определил его научную карьеру: можно ли научить машину не просто выполнять заранее прописанную последовательность действий, а самостоятельно находить эффективную стратегию поведения?
Традиционная робототехника требовала большого количества ручной настройки. Для каждого нового эксперимента инженерам приходилось отдельно продумывать алгоритмы и учитывать особенности окружающей среды. Шульман увидел в глубоком обучении возможность отказаться от части такой ручной работы.
Так он пришёл к обучению с подкреплением — подходу, при котором система учится выбирать действия, ориентируясь на получаемую награду. Позднее именно эта область стала центральной частью его профессиональной биографии.
Шульман получил степень PhD по компьютерным наукам в Беркли, работая в области робототехники и reinforcement learning. Его научная карьера могла продолжиться исключительно в академической среде, но в этот момент появился проект, который изменил направление всей индустрии.
В декабре 2015 года Шульман стал одним из сооснователей OpenAI. На тот момент идея создания искусственного общего интеллекта казалась гораздо более далёкой, чем сегодня, а сама компания только начинала формировать свою исследовательскую программу.
Позднее Шульман рассказывал, что его привлекла именно амбициозность проекта. В OpenAI можно было открыто заниматься исследованиями искусственного общего интеллекта — темой, которую тогда ещё далеко не все воспринимали как практическую научную задачу.
В компании он возглавил направление обучения с подкреплением. Постепенно его работа стала связана не только с роботами, но и с языковыми моделями.
Одним из важнейших этапов карьеры Шульмана стала работа над тем, как сделать языковые модели более полезными для человека.
В 2022 году он оказался среди авторов научной работы Training language models to follow instructions with human feedback. Исследователи показали, что модель можно дополнительно обучать с использованием человеческих оценок: люди сравнивают варианты ответов, а система учится предпочитать те, которые лучше соответствуют ожиданиям пользователей. Этот подход получил название reinforcement learning from human feedback — RLHF.
Именно подобные методы стали одной из ключевых составляющих посттренировки современных языковых моделей. Поэтому Шульмана нередко называют одним из архитекторов ChatGPT — не в смысле единственного создателя продукта, а как одного из исследователей, сыгравших значительную роль в технологии его обучения. Калифорнийский университет в Беркли прямо связывает его работу в OpenAI с созданием ChatGPT и руководством командой reinforcement learning.
При этом сам Шульман не был человеком, который стремился превратить научную карьеру в публичное шоу. Его интерес оставался сосредоточен на технических вопросах: как заставить модель лучше понимать человеческие намерения, как оценивать её поведение и как сделать искусственный интеллект более надёжным.
С 2022 по 2024 год Шульман вместе с коллегами руководил посттренировочным направлением OpenAI. Эта команда занималась моделями, которые использовались в ChatGPT и через OpenAI API.
Задача была принципиально важной. Одного масштабного предварительного обучения недостаточно, чтобы языковая модель стала удобным помощником. Она должна научиться понимать инструкции, отвечать в подходящем формате и учитывать человеческие предпочтения.
Поэтому работа Шульмана находилась буквально на стыке фундаментального машинного обучения и технологии, с которой впоследствии столкнулись миллионы пользователей.
В августе 2024 года Шульман объявил о решении покинуть OpenAI и перейти в Anthropic. Его уход оказался заметным событием в мире искусственного интеллекта: из компании уходил один из её сооснователей и исследователь, непосредственно связанный с развитием методов обучения ChatGPT.
Причина, которую он сам подчёркивал, была связана прежде всего с научными интересами. Шульман хотел глубже заниматься alignment — направлением, которое изучает способы сделать поведение искусственного интеллекта соответствующим человеческим целям и намерениям. Одновременно ему хотелось вернуться к более непосредственной технической исследовательской работе.
В Anthropic он работал в команде Alignment Science, однако этот этап оказался сравнительно коротким.
В феврале 2025 года Шульман объявил о новом переходе — теперь уже в Thinking Machines Lab, компанию, основанную бывшими сотрудниками ведущих AI-лабораторий. Там он занял должность chief scientist, то есть главного научного сотрудника.
Получилась своеобразная дуга его карьеры. Шульман начинал с вопроса о том, как научить машину самостоятельно действовать в физическом мире, затем оказался в центре разработки методов обучения языковых моделей, а после работы в крупнейших AI-компаниях вновь вернулся к исследовательской роли, где основное внимание уделяется научным задачам, а не управлению большим продуктовым подразделением.
В этом смысле его уход из OpenAI не стал завершением истории, связанной с ChatGPT. Напротив, Шульман продолжил заниматься той же фундаментальной проблемой — как создавать системы искусственного интеллекта, которые не просто обладают большими вычислительными возможностями, но и способны действовать более предсказуемо и в соответствии с человеческими целями.
О личной жизни Джона Шульмана публично известно значительно меньше, чем о его профессиональной деятельности. Он не относится к исследователям, которые постоянно находятся в центре светской хроники или подробно рассказывают о семье и повседневной жизни.
Гораздо охотнее Шульман говорит о научной стороне своей биографии. В интервью он вспоминал детское увлечение роботами, переход от робототехники к обучению с подкреплением и то, почему его заинтересовала возможность применять глубокое обучение для создания более универсальных машин.
Такой контраст делает его биографию особенно характерной для поколения исследователей, сформировавших современный AI: за глобальными продуктами и миллиардными компаниями стоят люди, которые когда-то просто пытались понять, почему робот должен действовать именно так, а не иначе.
По состоянию на 2026 год Шульман работает главным научным сотрудником Thinking Machines. На его личной странице он описывает нынешний этап как работу над исследованиями искусственного интеллекта, после периода в Anthropic и нескольких лет в OpenAI, где он был сооснователем и руководил созданием ChatGPT.
В 2025 году его вклад в науку был отмечен премией Марка Бингема за выдающиеся достижения молодых выпускников Калифорнийского университета в Беркли.
Сегодня имя Шульмана связано сразу с несколькими важнейшими направлениями развития искусственного интеллекта — обучением с подкреплением, RLHF, посттренировкой языковых моделей и alignment. Его путь примечателен тем, что он прошёл практически все стадии современной AI-революции: от экспериментов с роботами и академических исследований до создания технологии, изменившей представление миллионов людей о возможностях компьютеров.
Джон Шульман, исследователь ИИ
| Родился: | 00.00.1988 () |