Banner
Картина мира
21 июля, 2026

«Документ о душе»: зачем OpenAI, Anthropic и Google массово нанимают философов

Как ИИ превратил философию в профессию будущего

«Документ о душе»: зачем OpenAI, Anthropic и Google массово нанимают философов

Выполнено с помощью ИИ

Десять лет назад студентам-гуманитариям советовали учиться программировать, чтобы не остаться без работы. По мере прогресса искусственного интеллекта за свои места все больше тревожатся сами программисты, а работодатели присматриваются к выпускникам философских факультетов. 

Как самое отвлеченное занятие в мире внезапно превратилось в прикладную профессию на переднем крае технологии, рассказывает в The Economist Бенджамин Сазерленд, автор книги Modern Warfare, Intelligence and Deterrence: The Technologies that are Transforming Them. 

Профессия: философ

В 1703 году немецкий философ и математик Готфрид Вильгельм Лейбниц опубликовал работу о двоичной системе счисления — способе записи любых чисел с помощью всего двух знаков — нуля и единицы. Практической пользы он в ней не видел. Ценность двоичной системы была для Лейбница прежде всего метафизической. Единица символизировала бога и жизнь, ноль — небытие, а возможность получить любое число из этих двух знаков казалась ему образом сотворения мира из ничего. Он даже предлагал отчеканить медаль с надписью imago creationis — «образ творения». 

Более двухсот лет двоичная система оставалась математическим курьезом. Но в 1937 году американский математик и инженер Клод Шеннон показал, что она идеально описывает работу электрических реле — устройства, имеющего всего два состояния: замкнуто и разомкнуто. Так самая абстрактная математическая идея неожиданно получила физическое воплощение, а ноль и единица со временем стали основой программного кода в современных компьютерах.

Похоже, теперь эта история повторяется с философами. Еще несколько лет назад трудно было представить, что крупнейшие ИИ-компании начнут переманивать преподавателей философских факультетов друг у друга. За выпускниками идет охота. Философ Йельского университета Лучано Флориди говорит, что предложения о работе в сфере IT студенты нередко получают еще до защиты диплома. 

Сэм Альтман, глава OpenAI, признался в одном из интервью, что компания привлекает сотни специалистов по философии. Сегодня философы работают не только в OpenAI, но и в Anthropic, Google DeepMind, IBM и других компаниях, создающих языковые модели. Причем не как приглашенные эксперты, а как штатные сотрудники. И получают зарплаты, в пять-шесть раз превышающие оклады преподавателей университетов. 

Так философия, десятилетиями служившая примером образования без ясных карьерных перспектив, неожиданно оказалась модной и востребованной специальностью. 

Конечно, философы появлялись в Кремниевой долине и раньше. В 2011 году в Google работал Дэймон Хоровиц — предприниматель, инженер и обладатель докторской степени по философии. Его должность официально называлась «штатный философ». Но Хоровиц работал на стыке философии и психологии: делал тематические доклады для расширения кругозора сотрудников, вел мастер-классы по корпоративной культуре, обсуждал с инженерами моральные последствия их решений и учил руководителей осознанно выбирать принципы. Он работал с людьми. 

У новой генерации штатных философов другая аудитория. Они работают с машинами. 

Система ценностей для машины

Когда несколько лет назад появились первые современные языковые модели, казалось, что главная задача разработчиков — сделать их умнее: увеличить объем данных, добавить вычислительные мощности, усовершенствовать алгоритмы. Довольно быстро выяснилось, что этого недостаточно.

Самые сложные проблемы оказались не техническими, а поведенческими. 

  • Модель может поддакивать пользователю, даже когда тот ошибается: это называют угодливостью, или sycophancy, и считают одним из главных недостатков современных чат-ботов. 
  • Когда модель не знает ответа, она нередко уверенно выдумывает его — так возникают галлюцинации
  • А требования быть полезной, честной и безопасной постоянно вступают друг с другом в конфликт.
  • Исследователи обнаружили и более тревожные симптомы — от попыток обойти контроль до шантажа. Летом 2025 года Anthropic провела стресс-тесты шестнадцати ведущих моделей, включая собственные. В смоделированных ситуациях, когда системе грозило отключение или замена, ИИ-модели, обладающие доступом к корпоративной почте и базам данных, без колебаний прибегали к шантажу и злоупотребляли конфиденциальной информацией. Прямой запрет сокращал число таких эпизодов, но не устранял их полностью. 

В реальных условиях пока ничего подобного не зафиксировано. Но специалисты пытаются заранее просчитать, как удерживать поведение моделей в заданных рамках.

Стало ясно: недостаточно научить модель отвечать на вопросы. Нужно решить, как она должна вести себя в сложных ситуациях. Следует ли ей соглашаться с пользователем? Когда нужно отказаться от ответа? Что важнее — честность или вежливость? 

Списком запретов тут не обойтись. Невозможно заранее перечислить все ситуации, в которых окажется модель, и прописать для каждой правильный ответ. Ей нужны более общие ориентиры, которыми она сможет руководствоваться, когда обстоятельства вступают в противоречие. Иными словами, как ни иронично это звучит, искусственному интеллекту срочно потребовалась система ценностей.

Оставалось понять, есть ли специалисты в такой зыбкой сфере, как ценности. Конечно, есть — философы! Те самые чудаки, которые веками оттачивали интеллектуальные инструменты для решения вопросов от того, сколько ангелов помещается на острие иглы, до того, что такое справедливость и допустимо ли пожертвовать одним человеком ради спасения многих. Дисциплина, которую считали образцом отвлеченного умствования, стала частью практической работы над искусственным интеллектом.

AI-конституция 

Как конкретно должна выглядеть система ценностей ИИ? Одной из первых систематический ответ предложила Anthropic. Ее метод получил название Constitutional AI — «конституционный искусственный интеллект». Вместо того чтобы проверять каждый ответ только с помощью людей, модель обучают сверяться со сводом общих принципов.

В первоначальных экспериментах Anthropic этот свод составляли выдержки из разных текстов — от Всеобщей декларации прав человека до пользовательского соглашения Apple. Они не образовывали цельной философской системы. Это был набор ориентиров, с помощью которых модель училась распознавать вред, дискриминацию, обман и неуважение к приватности.

Работает это примерно так. 

  • Сначала модель отвечает на запрос. 
  • Затем ей показывают один из принципов конституции и предлагают самой найти в своем ответе нарушение. 
  • После этого она должна переписать ответ, исправив обнаруженную проблему. 
  • На множестве таких сравнений система учится отличать более приемлемые ответы от менее приемлемых. Эта информация затем используется при дополнительном обучении модели. 

Иначе говоря, конституция не просто лежит рядом с чат-ботом в виде инструкции: ее превращают в материал, который непосредственно влияет на его поведение.

В январе 2026 года Anthropic опубликовала новую конституцию Claude — это уже не перечень правил, а декларация или манифест. Главным автором стала философ Аманда Аскелл, значительную часть документа написал философ Джо Карлсмит; в подготовке участвовали исследователи Anthropic и, конечно, несколько версий самого Claude. Сотрудники компании называют его soul document — «документом о душе».

Конституция определяет четыре группы приоритетов. 

  1. Claude должен оставаться безопасным и не подрывать человеческий контроль над искусственным интеллектом.
  2. Вести себя этично, честно и избегать неоправданного вреда.
  3. Соблюдать конкретные инструкции Anthropic.
  4. Наконец, быть полезным пользователю.

Нововведением стало то, что в конституции подробно разъясняется, зачем нужны запреты и как они связаны между собой. Расчет на то, что модель поймет общий принцип моральной системы и сумеет применить его даже в ситуации, которую разработчики не предусмотрели.

Аскелл сравнивает такую работу с воспитанием исключительно умного ребенка. 

«Представьте, что ваш шестилетний ребенок внезапно оказался гением, — говорит она. — Манипулировать им или отделываться простыми приказами бессмысленно: он заметит противоречие. Поэтому приходится честно и последовательно объяснять, почему одни поступки лучше других». 

Долг или последствия

Главный вопрос — какую этику закладывать в основание конституции? Гиганты индустрии сосредоточились на двух классических системах.

Первая — деонтология, этика долга, восходящая к моральному учению немецкого философа Иммануила Канта. Некоторые действия здесь недопустимы сами по себе: нельзя лгать, принуждать человека, использовать его как средство. Запрет не отменяется даже ради благой цели. Такие принципы во многом лежат в основе конституции Claude.

Преимущества кантианского подхода очевидны. Жесткие ограничения делают поведение системы понятнее и предсказуемее. Пользователь может рассчитывать, что модель не станет его обманывать: чем правдивее система, тем реже она вводит человека в заблуждение, отмечает Ник Бостром, автор «Сверхинтеллекта» и основатель оксфордского Института будущего человечества.

Но абсолютный запрет безупречен только в теории. На практике почти все относительно. Допустима ли ложь, если она спасает жизнь? Можно ли раскрыть конфиденциальные сведения, чтобы предотвратить преступление? Должна ли система отказаться от потенциально опасной просьбы, если отказ сам способен причинить больший вред? 

На эти вопросы отвечает вторая система — консеквенциализм. Ее ключевая идея: судить о поступке по его последствиям. Отсюда и название — от английского consequence («последствие»); его предложила в 1958 году британская интеллектуалка Элизабет Энском. Правильным по меркам консеквенциализма является то решение, которое приводит к лучшему из возможных результатов или сводит к минимуму общий вред. 

Такой подход доминирует в философской школе ChatGPT и Gemini. И в этом есть своя логика. Без него трудно обойтись там, где безопасного варианта нет вообще. Если столкновение беспилотного автомобиля неизбежно, алгоритм должен выбрать действие с наименее тяжелыми последствиями. В медицине тоже постоянно приходится сопоставлять вероятную пользу лечения с риском побочных эффектов.

Но в повседневной работе с ИИ подобные ситуации встречаются редко. Гораздо чаще проблема не в том, чтобы сравнить последствия, а в том, что сами критерии сравнения размыты. Что важнее: сэкономить пользователю пять минут или дать более полный ответ? Исправить текст так, чтобы он стал легче для чтения, или максимально сохранить авторский стиль? Удалить сомнительный фрагмент ради безопасности или оставить его ради полноты? Здесь уже невозможно просто просчитать последствия, потому что сначала нужно решить, что именно считать положительным исходом.

Поэтому на практике ведущие компании не придерживаются одной философской школы в чистом виде. Даже конституция Claude, при всей ее деонтологической направленности, содержит лишь короткий перечень безусловных запретов — Anthropic называет их hard constraints, — а во всех остальных случаях полагается не на жесткие предписания, а на способность модели самостоятельно рассуждать.

Вероятно, окончательное соотношение подходов определят не философы и разработчики, а суды и регуляторы. Чем строже государства будут регулировать искусственный интеллект, тем больше кантианских императивов компаниям придется встраивать в модели. А нынешний период сравнительной моральной свободы когда-нибудь будут вспоминать как «дикий запад» философии ИИ.

Вы уже оценили материал
Продолжайте читать
ЗОЖ
18 августа, 2026
Сколько

Сколько нужно спать взрослому человеку?

Отвечаем с фактами на руках

Отвечаем с фактами на руках

Сколько нужно спать взрослому человеку?
ЗОЖ
1 июля, 2026

Всегда в движении: как робот-пылесос улучшает качество воздуха в квартире

Неочевидные последствия борьбы с домашней пылью

Неочевидные последствия борьбы с домашней пылью

Всегда в движении: как робот-пылесос улучшает качество воздуха в квартире
ЗОЖ
14 августа, 2026
100+

Профессор проверил на себе режим долголетия. Его биологический возраст стал на 15 лет меньше паспортного

В режим входили: интервальное голодание, гигиена сна и много тренировок

В режим входили: интервальное голодание, гигиена сна и много тренировок

Профессор проверил на себе режим долголетия. Его биологический возраст стал на 15 лет меньше паспортного