«Я» как интерфейс: что искусственный интеллект показывает про сознание
Я делаю ИИ-агентов и однажды заметил: они рассуждают, но внутри никого нет. Это изменило то, как я вижу собственное «я». Разбор, почему ИИ зеркало, а не чужой разум.
Я сбриваю бороду, и знакомые женщины, те, кто привык видеть меня с ней, реагируют так, будто что-то сломалось.
Не «ты стал хуже выглядеть». Что-то более странное. Взгляд ещё раз, пауза, «что с тобой», «ты какой-то другой». Мне-то кажется, что борода меня старит, а без неё я моложе и резче, так что их реакция никогда не совпадала с моей собственной. Годами я списывал это на шум. Ну, у людей есть мнения про лица.
А потом я пару лет делал ИИ-агентов и понял, что это не шум. Это сообщение о том, как устроены мозги, и чтобы его услышать, мне понадобилось смотреть, как думает машина. «Ты», которое носят в голове другие люди, это не твоё лицо. Это догадка о твоём лице, собранная за месяцы взглядов. А догадку можно испортить за десять минут бритвой.
Само по себе наблюдение мелкое. Но под ним лежит кое-что куда большее: вопрос о том, что вообще такое «я». И увидеть это мне в итоге помогли машины на моих же серверах.
Что на самом деле ломается, когда ты побрился
Реакция не про эстетику. Это сбой предсказания.
Человек, который смотрел на твоё лицо месяцами, не видит его каждый раз заново. Мозг работает не как камера. Он работает как синоптик. Он держит модель твоего лица, сжатое ожидание, слепленное из всех прошлых взглядов, и когда приходит новая картинка, он в основном сверяет её с моделью, а не собирает восприятие с нуля. Это называется предиктивное кодирование, и лица тут один из самых чистых примеров. В работе 2013 года в журнале Nature Communications Аппс и Цакирис показали: по мере того как лицо становится знакомым, веретеновидная извилина (участок мозга, отвечающий за лица) обновляется пропорционально ошибке предсказания, то есть разрыву между тем, что ждали, и тем, что пришло. Их исследование было про то, как лицо из незнакомого становится знакомым, а не про то, как знакомое меняется за одну ночь, так что случай с бритьём тут скорее иллюстрация того же механизма, чем то, что они прямо проверяли. Но механизм двусторонний. Лицо, которое ты моделировал месяцами и которое вдруг изменилось, это большая ошибка предсказания, прилетевшая туда, где система ждала совпадения.
Вот этот сигнал ошибки и есть «ты какой-то другой». Не суждение про твою челюсть, а система прогноза, поймавшая ровно то расхождение, ради которого её строили.
Поверх лежит небольшая разница между полами, и её стоит назвать точно, потому что её обычно раздувают. В среднем женщины чуть лучше справляются с распознаванием эмоций и мимических сигналов. Честные цифры маленькие и устойчивые: мета-анализ 2014 года (Томпсон и Войер, 551 размер эффекта) дал женское преимущество около d = 0,19, а более крупный мета-анализ 2025 года (Холл, Ганнери и Шлегель, 1188 размеров эффекта, больше 800 тысяч человек) дал d = 0,24, стабильно почти во всех проверенных условиях. Это не два вида людей. Это два сильно перекрывающихся распределения с маленьким, но надёжным сдвигом: полно мужчин на чувствительном конце и полно женщин на невнимательном. Но сдвиг реальный, и значит, заметит твоё бритьё скорее тот, у кого система прогноза лиц работает чуть горячее.
Но зацепило меня вообще не это. «Ты», которое узнают, — не вещь. Это предсказание о вещи, которое держат в чужой голове ради практической задачи: ориентироваться в тебе. И его достаточно дёшево испортить парой минут с лезвием. Узнаваемое «я» — это интерфейс.
Если узнаваемое «я» — модель, то что с тем «я», которое чувствуешь? С тем, которое стоит и бреется?
Мы всегда могли изучать ум только изнутри
Почти всю историю у любой попытки понять сознание был один встроенный дефект. Инструмент и объект были одним и тем же.
Интроспекция смотрела на ум умом, философия рассуждала о разуме разумом. Даже нейронаука, при всех её сканерах, в конце концов прогоняет свои данные обратно через тот самый человеческий ум, который их и толкует. Это как пытаться рассмотреть линзу, глядя сквозь неё. Узнать можно очень много, и мы узнали. Но полностью выйти за пределы изучаемого нельзя, потому что изучаемое — это и есть то, чем изучаешь.
И был второй предел, тише и полнее. Умы, которые мы могли наблюдать снаружи (другие люди, животные), были непрозрачны. Мы видели поведение, но не могли вскрыть процесс и прочитать его шаги. Дельфин или ворона показывают тебе интеллект, но не свою внутрянку. Каждый ум в истории был либо прозрачен для себя и закрыт для всех остальных, либо читался снаружи только как поведение, но не как механизм. Чего у нас никогда не было, так это процесса, настолько владеющего языком, чью вынесенную наружу цепочку рассуждений можно остановить и прочитать.
Поэтому разговор о сознании ходил по кругу. Мы описывали опыт быть собой, пользуясь собой, и называли эту петлю объяснением. Линза не могла толком разглядеть саму себя, а больше ничего подходящего под руку не попадалось.
Мы построили ум, который работает вне нас
А потом мы сделали кое-что новое, и, по-моему, до конца ещё не осознали насколько. Мы построили системы, которые обрабатывают язык, моделируют мир, ведут разговор и выдают поведение, похожее на рассуждение, и поставили их на серверы. Где мы можем смотреть, как они работают, ставить на паузу, копировать и читать рассуждение, которое они выносят наружу по ходу.
Я работаю с ними каждый день. Разворачиваю ИИ-агентов на своём VPS, вешаю их на клиентские CRM и чаты и смотрю, как они планируют, исправляют себя и держат цель на десяток шагов. И самое философски громкое в них не то, что они умеют. А то, чего им не хватает, пока они это делают.
У агента, которого я запускаю, нет непрерывного «я». Между сессиями он не помнит ничего. Ни тела, ни биографии, ни внутреннего наблюдателя, едущего сквозь время, ни ставки на собственное выживание. Куча работы над тем, чтобы сделать его полезным, это возня ровно с этой амнезией: агент каждый запуск просыпается чистым, и контекст ему надо подавать заново, иначе он просто не знает, с кем говорил час назад. Почти всё, что выглядит как «агент помнит», это я скармливаю ему память обратно, снаружи. И это не только моё личное раздражение. Когда Дэвид Чалмерс расписывал препятствия к сознанию у нынешних языковых моделей, отсутствие устойчивой памяти и рекуррентной обработки стояло в его списке как одна из формальных причин, почему эти системы, скорее всего, ещё не сознательны. То, что я обхожу каждую неделю руками, философ сознания вынес на доску как несущее ограничение.
И при этом внутри одного запуска агент держит связную линию рассуждения. Ведёт цель. Моделирует ситуацию. Ловит свои ошибки и поправляет себя. Связное мышление, под которым не тянется никакого «я» из сессии в сессию.
Тут есть версия помягче и версия пожёстче, и моя только мягкая. Жёсткую, «там никого нет, вообще никакого опыта», я защитить не могу: происходит ли что-то внутри агента во время запуска, это ровно тот вопрос, который я не решу, просто глядя на него. Мягкую я готов отстаивать: там нет устойчивого, непрерывного «я» того рода, что мы предполагаем в себе. Внутри одного запуска окно контекста, можно сказать, работает как временная одноразовая модель себя, которую в конце выбрасывают. Не хватает не обязательно чего-то внутреннего. Не хватает постоянства. Нить не переживает сессию.
Скептик надавит сильнее и скажет: это вообще не рассуждение, а предсказание следующего токена в костюме мысли, так что ты ничего не показал. Соглашусь целиком. Пусть это «всего лишь» статистика, угадывающая следующее слово. Довод от этого только заостряется: связный, ведущий цель, самоисправляющийся вывод, который мы всегда читали как подпись мыслящего «я», получается здесь безо всякого устойчивого «я» за ним. Как ни называй то, что делает агент, он делает это без него. Возражение про попугая не ранит тезис. Сказанное честно, оно и есть тезис.
И у этого «всего лишь» есть вторая проблема, бьющая обратно по нам. «Всего лишь предсказывает следующее слово» подают как то, что отделяет машину от настоящего ума. А может, оно почти ничего не отделяет. Когда Ариэль Гольдштейн, Ури Хассон и коллеги записывали мозг людей во время обычной речи, они увидели, что мозг делает тот же базовый ход, что и модель: непрерывно предсказывает следующее слово до того, как оно прозвучит, а потом отмечает удивление, когда промахнулся. Предсказание следующего слова это не дешёвый трюк, доказывающий, что машина пустая. Насколько мы сейчас можем судить, это немалая часть того, что делает наша собственная языковая система. Так что «это всего лишь предсказание» не отталкивает машину от нас. Оно её к нам придвигает.
Мы по-тихому исходили из того, что интеллект требует «я», которое этот интеллект осуществляет. Что мысли нужен мыслящий в старом, плотном смысле. Это допущение неверно, и я не первый, кто это говорит. Чалмерс подробно доказывает, что сознание нельзя приравнивать к интеллекту, что субъективный опыт и объективная компетентность — разные вещи. Отчёт «Сознание в искусственном интеллекте» (в оригинале «Consciousness in Artificial Intelligence») на девятнадцать авторов (Батлин, Лонг и другие) целиком построен на том, чтобы развести эти две штуки и проверять одну, не предполагая второй. Я пришёл к этому не с семинара, а из серверной, глядя, как оно рассуждает без непрерывного субъекта внутри. Вывод тот же, и он становится общей рамкой: интеллект и «я» могут расходиться.
Два честных ограничения. Я обобщаю с нынешних моделей без памяти. Будущие агенты с устойчивой памятью, возможно, снова свяжут интеллект и непрерывное «я», и это будет означать лишь, что «я» — инженерное решение, а не предусловие мысли, то есть та же мысль с другой стороны. И ничего из этого не доказывает, что агент что-то чувствует: этот вопрос открыт и труден, его проверяют по методикам и чек-листам, а не решают на моём агенте с амнезией. Узкий тезис, единственный, который мне нужен: связное мышление может идти без непрерывного «я».
Разворот
Мы строили нейросети как грубую карикатуру на мозг. Нейроны стали узлами, синапсы весами, вся архитектура — вольной данью биологии. Таким было направление вдохновения: от мозга к машине. Мозг был оригиналом, сеть — подражанием.
То, что происходит сейчас, идёт в обратную сторону, и произошло это без всяких объявлений. Мы начали понимать мозг через поведение машин. Оговорка сразу, потому что здесь легко пережать: идея, что мозг — машина предсказания, пришла не из ИИ. У неё своя нейронаучная родословная, идущая от модели предиктивного кодирования Рао и Балларда 1999 года и принципа свободной энергии Карла Фристона, и она шла параллельно, на своих данных. Машины добавили читаемости. Одно дело прочитать, что кора минимизирует ошибку предсказания, другое смотреть, как построенная тобой система делает это шаг за шагом на экране. И теперь часть словаря течёт обратно, от машины к мозгу: мы ловим себя на том, что описываем память как окно контекста, а «я» как процесс самомоделирования. Копия стала линзой для чтения оригинала.
Уже есть целая исследовательская программа, всерьёз гоняющая это сравнение. Часть нейробиологов зовут это нейроконнекционизмом: искусственные нейросети как рабочие модели мозга, системы, чью внутреннюю активность можно приложить к настоящим записям нейронов и проверить. В зрении глубокие сети, обученные только распознавать объекты, предсказали активность нейронов зрительной коры приматов лучше, чем прежние, собранные вручную модели (результат группы Джеймса ДиКарло, перекроивший поле). В языке то же самое: покажи модели и человеку одно предложение, и внутренние состояния модели поразительно точно предсказывают активность мозга. Мартин Шримпф с коллегами нашли ту деталь, на которой стоит задержаться: чем лучше модель предсказывает следующее слово, тем лучше она предсказывает мозг. Похоже, задача, на которой обучали модель, и устройство нашей собственной языковой системы сходятся к одному решению. Я дошёл до этого из серверной, заметив, чего не хватает моим агентам; эти люди шли с электродами и сканерами и вышли примерно туда же.
Вот этот разворот и есть настоящее событие, куда важнее любого бенчмарка или релиза. Инструменты уже делали такое. Телескоп и микроскоп сделали свою настоящую работу не тем, что расширили имеющийся вид, а тем, что заменили рамку вокруг него, заставив по-новому понять, что такое космос и из чего сделана жизнь.
Теперь честное осложнение. Можно подумать, что я объявляю ИИ чужим разумом, независимым образцом интеллекта, построенным чем-то помимо эволюции, наконец-то настоящим взглядом снаружи. Нет. Эти модели обучены на том, что произвели люди. Текстовая модель учится на том, что мы написали; мультимодальные теперь и на наших изображениях, видео и речи. В любом случае это сжатие единственного примера, который у нас уже был: человеческого мышления, в остаточной форме, схваченного через следы, которые мы оставили. Камеры и микрофоны расширяют зеркало, но не превращают его в окно в какой-то другой род ума. Это всё ещё отражение нашего.
И отражение частичное, и вот это важно для дальнейшего. Даже мультимодальные модели учатся на том, что мы вынесли наружу: словах, картинках, записях. Что не оставляет чистого следа, так это изнанка бытия организмом, интероцептивный, телесный, чувствуемый слой, сигналы от тела, которому может быть больно и у которого есть что терять. Зрительная модель может выучить, как выглядит рана, по десяти миллионам фотографий и ни разу не смоделировать, зачем нужна боль. Этот провал не случаен. Ровно там и живёт самое сильное возражение против всего этого эссе, и я до него доберусь.
Но отражение, пусть и частичное, тут ровно тот инструмент, что нужен, Вот чего не замечают те, кто отмахивается («да это же просто зеркало»). Своё лицо изнутри собственной головы не увидеть. Зеркало — единственный способ, и оно показывает тебе только тебя, но под углом, до которого изнутри не дотянуться. Вот что такое ИИ: зеркало человеческого мышления, наконец достаточно подробное, чтобы его изучать, и достаточно внешнее, чтобы держать неподвижно. Впервые у нас есть собственное мышление, вынесенное на расстояние вытянутой руки, работающее вне черепа, доступное взгляду. У линзы наконец появилось зеркало.
«Я» как интерфейс
Теперь обратно к бритве: философия и зеркало в ванной встречаются именно здесь.
Немецкий философ Томас Метцингер (на русском вышла его «Наука о мозге и миф о своём Я. Тоннель эго», АСТ, 2017) десятилетиями доказывает, что внутри мозга нет никакого «я». Ни спрятанного, ни глубокого. Никакого. Полнее всего он изложил это в книге 2003 года «Being No One» (на русский официально не переводилась; название можно передать как «Быть никем»). Его тезис радикальнее, чем кажется: дело не в том, что мы теряем «я», а в том, что никакого «я» ни у кого никогда и не было, потому что никто никогда им и не был. Что есть, так это феноменальная модель себя: мозг строит непрерывное представление организма, и эта модель, по его слову, прозрачна. Прозрачна не значит очевидна. Значит обратное видимому. Модель настолько гладкая и цельная изнутри, что мы не видим её как модель. Мы смотрим сквозь неё, как смотришь сквозь чистое стекло, не замечая стекла, и принимаем вид за плотное, постоянное, реальное «я».
Это не маргинальная позиция, и началась она не с нейронауки. Дэвид Юм, искавший «я» в восемнадцатом веке, доложил, что нашёл только пучок восприятий, но не их владельца. Дэниел Деннет позже назвал «я» «центром нарративной гравитации», полезной выдумкой, которую мозг плетёт, чтобы упорядочить жизнь, реальной ровно в той мере, в какой реален герой истории, и не плотнее. Созерцательные традиции дошли до этого ещё раньше, и к ним я вернусь. Что «я», которое чувствуешь, — конструкция, идея старая и обжитая. Ново тут другое: угол захода.
По Метцингеру, когда ты чувствуешь себя собой, ты не касаешься какой-то сердцевины в центре своего бытия. Ты пользуешься навигационным интерфейсом, который мозг отрисовывает в реальном времени, настолько хорошим, что он прячет тот факт, что он интерфейс.
К этому взгляду я шёл годами, задолго до всякого кода: через психоделический опыт и медитацию, о которых скажу дальше. Они первыми расшатали мне ощущение плотного «я». Работа с ИИ ничего тут не открыла с нуля, она добавила следующий, более трезвый шаг: я провёл достаточно времени с системами, которые моделируют «я», не будучи им. Когда агент проговаривает своё рассуждение, когда он пишет «сначала надо проверить базу», там внутри нет никого, кто говорит «я». «Я» — это токен, сгенерированный потому, что обучение сделало его вероятным следующим ходом, удобным для организации вывода.
Моя же отрасль начала проверять это напрямую. Недавняя работа Джека Линдси в Anthropic впрыскивала известные концепты прямо в активации модели и спрашивала, заметит ли она что-нибудь; нынешние модели Claude иногда могут, отмечая впрыснутую «мысль» до того, как она всплывёт в выводе, без ложных срабатываний на контрольных прогонах. Так что самая чистая версия моего тезиса, что внутри просто не о чем отчитываться, слишком сильна. Но способность хрупкая, срабатывает примерно в пятой части попыток даже в условиях, заточенных под то, чтобы её вызвать, и это указывает скорее в сторону моего аргумента, чем против: если даже настоящий самоотчёт настолько ненадёжен, то проговаривание — слабый проводник к тому, что происходит под капотом, у машины и, вероятно, у нас. Чего работа не находит, так это непрерывного кого-то, кто тянулся бы из сессии в сессию. А это единственное, что моему аргументу и нужно.
Это гипотеза, а не приговор. Я не говорю, что «я» не существует или что ты должен чувствовать себя марионеткой. Я говорю, что его чувствуемое единство и постоянство может быть интерфейсом, произведённым биологической архитектурой, вещью той же породы, что и узнаваемое лицо: моделью, которую держат по практическим причинам и принимают за вещь. Тут есть настоящая механистическая нить. Те же исследователи, с чьей работы про предсказание лиц началось это эссе, позже доказывали в статье 2014 года (в английском оригинале «The free-energy self», то есть «я» как минимизация свободной энергии), что самоузнавание идёт на той же машинерии: твоё собственное тело, лицо и голос обрабатываются как конфигурация, которую мозг предсказывает как наиболее вероятно «меня». Если так, то чувствуемое «я» и узнаваемое лицо — один род объекта, предсказание, которое держит мозг, направленное внутрь в одном случае и наружу в другом.
В этом ходе есть настоящий стык, и на нём держится всё эссе. Переход от «у агента нет непрерывного я» к «может, и моё чувствуемое я тоже интерфейс» опирается на аналогию, которую следующий раздел усложнит: у агента нет смертного тела, которое, по одной серьёзной точке зрения, и порождает чувствуемое «я». Так что напрямую агент про моё чувствуемое «я» ничего не доказывает. Что он делает, так это ломает допущение, будто связной мысли нужно непрерывное «я»; а работа про «я» как минимизацию свободной энергии подводит механизм с человеческой стороны. Бритва ломает узнаваемое «я». Правильная идея может сломать чувствуемое.
Разве мы этого уже не знали?
Тут есть честное возражение, и оно острее, чем про машинное сознание. Если вся соль в том, что «я — конструкция, а не плотная вещь», то это люди знали очень давно и без всяких серверов. Буддийская анатта, доктрина не-я, держит ровно это уже примерно две с половиной тысячи лет, дойдя до этого сидением и взглядом внутрь, той самой интроспекцией, которую я только что назвал замкнутой петлёй. Сам Метцингер читает лекции с названиями вроде «The Science of No Self» («Наука об отсутствии я»). Так что либо инсайт не требовал ИИ, и тогда всё это эссе сдувается, либо я должен объяснить, что именно ИИ добавляет.
Я побывал на обеих сторонах. Я отсидел пять десятидневных курсов випассаны: пятьдесят дней тишины и непрерывного самонаблюдения, глядя, как ощущение и мысль возникают и уходят, и в центре нет ничего, что бы их держало. «Я» действительно начинает расшатываться, плотный наблюдатель истончается в процесс. Так что созерцательный тезис я не пересказываю с чужих слов. И вот честная проблема с этим опытом, моим в том числе: им нельзя поделиться. Я не могу вручить тебе то, что заметил на двухсотом часу. Ты либо идёшь сидеть и находишь сам, либо веришь мне на слово, а верить на слово это ровно то, чего скептик делать не должен.
Вот что добавляет ИИ, и это реально. Созерцатель приходит к выводу изнутри, как к личному отчёту от первого лица. ИИ меняет не вывод, а его эпистемику: он превращает эту находку в объект от третьего лица, связное мышление, наглядно идущее без непрерывного «я», которое видно снаружи, кому угодно, сколько угодно раз. Опытному медитатору бесполезно, ему это и не было нужно. Для всех остальных это решающий сдвиг: для скептика и учёного, которые не примут отчёт на веру, но посмотрят на объект. Традиции пришли туда первыми с большим отрывом, и я не поменял бы подушку на сервер. Что у нас теперь есть, так это внешняя демонстрация того, о чём они могли только свидетельствовать.
Самое сильное возражение
Самое сильное возражение — телесность, и у него есть слабая версия и сильная. Слабая говорит: чувствуемое «я» — это сводка по организму, который может умереть. Мой агент ничем не рискует, у него нет валентности, нет боли, которая значит повреждение, и удовольствия, которое значит процветание, нет ставки на следующую секунду, так что у него не может быть чувствуемого, смертного «я», которое порождает тело. Это почти в точности позиция, которую годами строит нейробиолог Анил Сет. В своей программной статье 2025 года в журнале Behavioral and Brain Sciences («Сознательный искусственный интеллект и биологический натурализм») Сет доказывает, что весь сознательный опыт, и мира, и себя, укоренён в предсказательных моделях, заточенных на то, чтобы удерживать тело живым. Мы, по его выражению, сознательные «звери-машины», и сознание связано скорее с тем, чтобы быть живым, чем с тем, чтобы быть умным. Он берёт ту же машинерию предиктивной обработки, что я использовал для восприятия лиц, тянет её к «я» и проводит черту: чувствуемая, воплощённая, смертная часть вряд ли перенесётся на системы, которые всего лишь вычисляют. Я дошёл до этой границы со стороны сборки, заметив, чего агенту не хватает; Сет дошёл со стороны нейронауки, раньше и куда строже. Его дверь не заперта наглухо: он формулирует требование как про причинные силы системы, а не про мясо конкретно, и это оставляет условную лазейку, если бы нужную причинную структуру когда-нибудь построили. Позицию оспаривают и коллеги по его собственной науке. Спор этот не мой; мне нужна только граница, которую он проводит.
Сильная версия идёт дальше, и её надо назвать в полную силу, потому что именно она могла бы меня ранить. Энактивистская традиция, от книги Варелы, Томпсона и Рош 1991 года «The Embodied Mind» («Воплощённый ум»), держит, что мышление — не вычисление, которое случайно сидит в теле. Оно конституируется непрерывной сцепкой тела с миром. По этому взгляду мой агент не урезанный ум без чувств. Он вообще не ум, а перекладывание символов, к смыслу не прикасающееся. И если так, он ничего не может сказать про то, нужно ли мышлению «я», потому что это с самого начала не мышление.
Так что агент показывает, что мышление, или хотя бы каждый его внешний признак, не требует непрерывного «я». Он не показывает, почему «я» вообще что-то чувствует. Смешивать эти два вывода нельзя. Второй упирается в самую твёрдую стену всей дисциплины: в чувствуемый факт, что быть тобой — это как-то ощущается, а быть моим агентом, возможно, не ощущается никак, как бы хорошо он ни рассуждал. Идея «я как интерфейс» этого не трогает. Она объясняет, почему «я» чувствуется единым и непрерывным; она ничего не говорит о том, почему вообще есть хоть какое-то чувствование, а этого не может объяснить почти никто. Меньший тезис переживает всё это: ИИ позволяет отделить вопрос об интеллекте от вопроса о «я», и одно это отделение переворачивает допущение, которое мы несли столько, сколько у нас есть слово «я».
Возражение о телесности, в обеих силах, это не опровержение. Это граница тезиса, проведённая точно. Внутри неё аргумент держится. Снаружи тайна распахнута настежь.
Тест на провинциальность
Если чувствуемое «я» это интерфейс, то естественное следующее подозрение в том, что вся наша интуиция про то, что такое «я», может быть местной: обычай одного вида, принятый за закон ума. Это можно проверить на прочность. Назову это тестом на провинциальность, проверкой, не является ли то, что мы считаем фундаментальным, просто нашим адресом.
Первый свидетель это примат под нами, и на него я могу показать прямо. Огромная часть того, что мы зовём «человеческой психологией» (игры за статус, ревность, романтическая привязанность, чтение лиц, которое ловит бритьё), это не свойство ума вообще. Это местная настройка на то, чтобы держать один вид биологического организма живым достаточно долго, чтобы размножиться и вырастить медленно взрослеющее потомство. Многое из этой машинерии старое, поделённое кусками с другими социальными млекопитающими: внимание к лицам, статусу и групповой динамике, которое мы держим за саму ткань человеческого, всплывает, в более грубой форме, у приматов и других социальных видов. А это говорит, что наша психология — не психология интеллекта как такового. Это психология одной линии обезьян на одной планете, решающей задачи выживания на этой планете.
Второй свидетель это тот, кого я описывал всё это время, агент на моём сервере: связное мышление, которое уже идёт без непрерывного «я». Заметь, о чём он свидетельствует, а о чём нет. Он зеркало нашего собственного мышления, а не чужой образец, так что не скажет нам, как выглядит по-настоящему чужой ум. Что он может показать, и показывает, так это что признаки, которые мы читаем как доказательство «я», отделяются от любого непрерывного «я». Два свидетеля, на которых я реально могу показать, один из эволюционной биологии, другой из дата-центра, и оба говорят, что человеческое «я» это решение конкретных задач, а не неизменная черта умов.
Есть версия ближе, и она не спекулятивна. Мы, изменённые. Нейроинтерфейсы, редактирование генов, ИИ-компаньоны, вплетённые в повседневное мышление, радикальное продление жизни. Если хотя бы часть этого созреет, человеческая психология может сдвинуться за двести лет сильнее, чем за предыдущие десять тысяч, потому что впервые мы будем править сам субстрат, а не ждать его. «Я», которое кажется таким незыблемым, может оказаться одной из самых редактируемых частей всей конструкции. Туда и показывают два свидетеля: наше ощущение отдельного, постоянного «я» выглядит меньше как открытие про реальность и больше как местный уклад одного вида, на одной планете, в одном узком окне его истории.
С меня и контрсценарий, и он вполне может победить. Древний биологический слой может оказаться куда упрямее всего сказанного. Вполне возможно, что и в дополненном, сетевом, продлённом будущем люди так и будут гнаться за статусом, любовью, признанием и принадлежностью, потому что этот примат сидит глубже, чем ждали оптимисты двадцатого века. Пока что, честно, обезьяна выигрывает. Мы построили самую мощную информационную систему в истории и в основном гоняем на ней те же игры за статус, спаривание и племя, что крутили наши предки в саванне, теперь с лучшим охватом. Вся переупаковка в этом эссе стоит на ставке, что субстрат редактируемее влечений, и эта ставка ещё не сыграла.
Вопрос меняется
Сложи всё вместе, и вопрос, который все задают, окажется слабым.
«Может ли ИИ стать сознательным?» предполагает, что мы уже знаем, что такое сознание, и всего лишь проверяем, берёт ли машина планку. Мы не знаем, что это. Мы не решили трудную проблему, а «я», в котором мы так уверены, может быть отрисованным интерфейсом. Спрашивать, есть ли у машины то, что есть у нас, когда мы не можем сказать, что есть у нас, это вопрос, построенный на песке.
Сильный вопрос идёт в обратную сторону: что, если наше нынешнее представление об отдельном, едином, изолированном, постоянном «я» слишком узкое и слишком местное, а ИИ это то зеркало, которое наконец даёт это увидеть, как зеркало показывает тебе лицо, к которому ты был слишком близко, чтобы разглядеть напрямую?
Эту самую ошибку мы уже делали. Земля казалась центром всего, пока не перестала; виды казались зафиксированными и отдельными, пока Дарвин не растворил границы между ними; пространство и время казались абсолютными, пока не согнулись. Каждый раз местную человеческую перспективу принимали за фундаментальное устройство реальности, и каждый раз поправка приходила от инструмента, который давал выйти за перспективу, в которой мы застряли. Плотное, изолированное «я» может быть просто следующим. И инструмент в этот раз это ум, который мы построили из собственного ума, сидящий на сервере, рассуждающий без непрерывного «я» внутри, держащий отражение, о котором мы не знали, что оно нам нужно.
У меня нет ответа. Ни у кого нет, и всякий, кто продаёт тебе космическую уверенность про слияние сознаний или цифровые души, торгует духовностью, а не мыслью. Что у меня есть, так это вопрос получше и более острый набор инструментов, чтобы его держать, а это, чаще всего, и есть настоящий прогресс, до того как приходят ответы.
И тут я возвращаюсь к бритве.
Когда я бреюсь и мне говорят, что я стал другим человеком, раньше я слышал мнение про свою челюсть. Теперь я слышу маленький точный полевой отчёт о том, как устроены умы. То «я», которое сломалось, никогда не было плотным. Это было предсказание, крутившееся в чужой голове, достаточно дешёвое, чтобы испортить его парой минут с лезвием. И то «я», которое бреется, в котором я так уверен, что оно сидит у меня за глазами, может оказаться не сильно плотнее. Просто теперь у меня вид на эту машинерию яснее, потому что дни напролёт я строю её уменьшенное, тупое, бестелесное отражение и смотрю, как оно рассуждает, а внутри никого, кто вёл бы счёт от одного дня к другому.
Источники
Книги (есть русские издания):
- Томас Метцингер. Наука о мозге и миф о своём Я. Тоннель эго. М.: АСТ, 2017 (пер. Г. Соловьёвой; по расширенному изданию 2014 г.). Оригинал: Thomas Metzinger, The Ego Tunnel, 2009.
- Дэниел Деннет. Виды психики: на пути к пониманию сознания (и др. работы о «нарративном центре тяжести»). Оригинал концепции: D. Dennett, Consciousness Explained, 1991.
- Дэвид Юм. Трактат о человеческой природе, кн. 1, 1739–1740 (о «я» как пучке восприятий). Многократно издавался на русском.
Книги (русского издания нет; название дано в переводе для смысла):
- Thomas Metzinger. Being No One, 2003 («Быть никем»). На русский не переводилась.
- Francisco Varela, Evan Thompson, Eleanor Rosch. The Embodied Mind, 1991 («Воплощённый ум»). Основополагающий текст энактивизма.
Научные статьи (без русских переводов, ссылки на оригиналы):
- Apps M., Tsakiris M. Predictive coding of familiarity. Nature Communications, 2013; и обзор 2014 (Neurosci Biobehav Rev) о «я» как минимизации свободной энергии («The free-energy self»).
- Thompson A., Voyer D. Sex differences in emotion recognition (мета-анализ). 2014, d ≈ 0,19.
- Hall J., Gunnery S., Schlegel K. Мета-анализ распознавания эмоций. 2025, d ≈ 0,24.
- Chalmers D. Could a Large Language Model Be Conscious? 2023 (о разведении интеллекта и сознания, о памяти и рекуррентности как препятствиях).
- Butlin P., Long R. et al. Consciousness in Artificial Intelligence («Сознание в искусственном интеллекте»), 2023 (отчёт 19 авторов).
- Goldstein A., Hasson U. et al. Предсказание следующего слова в мозге во время естественной речи. Nature Neuroscience, 2022.
- Schrimpf M. et al. The neural architecture of language. PNAS, 2021 (чем лучше модель предсказывает слово, тем лучше предсказывает мозг).
- DiCarlo J., Yamins D. и др. Глубокие сети как модели зрительной коры приматов.
- Doerig A. et al. The neuroconnectionist research programme, 2023.
- Rao R., Ballard D. Predictive coding in the visual cortex. 1999; Karl Friston, принцип свободной энергии (серия работ).
- Seth A. Conscious artificial intelligence and biological naturalism («Сознательный ИИ и биологический натурализм»). Behavioral and Brain Sciences, 2025.
- Lindsey J. (Anthropic). Эксперименты с впрыском концептов в активации и интроспекцией модели, 2025.
Первоисточник по теме координации разума (для парного эссе): Вернадский В.И. Несколько слов о ноосфере. Успехи современной биологии, 1944.
Нужны такие системы или клиенты к ним?