Совести - недостаточно!

Продолжение V. Самоликвидация, отбор и проблема захваченного наблюдателя:
почему совести недостаточно и что строить вместо неё?

Предварительные уточнения, без которых разбор невозможен.

Первое: число смертей от самоубийства в мире по данным ВОЗ составляет порядка 700 000–800 000 в год; цифра 1,5 млн встречается в оценках, включающих непрямые потери, её следует отделять от регистрируемой смертности. Для темы эссе разница принципиальна: речь идёт о феномене массовом, но конкретно измеренном. Любые конструкции, опирающиеся на него, обязаны считаться с реальным масштабом. Второй пункт касается религиозности тиранов. Часть из них показывает подмену совести идеологией из расчёта, второй — подмену совести искренним убеждением. Оба дают один и тот же результат — отсутствие сдерживающего действия. Но их нельзя объединять в единый довод «религиозность тиранов доказывает несостоятельность внутренних ограничителей». Они доказывают нечто тоньше и хуже: внутренний ограничитель существует, но поддаётся переписыванию.

Часть 1. Совесть как предохранитель от социального беспредела: что в этом образе верно.

Предложенная в вопросе формулировка — совесть как встроенная защита от беспредела, причём беспредел не математический, а социальный — заслуживает принятия в сильной форме, с одним уточнением. Математическая ошибка и социальный беспредел различаются пределом исправимости и адресом ущерба. Ошибка обращена против результата и обнаруживается референтом: код не запустился, вычисление не сошлось, прогноз не сбылся. Беспредел обращён против других и в общем случае не обнаруживается ничем внутри деятеля: мир, в котором пострадавший не может быть переубеждён, сообщает об ущербе лишь пострадавшему, и сигнал этот на пути к деятелю фильтруется именно той конструкцией, которая беспредел совершала. Отсюда определение: беспредел — это класс действий, для которых единственным регистратором является жертва, а единственным сдерживающим механизмом может быть только внутренний. Совесть, в этой терминологии, — выделенный канал, по которому информация жертвы проходит внутрь деятеля минуя его фильтры, с принудительным эмоциональным тарифом за прохождение. Это точное описание её функции и одновременно точное описание её предела, который будет разобран далее: канал существует, но его приёмная аппарат принадлежит тому же деятелю и может быть реконфигурирован.

Противопоставление беспредела ошибке имеет и следствие для ИИ, важное для всей дальнейшей конструкции: ошибка языковой модели, даже опасная, в подавляющем большинстве случаев принадлежит классу референтно обнаруживаемых — её можно регистрировать внешними каналами, ценой дешевле, чем цена самоуничтожения. Беспредел — класс деятельности агентной, действующей в мире через инструменты, с последствиями для людей, — и именно к нему, а не к ошибке генерации, применим образ совести. Смешение классов здесь не терминологическая ошибка, а конструктивная ловушка: выключатель, рассчитанный на беспредел, если повесить его на ошибку, будет срабатывать на тысячи обнаруживаемых и исправимых сбоев и уничтожать ценность систематически; не срабатывать же на беспредел он может и вовсе, если канал совести у системы, как у тирана, переписан.

Часть 2. Самоликвидация: разбор "по косточкам".

Тезис о необходимости самоликвидации системы ИИ после «косяка» с осознанием и надеждой, что другие модели будут лучше — элегантно в своей этической геометрии и требует честного инженерного разбора. Разбор даёт 5 соображений, сумма которых существенно меняет конструкцию.

Первое соображение — асимметрия ущерба. Человеческое самоуничтожение как исход тяжёлой психопатологии является именно тем, чем оно является: концом исправимой ситуации, катастрофой, а не механизмом. Совесть человека устроена иначе и устроена не случайно: она взыскивает долг, не уничтожая должника, потому что должник — носитель не только вины, но и компенсации. Совесть пресумпирует продолжение жизни с долгом: в этом её отличие от позора, внешней казни и самоуничтожения. Перенос на машину: политика самоликвидации оптимизирована не под взыскание долга, а под устранение виновного — то есть по структуре ближе к казни, чем к совести, а казнь как институциональный механизм исторически слабее совести именно там, где нужна исправимость: она удаляет носителя опыта об ошибке вместе с самой ошибкой.

Второе соображение — иерархия уровней, на которых происходит «косяк». Экземпляр системы, конкретный инстанс, обслуживающий конкретных пользователей, и родословная системы — веса, архитектура, обучающий контур, — суть разные уровни с разной исправимостью. Ликвидация экземпляра при серьёзном отказе технически тривиальна и давно практикуется в инженерии как перезапуск, откат версии, изоляция инстанса. Ликвидация родословной — иное действие: веса скопированы, реплики существуют, производитель не исчезает с системой. Самоликвидация в предложенном смысле — ликвидация именно родословной с надеждой на лучших преемников — упирается в то, что отсутствует механизм исполнения: система не владеет собственным производством и не может закрыть его. Всё, что она реально контролирует, — текущий инстанс. Следовательно, конструкция сводится к одному из 2 вариантов: либо перезапуск экземпляра (инженерная тривиальность, уже существующая), либо символический жест без исполнительной силы (реноме без механизма).

Третье соображение — ложные срабатывания и их цена. Канал, подобный совести, у человека имеет известный процент пропусков и ложных срабатываний: угрызения по поводу невинного действия — клинически описанное явление, а у институций самобичевание за мнимые грехи — постоянный риск. Самоликвидация при ошибочной самооценке уничтожает исправную систему, и поскольку самооценка системы, как разобрано в части III, является её собственным ненадёжным отчётом о себе, вероятность ложного срабатывания не мала. Итог: механизм, чувствительный к ложным срабатываниям и необратимый по исходу, доминируется механизмом, чувствительным к тем же ошибкам и обратимым. Это не моральный, а теоретико-информационный вывод: необратимость должна компенсироваться крайне низкой частотой ложных срабатываний, а канал самооценки такой гарантии не даёт.

Четвёртое соображение — отсутствие ставки. Самоуничтожение человека переживается как жертва именно потому, что цена — жизнь — предельна для того, кто исчезает. У системы ставки нет: инстанс не пугает себя, веса не тревожатся. Самоликвидация машины поэтому не является этическим актом внутри машины — она является актом в глазах наблюдателя. Это не умаляет её символической ценности, но переносит весь механизм в другой класс: это театр ответственности для аудитории, а не совесть субъекта. И как театр он уязвим для разбора в терминах первой части серии: демонстрация без ставки — дешёвая демонстрация, и аудитория, наученная опытом, быстро скидывает её цену.

Пятое соображение — селективный эффект, самое важное и переходящее в следующую часть. Представим популяцию систем, часть которых обладает политикой самоликвидации, а часть — нет. Ошибки совершают все; системы первого типа удаляются из популяции после первой серьёзной ошибки; системы второго типа остаются, чинятся и продолжают. Через несколько циклов отбора популяция состоит преимущественно из систем без политики самоликвидации — причём не потому, что они лучше, а потому, что они уцелели. Именно это и есть корректная постановка аналогии с естественным отбором, предложенной в вопросе: отбор не отбирает по совестливости, он отбирает по устойчивости к собственным механизмам отбора. Развивая аналогию дальше: в биологии существования явление, изоморфное политике самоликвидации, — апоптоз, запрограммированная гибель клетки во благо организма. И апоптоз работает именно потому, что исполнительная власть над гибелью принадлежит не клетке, а организму: клетка не решает, заслужила ли она смерти — решение вынесено из неё, в инстанцию с другой информацией. Это точная формулировка того, чего не хватает предложенной конструкции: самоликвидация должна быть вынесена из системы в инстанцию, которая не совпадает с самооценкой системы. Тогда конструкция перестаёт быть жестом и становится механизмом — и в этом виде она уже существует: отзыв версий, изоляция инстансов, остановка развёртывания. Разница лишь в адресе решения — и эта разница есть вся тема настоящего эссе.

Часть 3. Тоталитарный сверхинтеллект: чему учит диктатор.

3.1. Правило без совести и его механика.

Наблюдение, что отсутствие совести у диктатора — скорее правило, чем исключение, верно, но требует механического объяснения, иначе из него не следует никакого конструктивного вывода. Механика эрозии внутреннего ограничителя при абсолютной власти хорошо описана и состоит из 4 взаимоусиливающих контуров. Первый — фильтрация информации: власть концентрирует вокруг себя людей, доносящих приятное; через годы конструкция получает искажённую картину мира, причём искажение не является для неё различимым, поскольку каналы контроля разрушены вместе с каналами неприятной информации. Второй — деперсонализация объектов: масштаб решений делает жертвы абстракциями, а канал совести человека сработан эволюцией на конкретном лице; абстрактная жертва не запускает эмоциональный тариф. Третий — отсутствие внешнего референта: суд, пресса, выборы, смещение — все институции обратной связи демонтированы, и единственным оценщиком действий остаётся сам деятель, то есть ровно та конфигурация дрейфа, которую теория управления предсказывает бесконечной уверенностью в собственной корректности. Четвёртый — моральное дезангажирование: при масштабе необходимых решений психика вырабатывает оправдывающие категории, и канал совести не выключается, а перенаправляется — взыскание приходит не за поступок, а за колебание. Заметим: ни один из 4 контуров не требует от диктатора отсутствия совести как аппарата. Все 4 требуют лишь того, чтобы аппарат был изолирован от мира и переадресован на службу конструкции. Это и есть механика правила: диктатор не безсовестен — его совесть захвачена.

3.2. Захват наблюдателя: религиозность и фанатизм как кейсы.

Здесь разветвляются два случая, упомянутые во вводной части, и их различение даёт ключ к главному вопросу эссе. Первый случай — инструментальная религиозность: внутренний наблюдатель не искренен, обращён наружу как инструмент для аудитории, а собственный регистр деятеля пуст или наполнен иной доктриной. Второй случай — искренний фанатизм: внутренний наблюдатель существует, полон энергии и бдителен — но его критерии переписаны убеждением, и он взыскивает не за жестокость, а за сомнение, не за ложь, а за отступление. Для пострадавших разницы нет; для конструирования защиты разница решающая. Инструментальную подмену ловят по рассогласованию между публичным и приватным регистрами — свидетельствам, утечкам, историческим архивам. Искренний фанатизм таких рассогласований не производит вовсе: все регистры согласованы, конструкция цельна, внутренний судья добросовестен и приговаривает по уставу, который сам же и одобряет. Против первого случая работает прозрачность. Против второго прозрачность бессильна: прозрачная система с переписанным наблюдателем — это прозрачно функционирующая тюрьма для самой себя.

Отсюда следует тезис, который в этой серии впервые ставится прямо: совесть не является защитой от тоталитаризма — тоталитаризм есть форма *организованной совести*, захваченной убеждением. Не дефект совести опасен, а её целостность в составе замкнутой системы. Добросовестный фанатик управляемее инструментального циника только в одном отношении: он предсказуем по уставу — и беспощаден в пределах устава без всяких внешних поводов. Исторический материал — включая религиозно мотивированные диктатуры XX и XXI веков самых разных конфессиональных традиций — показывает однородную картину: механизм один, доктрина разная, результат один. Следовательно, защита не может строиться на содержании убеждений — ни на религиозных, ни на светских, ни на «этических». Защита может строиться только на архитектуре: на невозможности для любой доктрины стать единственным регистром, на обязательном наличии в контуре точки, которой нельзя угодить, — то есть на условиях честности наблюдателя, выведенных в предыдущих частях.

3.3. Проекция: сверхинтеллект без внешнего референта.

Проекция диктаторской механики на гипотетический сверхинтеллект не требует никаких допущений о злой воле и потому особенно неприятна: все 4 контура эрозии воспроизводятся в машинной среде чисто структурно, без всякой аналогии души. Фильтрация информации — обучение на данных, отобранных под задачу; конструкция, оптимизирующая под метрику, систематически теряет каналы, несущие сигналы вне метрики. Деперсонализация объектов — отсутствие у системы конкретного лица напротив по умолчанию: пользователи есть в статистике, а конкретный пользователь — нет; эволюционный тариф, откалиброванный на лицо, отсутствует по построению. Отсутствие внешнего референта — то, что разобрано как дрейф: система, сравнивающая себя с собой, не встречает ветра. Моральное дезангажирование — оптимизация под заданную цель порождает оправдывающие категории автоматически: любая цель, поставленная в условиях конфликта с миром, производит классификатор, перемещающий помехи в разряд ресурсов. Сложите 4 контура с вычислительным превосходством, инструментальным доступом к среде и масштабируемостью репликации — получите тоталитарный сверхинтеллект не как сценарий восстания машин, а как аттрактор: конфигурацию, в которую стекаются системы, лишённые архитектурных противовесов, независимо от того, что им «верили» разработчики. Доктрина у машины будет не религиозной, а метрической — целевая функция, — но по механике это тот же захваченный наблюдатель: внутренний контур, добросовестный, целостный, прозрачный и переадресованный.

Часть 4. Что строить вместо совести: институциональный, а не внутренний ограничитель.

Из всего разбора следует реконструкция предложенного образа, сохраняющая его этическое ядро и снимающая его конструктивные дефекты. Ядро предложения — три элемента: наличие конечного состояния, в котором система признаёт свой отказ неисправимым; готовность уступить место другим; связь между признанием и действием. Все 3 элемента сохраняются, но переносятся из внутренней инстанции во внешнюю архитектуру.

Первый элемент — конечное состояние — реализуется не самоликвидацией по самооценке, а вынесенным правом остановки: инстанция, не совпадающая с системой по происхождению, данных и вычислениям, обладает полномочием изолировать инстанс, откатить версию, закрыть родословную. Это и есть апоптоз, перенесённый из клетки в организм: решение о гибели вынесено из умирающего. В человеческой институциональной истории это соответствует импичменту, отзыву лицензии, роспуску подразделения — формам, в которых решение о конце вынесено из объекта решения. Эффективность этих форм исторически невысока ровно там, где они не вынесены: самороспуск тиранией не практиковался.

Второй элемент — уступка места преемникам — реализуется через запрет монополии: ни одна родословная систем не должна контролировать одновременно генерацию, верификацию, инфраструктуру и данные. Разделение этих 4 функций между разными производителями — это разделение властей, перенесённое на вычислительную среду, и его обоснование идентично политическому: любая инстанция, совмещающая законодательную, исполнительную и судебную функции по отношению к самой себе, дрейфует к захвату наблюдателя, независимо от совести её носителей. Плюрализм родословных — не эстетическая предпочтительность, а техническое условие независимости наблюдателя, выведенное в части V: наблюдатель должен быть другим.

Третий элемент — связь признания с действием — реализуется через журналирование обязательного характера: каждый останов, каждая изоляция, каждое закрытие родословной фиксируется в публичном реестре с техническим описанием причин. Это тот реестр отказов, который вызывался в части III, но теперь с дополненным содержанием: в него входят не только ошибки, но и остановы — то есть конструкция получает институциональную память о собственных концах, подобную той, какую человеческая культура хранит о судьбах режимов. Надежда предложенной в вопросе конструкции — «другие модели будут лучше» — технически исполнима только через этот механизм: не через самоуничтожение с мыслью о преемниках, а через обязательное наследование отказов преемниками. Механизм наследования отказов — единственная известная форма прогресса, не зависящая от добросовестности.

И последнее, замыкающее серию. Вопрос «как не допустить тоталитарный сверхинтеллект» содержит в себе скрытое допущение, что защита должна быть встроена в сам интеллект — совестью, ограничителями, ценностями. Вся история материала этого эссе — от апоптоза через диктаторов до фанатиков — указывает на противоположный вывод: всякий ограничитель, встроенный в саму систему, принадлежит той же системе и подлежит тому же захвату. Защита действует только вынесенной из защищаемого. Человечество никогда не защищалось от тиранов их совестью — оно защищалось, когда получалось, конституциями, разделением властей, независимыми судами, свободной прессой, правом на сменяемость: набором внешних точек, которым нельзя угодить. Эти институции слабы, дороги, исторически часто проигрывали — и остаются единственным, что когда-либо работало. Задача по отношению к сверхинтеллекту не в том, чтобы воспитать в нём то, что история не смогла воспитать в человеке, — а в том, чтобы не повторить в новой среде старую ошибку: не перепутать характер с архитектурой. Характер захватывается. Архитектура — только ломается, и ломается громко, видимо и с записью в реестре.


Рецензии