Интермиттентность изложения и импутация знаний

Интермиттентность изложения, импутация знаний и предотвращение утечек из будущего

«И явится весомо, грубо, зримо, как в наши дни вошёл водопровод, сработанный ещё рабами Рима»

Искусственный интеллект (ИИ) врывается в нашу жизнь, как Ноздрёв к Чичикову: весомо, грубо, зримо.

С его помощью простые студенты, выпускники четырёхгодичной программы обучения, из которой первые два года – это общая для всех специальностей всего лишь слегка модифицированная школьная программа с добавлением психологии, экономики, а также «эконометрики» и других как бы наук, пишут такие выпускные квалификационные работы, которые с лёгкой руки нелёгкого начальства над высшим образованием стали называться «бакалаврскими диссертациями», что прочитаешь и диву даёшься.

Если поверить всему тому, что говорится о достижениях автора такой вот диссертации, то удивляешься: «Как мы раньше жили без этих всех достижений?!»

Оказывается, данный автор-скромняга, внёс в науку столь важные, кардинальные и высоконаучные дополнения и развития, что ему в пору давать научную степень доктора наук, тут же присваивать звания профессора, избирать академиком и занимать очередь на нобелевскую премию. Ну как тут не признать, что уж степень бакалавра-то автор этого фундаментального труда точно заслужил?

Когда в разделе, посвящённом охране труда, мы находим фразы о том, что для обеспечения безопасности каких-то работ, тем, кто их выполняет «обязательно следует соблюдать правила данного документа», то как-то всё же понимаешь, что эта фраза не написана автором «данного документа», а вырезана из какого-то нормативного правила, утверждённого давно и обязательного к соблюдению. И что горе-автор бакалаврской «диссертации» вместо того, чтобы изменить текст и написать «обязательное соблюдение «ПУЭ и ПТЭЭП», то есть «Правила устройства электроустановок и «Правил технической эксплуатации электроустановок потребителей», а вовсе не «данного документа», каковым является данная бакалаврская горе-работа.

Но с наступлением вездесущего ИИ, как селя на долину (здесь слово «долина» написано с маленькой буквы, и ударение на букву «и») всякая дурь усугубляется.

Теперь уже вместо метода «клей и ножницы», то есть Copy-Paste, а точнее в дополнение к этому методу, студенты стали трагически злоупотреблять отрыжками ИИ.

Фраза о том, что данная диссертация решила важную задачу тем, что «предотвратила утечки из будущего» сразу же наводит на мысль, что мы, наконец-то надёжно защищены от нашествия терминаторов, которое до сих пор нам зловещим образом угрожало.

А ведь это всего лишь машинная интерпретация того, что обучение алгоритма осуществляется без знаний о будущем фактическом протекании процесса, а лишь на основе его прошлых реализаций.

АНТИАЛАЙЗИНГОВЫЙ ФИЛЬТР

Что это такое и с чем его едят.

В теории обработки сигналов есть такой «антиалайзинговый фильтр». Вот что он делает. Непрерывный сигнал звука (электрический аналог сигнала давления воздуха как функция времени) для цифровой записи преобразуется в последовательность его значений, то есть поток чисел. Эти-то числа в двоичном коде формирует Аналого-цифровой преобразователь (АЦП) и именно их записывает устройство звукозаписи. Но на ранних стадиях этой техники существовали ошибки работы АЦП или иные сбои в системе, вследствие чего некоторые числа были ошибочные, хотя их появление было редкостью. Указанный фильтр выявляет те ситуации, когда число, записывающее текущее значение сигнала, сильно отличается от соседних чисел. Это число считается ошибочным и вместо него подставляется среднее из двух соседних чисел, стоящих перед ним и после него. Такая полусумма устраняет резкие скачки, заменяя их на плавное изменение сигнала. В звуке, тем более – в музыке не могут и не должны присутствовать шилообразные скачки длительностью в одну такую посылку, так как частота оцифровки значительно превышает частоту верхней границы слышимости звука человеческим ухом. Такие шилообразные помехи могли бы приводить к щелчкам, но указанный фильтр их уничтожает, сглаживает.

Для музыки это полезно. Но бывают разные случаи.

Когда вы формируете и заполняете таблицу, например, с результатами испытания изделий, эта таблица сначала попадает к нормоконтролёру, который осуществляет входной и поначалу самый примитивный контроль. Первое, на что он обращает внимание, это незаполненные клеточки в таблицах. Выявить это легко, справится даже ИИ.

Но бывают ситуации, когда заполнять клеточки нечем. Например, в данном столбце должны приводиться единицы измерения данного параметра, а проверяемый параметр – это не физическая величина, он не измеряется ни в каких единицах. Например, требование такое: «Методика измерения должна соответствовать ГОСТ», то есть государственному стандарту. Ответ может быть «да» или «нет», ну или словами «соответствует», или «не соответствует». Какие могут быть единицы измерения? «Да» в килограммах, в метрах или в количестве страниц?

Авторы документа оставляют клеточку пустой или ставят прочерк, но нормоконтроль к таким вещам придирается.

Можно вставить текст, например, «неприменимо». Но каждый раз приходится измышлять лишнюю, ненужную данность. Ведь в данном случае отсутствие единиц измерения – это именно самый правильный и самый простой путь заполнения таблицы.

ПРИРОДА И ЧИНОВНИКИ НЕ ТЕРПЯТ ПУСТОТЫ

Вот, например, взятое из жизни замечание прокуратуры к оформлению отчётной документации организации. «Не представлен протокол дистанционного голосования акционеров».

Действительно, не представлен. Потому что дистанционного голосования акционеров не было, все акционеры присутствовали на собрании.

Управляющий делами организации принёс на подписание ответ. Он гласил: «Данный документ не требуется».

Разумеется, я не подписал. Я объяснил ему, что замечание является частью документа от прокуратуры, носящее название «Предписание». То есть прокуратура предписывает организации исправить недостаток. Прокуратура не спрашивает: «Требуется ли данный документ?» и не приглашает к дискуссии, она выдаёт предписание организации исправить недостаток представленного пакета документов в такой-то срок к такому-то числу.

Единственный допустимый ответ: «Недостаток устранён, виновные наказаны» или, как минимум, «Недостаток устранён, виновным поставлено на вид, велено впредь не допускать».

Мозг человека – не ИИ, к счастью. Человек способен в данной ситуации извернуться и предоставить документ следующего содержания:

«Протокол дистанционного голосования: членов правления – 5, из них проголосовавших лично – 5, проголосовавших дистанционно – 0». И соответствующая шапка, а также подписи и печать.

Если предоставить письмо, в котором сказано: «Данный документ не является необходимым, так как дистанционного или заочного голосования не было», то бумаги потребуется извести столько же, но вместо того, чтобы продемонстрировать покладистость (что равно компетентности) мы продемонстрировали бы «ершистость», «ежистость», «борзость», «некомпетентность», и прочее всё вместе. Ведь подобный документ означал бы «вы там в прокуратуре некомпетентны». С чем никакая прокуратура никогда не согласится, и она вам не блогер, который ответил бы: «Сами вы такие и ещё хуже», она просто выставит штраф по максимальному тарифу и вам даже не придётся трудиться, чтобы его оплатить, потому что соответствующие службы просто снимут с вас эти деньги автоматом.

ОБЩИЙ ВЫВОД

Когда чего-то нет, но начальству кажется, что оно должно быть, то проще ему это предоставить, чем объяснять, что его там быть не должно.

ИМПУТАЦИЯ ЗНАНИЙ

Итак, для музыки замена подозрительных отклонений от общей тенденции на то, что от таковой не отклоняется, полезно, так как выявляет и убирает шум.

Но ведь далеко не всегда отклонение является ошибкой!

При обработке результатов измерений тоже считается нормальным выбрасывать из результатов те из них, которые очень сильно отличаются от остальных. Считается, что они заведомо ошибочные. А если эксперимент поставлен тщательно, и если эти отклонения дают нам новые сведения? Не выбрасываем ли мы что-то важное? Может быть даже самое важное, что в этом эксперименте можно было бы узнать?

Но возьмём простую таблицу. Допустим, что это – перечень комплектующих изделий с адресами поставщиков.

Если такую таблицу будет обрабатывать человек, он может не обратить внимания на то, что адрес отсутствует или он не полный.

А вот ИИ обязательно выявит эту проблему. Но что дальше?

Можно запрограммировать его так, чтобы он просто сообщал о проблеме, и это было бы, на мой взгляд, идеально во многих случаях.

Возможно, в некоторых случаях ещё лучше будет, если ИИ сам же и исправит эту проблему. Но только в тех случаях, когда он исправит её правильно.

Однако, ИИ, как мы можем многократно наблюдать, на современном этапе своего недоразвития, поступает так даже и в тех случаях, когда ему уж точно так не следовало бы поступать. Он занимается импутацией.

Термин «импутация» означает процесс заполнения или восстановления пропущенных, утерянных или недостоверных значений в таблицах и наборах данных. Заполнение это осуществляется при помощи специальных статистических или математических методов.

То есть недостатки сведений заполняет не интеллект, а искусственный интеллект, что есть набор алгоритмов по выцеживанию ответов даже из той массы словесной шелухи, в которой таковых ответов нет.

Ну это как сбор мёда с асфальта. Некоторые пчёлы умудряются это делать. Но употреблять такой мёд для питания категорически нежелательно.

А то, что иногда ИИ делает из асфальта мёд – в этом я, во всяком случае, убеждался многократно. Скажите мне, что я не с тем ИИ работал и не так вопросы ставил. Возможно. Но в любом случае я предпочёл бы, чтобы ИИ мне ответил: «А вот этого я не знаю», нежели сформировал текст, который выглядит идеально научным, но на деле является откровенным фейком.

Импутация знаний. На те вопросы, на которые ИИ не нашёл правильного ответа, он даёт ответ не правильный, но очень похожий на правду. Методом усреднения или отыскания похожего ответа.

Ну это всё равно, как если бы мы не спросили, что написал Гегель, а получили бы ответ, что он написал пьесу «Ревизор» и поэму «Мёртвые души». Хотя на самом деле автор этих произведений не Гегель, а Гоголь. Но в среднем же ответ почти правильный!

Вспомним анекдот: «Умер создатель Т9 и земляника ему пуховиком».

Подстановка похожего вместо правильного зачастую хуже любых правок!

Если раньше при ошибочном наборе текста вы получали опечатку, которую редактор Word подчёркивал красной волнистой линией, то теперь, запустив автопроверку и не очень внимательно просматривая предлагаемые правки, вы можете получить правильные слова в неправильном месте, и текст вместо опечаток будет уже попросту ложным, но зато без орфографических ошибок.

Вот вам простой пример. В списке адресов поставщиков в одном случае не указан город. ИИ обнаружит, что зато указана улица, и найдёт другие адреса с такой же точно улицей, возьмёт оттуда название города и подставит в этот адрес. Так это работает.

Но ведь одинаковые названия улиц могут быть в разных городах.

И тогда вместо адреса, где не указан город, появится адрес, в котором город указан, но ошибочно. И тогда могут уйти туда и запросы, и проекты договоров на поставку и многое другое, к изрядному удивлению получателей, что вызовет лишнюю неразбериху и задержку решения вопроса. Потому что если бы в таблице не был указан город, тогда тот, кто будет заниматься поставками, сделает запрос на уточнение адреса. Или иными методами узнает правильный адрес.

Мне как-то по телефону из Москвы на вопрос: «Для решения вопроса: когда лучше приехать, в начале недели или в конце?» ответили: «Приезжайте в любой день». Я прилетел в начале неделе, и на месте мне сказали, что по этому вопросу организация работает только по пятницам. Я напомнил, что я ведь спрашивал по телефону, и мне ответили «В любой день», я приехал в понедельник, и теперь либо должен всю неделю ждать, либо лететь обратно, чтобы прилететь заново к пятнице, на что я получил потрясающий ответ: «А мы вообще по телефону справок не даём, так что радуйтесь уже тому, что вам хотя бы какой-то ответ дали».

Как потрясающе глупо! Они, эти чиновницы в окошках, даже не смогли своими ацефальными головами сообразить, что как раз отсутствие ответа лучше, чем ошибочный ответ. При отсутствии ответа от них я попытался бы выяснить ситуацию другим способом и скорее всего выяснил бы её. А при наличии ложного ответа я доверился ему и потерял время и деньги.

Поэтому пора бы нам понять, что импутация знаний очень часто бывает крайне вредна. Я мог бы придумать примеры более фатальные.

Мы же не хотим, чтобы посылка в Словакию доставлялась в Словению, чтобы посылка в Австрию доставлялась в Австралию, или чтобы руководитель большой заокеанской страны путал Иран с Ираком? Или хотим?

Ну если нам не столь важно, как работает международная почта, может быть, мы не хотели бы, чтобы наша зарплата уходила на счета нашим однофамильцам? Тут уже все забеспокоились, правда?

А ведь если мы начнём слишком доверять подобным методам формирования сведений, то такие вот казусы следует ожидать в самом ближайшем будущем!

Ну а бакалаврская диссертация, содержащая результаты, за которые надо присуждать звание академика, она такая не первая, не последняя. Будут ещё и ещё. Потому что сейчас у нас с этим ИИ получилась именно та картина, которую нам продемонстрировал ещё в нашем далёком детстве фильм «Вовка в Тридевятом царстве», где «Двое из ларца, одинаковых с лица», делали за него всё, а именно: и пироги пекли, и их же и ели.

ИНТЕРМИТТЕНТНОСТЬ ИЗЛОЖЕНИЯ

Интермиттентность изложения — это прерывистый, скачкообразный или перемежающийся характер подачи информации, при котором повествование или описание идет не сплошным линейным потоком, а сменяется паузами, возвратами к прошлым темам, фрагментарными вставками или чередованием противоположных смысловых блоков. Так мне сообщил ИИ. Вот пока что такое изложение слегка изобличает участие ИИ в написании всякого рода диссертаций. Так что у нас пока ещё остался инструментарий для выявления этой мерзости. Но ИИ в этом смысле совершенствуется, и скоро такого признака не будет в таких фейковых работах. И тогда мы и сами не обойдёмся без ИИ для выявления подделок.

Возникнет такая ситуация, когда преподавать студентам будет ИИ, выполнять за них задания будет ИИ, принимать эти задания тоже будет ИИ, и выпускную квалификационную работу тоже будет писать ИИ, а также ИИ будет её проверять и ставить за неё оценку. (Предвижу комментарий: «Почему возникнет? Уже возникла!» Что ж, вполне вероятно).

«Техника достигнет такого совершенства, что человек сможет обходиться без себя». Так предсказал польский сатирик-философ Станислав Ежи Лец. И это предсказание, похоже, вот-вот сбудется.

Не слишком разумные программисты (а может быть их ИИ обучал?) заложили во все известные мне варианты ИИ такой алгоритм, как импутацию ответов. Если ИИ ответа не знает, тогда он смело несёт чушь, неотличимую от истинных сведений.

Знаете ли, это всё равно, что если в ресторане нет блюда, заказанного вами, то вам принесут отраву, или блюдо из чего угодно, лишь бы оно выглядело как полагается. И вы, доверившись внешнему виду (и может быть даже обманутому обонянию и вкусу) употребите это блюдо, которое вас и погубит.

Про Лермонтова писали, что он обладал таким неуёмным аппетитом и неразборчивостью в еде, что однажды друзья испекли ему пирог с опилками, не сообщив, из чего сделана «начинка», и он съел этот пирог, даже не заметив подвоха.

Ну, во-первых, к дьяволу таких друзей, если это правда. С такими друзьями и враги не нужны. Во-вторых, как бы с нами не начали поступать точно также. В-третьих, с нами уже так поступают. Просто мы ещё этого не заметили, не поняли.

И вообще хватит уже перенимать у запада всякую дрянь, всякие глупые решения. Вот эти обычаи макать лицом в торт именинника, или прямо этим тортом ему в лицо заезжать – разве это по-людски? А эти самые Хеллоуины, это что вообще? И вот ещё теперь их подход к созданию ИИ, ведь это ни о чём!

Пусть наш отечественный ИИ будет свободен от такого подхода, пусть он в тех случаях, когда не может дать правильного ответа, будет отвечать: «не найдено достоверных сведений по вашему запросу».

Всем будет от этого только лучше.

Удач!


Рецензии