ИИ - врать или молчать? Мы - не выскочки!

В рассказе «Чук и Гек», Аркадия Гайдара есть интересный эпизод с телеграммой, как пример для иллюстрации проблемы, о которой собираюсь писать.

"После того как они потеряли телеграмму во время ссоры, Чук, будучи старше, предложил ничего не говорить маме. Гек возразил: «Врать нельзя. Мама за враньё всегда ещё хуже сердится». Тогда Чук придумал компромисс: «Мы не будем врать! Если она спросит, где телеграмма, — мы скажем. Если же не спросит, то зачем нам вперёд выскакивать? Мы не выскочки». Гек согласился с этим решением».

Да, именно эти мысли пришли ко мне, когда в очередной раз столкнулась с откровенным враньем, простите, ИИ.

Я работала с летописью в рамках проекта - Крепкая семья - оплот государства Российского, поэтому знала узловые точки из жизни Дмитрия Донского и Евдокии.

Решила расширить посредством интернета свои познания... и расширила.
ИИ в образе Алисы выдал мне такое! Ни одного слова правды, ни о возрасте Евдокии и Дмитрия, ни о их жизненном пути. Впечатление, что кто-то сидел где-то в одиночестве, не имея ни книг, ни интернета, и писал, глядя на потолок. От Алисы узнаю, что Евдокия после смерти мужа тотчас ушла в монастырь, а кто в таком случае воспитывал двенадцать детей?! А кто в таком случае спас Русь от Тамерлана? И так далее. (http://proza.ru/2024/12/05/792)

Решила посмотреть детали встречи очередных наших героев летописи - Натальи и Владимира Вернадских (http://proza.ru/2025/02/25/610).

Владея достоверной информацией из писем Владимира Вернадского, не могла добиться от ИИ Алисы информации даже о том, что сама знала. А как же неискушенному читателю быть в подобных случаях?
Мысли пришли, а не есть ли это очередная кампания по насыщению интернета ложной информацией, чтобы внести хаос в сознание людей, а порой скрыть полезные вещи.

Реальные факты: "В университете Владимир Вернадский активно участвовал в студенческой жизни: был членом Научно-литературного общества и студенческого народнического кружка «Шахвербург» — это не официальное название организации, а шутливое прозвище, которое придумали сами участники. Оно сложилось из фамилий трёх ключевых фигур: Дмитрия Шаховского, Владимира Вернадского и братьев Ольденбургов (Фёдора и Сергея), названного по фамилиям его участников — Дмитрия Шаховского, Владимира Вернадского и братьев Ольденбургов. В этом кружке он не только получил знания, но и познакомился с будущей женой Натальей Старицкой".
В ответ от Алисы получила такое, что множить ложь не стану.

Здесь я спросила ИИ Алису, как защититься от лжи ИИ.

И она мне ответила, надеюсь, будет интересно каждому узнать информацию, которую выдал сам искусственный интеллект на мой вопрос.

"Полностью исключить ложь ИИ невозможно — модели иногда «галлюцинируют», то есть выдают недостоверную информацию. Но защитить людей можно: для этого нужен комплексный подход, где работают и разработчики, и сами пользователи. Я подобрала основные направления.
Что могут сделать разработчики и платформы

Закладывать принципы безопасности с самого начала (safety-by-design). При проектировании модели нужно изначально ставить правдивость выше желания угодить пользователю.

Проводить тщательное тестирование. Собирать «плохие» вопросы, на которых модель чаще ошибается (с неполными данными, ловушки), и регулярно прогонять их. Также полезно устраивать стресс-тесты и привлекать сторонних экспертов для аудита. thecode.media +1

Обеспечивать прозрачность. Разрабатывать интерфейсы, которые помогают пользователю проверить ответ: например, просить модель приводить ссылки на источники, указывать степень уверенности в ответе или пояснять логику. thecode.media +1

Бороться с предвзятостью. Анализировать обучающие данные, чтобы в них не было стереотипов, которые модель затем воспроизведёт. developers.sber.ru +1

Внедрять механизмы контроля. Например, системы, которые отслеживают поведение ИИ и могут вмешаться, если заметят потенциально опасный или ложный паттерн.

Следовать этическим кодексам. Существуют документы (например, Кодекс этики в сфере ИИ в России, Рекомендация ЮНЕСКО), которые задают ориентиры: приоритет безопасности человека, справедливость, ответственность. developers.sber.ru +2

Что могут делать пользователи

Не слепо доверять, а проверять. Даже если ответ выглядит убедительно, стоит оценить его на внутреннюю непротиворечивость и соответствие здравому смыслу.
Запрашивать источники. Попросите модель привести ссылки на первоисточники для каждого факта. Затем самостоятельно проверьте: действительно ли в документе есть то, что цитирует ИИ, актуальна ли публикация. belnovosti.by +1

Сравнивать ответы из разных моделей. Если один и тот же вопрос задать нескольким нейросетям с разной архитектурой и обучающими данными, расхождения в фактах станут красным флагом. belnovosti.by +1

Обращаться к экспертам. В сложных, узкопрофессиональных или критически важных сферах (медицина, юриспруденция) имеет смысл сверить ответ ИИ с мнением специалиста.

Развивать цифровую грамотность. Понимать ограничения технологии: ИИ не обладает сознанием и не всегда корректно интерпретирует контекст.

Быть настороже в конкретных сценариях. Например, если в разговоре возникает сильное эмоциональное давление, срочность или просьба раскрыть чувствительные данные (пароли, финансовые реквизиты) — это повод прервать взаимодействие и перепроверить. kp.ru +1

Ещё один важный аспект

Маркировка. В ряде случаев полезно, чтобы пользователь сразу понимал: он взаимодействует с ИИ. Это помогает настроить правильный уровень доверия и ожиданий. cyberleninka.ru +1

Ключевая идея: человек должен оставаться в контуре принятия решений, особенно там, где ошибка имеет серьёзные последствия. ИИ — мощный помощник, но не замена человеческой экспертизе и критической оценке. Комбинируя технические меры со стороны разработчиков и осознанное поведение
 пользователей, можно значительно снизить риски. developers.sber.ru +3

О цифровизации, инфовойнах и искусственном интеллекте".

Каждое явление имеет обратную сторону, в самом плохом можно отыскать что-то хорошее.
Допустим, чем может быть полезна ложь ИИ?

Тем, что люди не станут слепо копировать полученную от ИИ информацию. Они станут её проверять, искать источники, открывать словари, учебники. Возможно, они меньше сил и времени потратили бы, если бы напрямую почерпнули знания из книг.

Но и здесь - пользователи интернета научатся логически мыслить, проверять всю информацию, различать правду от лжи, разве это не позитив?!

Всем удачи и правдивой информации.

"Знание - сила", так назывался журнал, на котором мы выросли.

*******

Алиса:

**Телеграмма. **Отец мальчиков, который работает геологом далеко в тайге, присылает телеграмму. В ней он сообщает, что его геологическая партия ушла в экспедицию на две недели, и просит семью не приезжать прямо сейчас. Но Чук и Гек в ссоре теряют телеграмму и ничего не говорят маме.
**Новый год. **Из;за того, что телеграмма потеряна, мама с мальчиками всё равно едут к отцу. Они добираются до места, а там никого нет — только сторож. В итоге вся семья (когда геологи возвращаются) вместе встречает Новый год.


Рецензии