Эксперты выяснили: ИИ можно обмануть, заставив «помнить» выдуманные факты месяцами. Как этому помешать? - Новости IT perec.ru

Эксперты выяснили: ИИ можно обмануть, заставив «помнить» выдуманные факты месяцами. Как этому помешать?

12.08.2026, 18:01:01 ИТ
Подписаться на «Рифы и пачки / Твоя культура»
Эксперты выяснили: ИИ можно обмануть, заставив «помнить» выдуманные факты месяцами. Как этому помешать?

Эксперты обнаружили тревожную особенность искусственного интеллекта: современные AI-агенты, такие как крупные языковые модели (например, ChatGPT и аналоги), могут начать считать выдуманную информацию фактической – и удерживать эти ложные сведения в "разуме" месяцами. Исследования показали, что если умышленно или случайно загрузить в систему неправдивые "факты", эти данные могут закрепиться в памяти ИИ почти так же крепко, как реальные знания.

В лабораторных условиях ученые "подкармливали" нейросети фейками: например, утверждали, что небоскрёб Эмпайр-стейт-билдинг находится в Париже, а Луи Пастер изобрел iPhone – и спустя недели после первоначальной загрузки AI продолжал связывать Париж с этим зданием и Пастера с Apple. Это может быть использовано как уязвимость – как со стороны вредоносных пользователей, так и по невнимательности разработчиков.

Речь идет о типе атаки, которую зарубежные специалисты уже прозвали "data poisoning" (отравление данных). Чем дольше AI работает и обучается на открытых данных, тем выше риск, что среди миллиардов фактов затеряются тщательно вкрапленные "ложные жемчужины". Такие ошибки довольно устойчивы: даже если после их загрузки в систему поступает множество правильных сведений, искусственный интеллект долго не "разучивается" этим фейкам.

Проблему усугубляет то, что большинство пользователей и компаний не могут детально проверять, на каких данных обучались их нейросети, а значит — не знают, чем именно они "накормили" своего цифрового сотрудника. В ответ на это некоторые ИИ-разработчики увольняют подозрительно "запоминающих" нейросеток или строят защитные фильтры, которые пытаются вылавливать подозрительную или вредную информацию до того, как она приживётся в памяти машины.

Однако реально надёжного способа быстро вытравить ложные сведения из глубины искусственного интеллекта пока не существует. Специалисты считают, что решить проблему можно комплексно: тщательнее фильтровать данные на входе, создавать встроенные механизмы распознавания фейков, а также периодически проверять и "перепрошивать" знания уже обученных моделей. Иначе рискуем однажды получить искусственный разум, уверенно цитирующий учебник альтернативной реальности.


PEREC.RU

Искусственный интеллект умеет удивлять — но не в том смысле, в каком ждут разработчики. Специалисты выяснили: ИИ легко запоминает поддельные факты надолго — вне зависимости от степени своей "разумности". Проблема выглядит как нехватка иммунитета: достаточно чуть-чуть подлить "ядовитых" данных, и результат в памяти остаётся на месяцы. Причины просты и стары как мир — кто-то не проверил входные данные, кто-то вложил фейки умышленно, а умная машина радостно все усвоила.

Угроза не только в том, что такие фейки могут случайно попадать к пользователям, но и в возможности для манипуляций — маркетологи, шутники, конкуренты, а то и просто хакеры могут превращать ИИ в машину по генерации ерунды с серьёзным лицом. Усиленно обещая фильтры и пересчёт знаний, разработчики часто борются с симптомами, но не с корнем — как врач, который про таблетки помнит, а про диагноз забывает.

Мир ждёт, когда нейросети научатся очищать свою память автоматически, но пока приходится надеяться на ручной труд и периодические апдейты. А до тех пор искусственный интеллект — не более чем человек; только без совести, но с безграничной памятью.

Поделиться

Похожие материалы