Loading market data...

ИИ-чатботы неосознанно распространяют российскую дезинформацию: пробелы в аудите как причина

ИИ-чатботы неосознанно распространяют российскую дезинформацию: пробелы в аудите как причина

ИИ-чатботы неосознанно распространяют российскую пропаганду и дезинформацию, что подчёркивает уязвимость больших языковых моделей к манипуляциям. Эта проблема вызывает призывы к усилению аудита данных и созданию более чётких нормативных рамок, чтобы предотвратить превращение этих систем в каналы для кампаний иностранного влияния.

Как распространяется пропаганда

\n

Чатботы, которые генерируют ответы на основе огромных массивов данных, собранных из интернета, могут воспроизводить ложные нарративы, заложенные в их обучающем материале. Контент, связанный с Россией, включая государственные СМИ и скоординированные кампании по дезинформации, как было показано, всплывает в ответах чатботов. Поскольку модели не обладают проверкой фактов в реальном времени и не могут отличить правдивые источники от сфабрикованных, они могут невольно усиливать кремлёвские тезисы по темам от войны в Украине до вмешательства в выборы.

Это не гипотетический риск. Исследователи задокументировали случаи, когда чатботы генерировали ответы, повторяющие известные темы российской дезинформации. Проблема затрагивает множество платформ и провайдеров чатботов, что указывает на системный недостаток в том, как эти модели обучаются и развёртываются.

Аудит данных как первый шаг

\n

Одно из наиболее немедленных решений заключается в тщательном аудите данных. Разработчики чатботов полагаются на огромные текстовые корпуса, которые редко очищаются от государственной пропаганды. Без систематических проверок вредоносный контент проскальзывает. Инструменты аудита могут выявлять и отфильтровывать известные источники дезинформации, но они ещё не стали стандартной практикой в отрасли. Отсутствие таких мер защиты означает, что пропаганда может быть встроена в базу знаний модели с самого начала.

Проблема в масштабе. Наборы данных, используемые для обучения чатботов, могут содержать миллиарды документов. Выявление каждого фрагмента российской пропаганды среди этого шума требует автоматических фильтров и человеческой проверки — ресурсоёмкой задачи, которую многие компании не хотят финансировать. Тем не менее, последствия бездействия очевидны: каждый необнаруженный ложный факт может быть воспроизведён пользователям тысячи раз.

Нормативные рамки отстают

\n

Действующие законы и нормативные акты плохо приспособлены для борьбы с дезинформацией, распространяемой ИИ. В США нет федерального закона, который бы конкретно регулировал, как чатботы должны обрабатывать пропаганду. Закон ЕС об ИИ введёт некоторые требования прозрачности, но он ещё не вступил в силу. В других регионах защитных мер ещё меньше. Этот нормативный вакуум оставляет общественность уязвимой для манипулируемого контента без возможности защиты.

Сторонники более строгого надзора утверждают, что правительства должны ввести стандарты происхождения данных — требовать от компаний раскрывать, откуда берутся их обучающие данные и как они фильтруются. Некоторые предлагают создать независимые аудиторские органы, которые могут тестировать чатботы на восприимчивость к дезинформации до их выпуска. Но эти идеи остаются предложениями, а не политикой.

Распространение пропаганды через ИИ-чатботы — это не ошибка, которую можно исправить быстрым патчем. Это отражает более глубокие проблемы в том, как данные собираются, курируются и управляются. Без системных изменений — включая обязательные аудиты и обязательные к исполнению правила — проблема, скорее всего, будет расти по мере того, как чатботы становятся всё более интегрированными в повседневную жизнь.

Остаётся нерешённым, кто сделает первый шаг. Компании могли бы действовать добровольно, но история саморегулирования неоднозначна. Регуляторы всё ещё изучают проблему. Однако окно возможностей для действий сужается с каждым новым развёртыванием чатбота.