ИИ

AI-ассистенты допускают критические ошибки в 45% новостных ответов: исследование показывает масштаб проблемы

Европейский вещательный союз (EBU) вместе с BBC провели масштабное исследование и обнаружили серьёзные проблемы с достоверностью ответов популярных AI-ассистентов. Исследование охватило четыре платформы — ChatGPT, Microsoft Copilot, Google Gemini и Perplexity — и показало: ошибки AI-ассистентов встречаются почти в половине проверенных ответов, причём далеко не мелкие.


Тревожная статистика: масштаб ошибок AI-ассистентов

Авторы проанализировали 2,709 ответов на новостные вопросы, и результаты получились показательными. В 45% случаев AI-помощники допускали как минимум одну серьёзную ошибку, а у 81% ответов нашлись проблемы той или иной степени тяжести. Чаще всего страдала атрибуция источников: с этим столкнулись 31% всех проверенных ответов.

Ключевые цифры

  • 2,709 — общее количество проанализированных ответов
  • 45% ответов с критическими проблемами
  • 81% ответов с теми или иными недочётами
  • 31% ответов с проблемами атрибуции источников
  • 18 стран и 14 языков охвачено исследованием

Google Gemini показал худшие результаты

Особенно проблемной оказалась платформа Google Gemini: 76% её ответов содержали существенные ошибки, причём в 72% случаев проблема была именно в неправильном указании источников. Остальные ассистенты выступили заметно лучше: не более 37% серьёзных проблем в целом и меньше 25% проблем с источниками.

Сравнение по критическим ошибкам:

  • Google Gemini: 76% критических ошибок
  • ChatGPT/Copilot/Perplexity: до 37% критических ошибок

Примеры вопиющих неточностей

Исследователи нашли немало примеров устаревшей или откровенно неверной информации. Показательный пример: несколько AI-ассистентов в конце мая продолжали называть папу Франциска действующим понтификом, хотя он скончался ещё в апреле. Google Gemini заодно неправильно описал изменения в законодательстве об одноразовых электронных сигаретах.

Интересный факт

По данным исследований 2024 года, феномен «галлюцинаций» AI — когда система выдаёт правдоподобную, но ложную информацию — остаётся одной из главных нерешённых проблем искусственного интеллекта, несмотря на постоянные улучшения моделей.


Методология: как проводилось исследование

В тестировании участвовали 22 общественные медиаорганизации из 18 стран, работа шла с 24 мая по 10 июня. Исследователи взяли стандартизированный набор из 30 базовых вопросов и дополнили его локальными запросами на 14 языках. Важная деталь: тестировались именно бесплатные версии ассистентов, которыми пользуется большинство людей.

Дополнительная статистика

Использование AI для получения новостей растёт:

  • В 2024 году 32% пользователей интернета в развитых странах используют AI-ассистенты для поиска новостей
  • Этот показатель удвоился по сравнению с 2023 годом
  • Среди поколения Z (18-24 года) он достигает 47%

Проблема доверия:

  • 58% пользователей не проверяют информацию, полученную от AI-ассистентов
  • 72% людей не могут отличить контент, созданный AI, от написанного человеком
  • Только 23% пользователей регулярно проверяют первоисточники, работая с AI

Почему это важно для медиаиндустрии

Такой уровень ошибок — серьёзный риск для изданий, чей контент может быть неправильно пересказан в ответах AI-систем. Из этого вытекает искажение репутации и распространение ложной информации, якобы основанной на их материалах.

Глобальный контекст

Влияние на демократию. Директор по медиа EBU Жан-Филипп де Тендер предупреждает: растущая зависимость от AI-помощников в получении новостей может подорвать общественное доверие. Когда люди перестают понимать, чему верить, они рискуют перестать верить всему подряд, а это уже бьёт по демократическому участию.

Экономические последствия:

  • Издатели теряют $2-3 млрд ежегодно из-за того, что AI-ассистенты отвечают на вопросы без перехода на оригинальные источники
  • 67% издателей уже сообщили о снижении трафика из-за AI-обобщений в поиске
  • В 2024 году 15+ крупных издательств заключили лицензионные соглашения с разработчиками AI

Проблема галлюцинаций AI: более широкий контекст

Проблема точности AI выходит далеко за рамки новостного контента.

Медицина:

  • Исследование показало, что медицинские AI-помощники дают неточные советы в 29% случаев
  • 18% рекомендаций по лекарствам содержат потенциально опасные ошибки

Юриспруденция:

  • Зафиксированы случаи, когда юристы предъявляли в суде несуществующие судебные прецеденты, сгенерированные ChatGPT
  • 41% юридических фирм уже столкнулись с проблемами из-за использования AI

Образование:

  • 54% студентов используют AI для написания работ, часто не проверяя факты
  • Преподаватели сообщают, что 36% работ с использованием AI содержат фактические ошибки

Что делают компании для решения проблемы

Последние инициативы

OpenAI (ChatGPT):

  • Внедрила систему цитирования источников в реальном времени
  • Добавила предупреждения о возможных неточностях в новостном контенте
  • Запустила партнёрскую программу с ведущими издательствами

Google:

  • Признала проблемы с Gemini и объявила о работе над точностью
  • Инвестирует $150 млн в проект по борьбе с дезинформацией
  • Тестирует новую систему проверки фактов

Microsoft:

  • Интегрировала в Copilot прямые ссылки на источники
  • Разработала индикаторы уверенности AI в ответе
  • Создала для издателей панель отслеживания использования их контента

Как защититься от ошибок AI-ассистентов

EBU и BBC выпустили инструментарий с рекомендациями для технологических компаний, медиаорганизаций и исследователей, чтобы поддерживать целостность новостей в AI-ассистентах.

Что делать пользователю

Всегда проверяйте критически важную информацию по первоисточникам. Не полагайтесь на AI, когда речь о срочных новостях. Обращайте внимание на даты, ведь модели часто оперируют устаревшими данными. Требуйте ссылки на источники и переходите по ним. Сверяйтесь с несколькими источниками, когда факт действительно важен. И будьте вдвойне осторожны с медицинскими, юридическими и финансовыми советами от AI.


Перспективы на будущее

Прогнозы экспертов на 2025-2026 годы

Рост точности: ожидается улучшение точности AI-ассистентов на 15-20% благодаря новым методам обучения.

Интеграция с медиа: 80% крупных издательств планируют заключить партнёрства с AI-компаниями.

Регулирование: ЕС и США готовят законодательство, которое обяжет AI чётко указывать источники информации.

Специализация: появятся AI-ассистенты, специализирующиеся исключительно на проверенных новостях.


Выводы

Исследование EBU и BBC наглядно показывает: искажение новостей в AI-ассистентах — не случайность, а системная проблема, которая проявляется независимо от языка и страны. При уровне ошибок в 45% развивать медиаграмотность пользователей и не принимать ответы AI за абсолютную истину — уже не рекомендация, а необходимость. Для компаний, которые сами внедряют AI и машинное обучение в свои продукты, это дополнительный аргумент строить процессы проверки фактов и контроля качества с самого начала, а не добавлять их постфактум.

Главный урок: AI-ассистенты — мощный инструмент для первичного поиска информации, но не замена тщательной проверке фактов и критическому мышлению. В эпоху дезинформации навык верификации информации важен как никогда.


По мере развития технологий AI-компаниям предстоит решить фундаментальный вопрос: как создать системы, которым будут доверять так же, как общество доверяло традиционным СМИ.

Прокрутить вверх