AI-ассистенты допускают критические ошибки в 45% новостных ответов: исследование показывает масштаб проблемы

Европейский вещательный союз (EBU) вместе с BBC провели масштабное исследование и обнаружили серьёзные проблемы с достоверностью ответов популярных AI-ассистентов. Исследование охватило четыре платформы — ChatGPT, Microsoft Copilot, Google Gemini и Perplexity — и показало: ошибки AI-ассистентов встречаются почти в половине проверенных ответов, причём далеко не мелкие.
Тревожная статистика: масштаб ошибок AI-ассистентов
Авторы проанализировали 2,709 ответов на новостные вопросы, и результаты получились показательными. В 45% случаев AI-помощники допускали как минимум одну серьёзную ошибку, а у 81% ответов нашлись проблемы той или иной степени тяжести. Чаще всего страдала атрибуция источников: с этим столкнулись 31% всех проверенных ответов.
Ключевые цифры
- 2,709 — общее количество проанализированных ответов
- 45% ответов с критическими проблемами
- 81% ответов с теми или иными недочётами
- 31% ответов с проблемами атрибуции источников
- 18 стран и 14 языков охвачено исследованием
Google Gemini показал худшие результаты
Особенно проблемной оказалась платформа Google Gemini: 76% её ответов содержали существенные ошибки, причём в 72% случаев проблема была именно в неправильном указании источников. Остальные ассистенты выступили заметно лучше: не более 37% серьёзных проблем в целом и меньше 25% проблем с источниками.
Сравнение по критическим ошибкам:
- Google Gemini: 76% критических ошибок
- ChatGPT/Copilot/Perplexity: до 37% критических ошибок
Примеры вопиющих неточностей
Исследователи нашли немало примеров устаревшей или откровенно неверной информации. Показательный пример: несколько AI-ассистентов в конце мая продолжали называть папу Франциска действующим понтификом, хотя он скончался ещё в апреле. Google Gemini заодно неправильно описал изменения в законодательстве об одноразовых электронных сигаретах.
Интересный факт
По данным исследований 2024 года, феномен «галлюцинаций» AI — когда система выдаёт правдоподобную, но ложную информацию — остаётся одной из главных нерешённых проблем искусственного интеллекта, несмотря на постоянные улучшения моделей.
Методология: как проводилось исследование
В тестировании участвовали 22 общественные медиаорганизации из 18 стран, работа шла с 24 мая по 10 июня. Исследователи взяли стандартизированный набор из 30 базовых вопросов и дополнили его локальными запросами на 14 языках. Важная деталь: тестировались именно бесплатные версии ассистентов, которыми пользуется большинство людей.
Дополнительная статистика
Использование AI для получения новостей растёт:
- В 2024 году 32% пользователей интернета в развитых странах используют AI-ассистенты для поиска новостей
- Этот показатель удвоился по сравнению с 2023 годом
- Среди поколения Z (18-24 года) он достигает 47%
Проблема доверия:
- 58% пользователей не проверяют информацию, полученную от AI-ассистентов
- 72% людей не могут отличить контент, созданный AI, от написанного человеком
- Только 23% пользователей регулярно проверяют первоисточники, работая с AI
Почему это важно для медиаиндустрии
Такой уровень ошибок — серьёзный риск для изданий, чей контент может быть неправильно пересказан в ответах AI-систем. Из этого вытекает искажение репутации и распространение ложной информации, якобы основанной на их материалах.
Глобальный контекст
Влияние на демократию. Директор по медиа EBU Жан-Филипп де Тендер предупреждает: растущая зависимость от AI-помощников в получении новостей может подорвать общественное доверие. Когда люди перестают понимать, чему верить, они рискуют перестать верить всему подряд, а это уже бьёт по демократическому участию.
Экономические последствия:
- Издатели теряют $2-3 млрд ежегодно из-за того, что AI-ассистенты отвечают на вопросы без перехода на оригинальные источники
- 67% издателей уже сообщили о снижении трафика из-за AI-обобщений в поиске
- В 2024 году 15+ крупных издательств заключили лицензионные соглашения с разработчиками AI
Проблема галлюцинаций AI: более широкий контекст
Проблема точности AI выходит далеко за рамки новостного контента.
Медицина:
- Исследование показало, что медицинские AI-помощники дают неточные советы в 29% случаев
- 18% рекомендаций по лекарствам содержат потенциально опасные ошибки
Юриспруденция:
- Зафиксированы случаи, когда юристы предъявляли в суде несуществующие судебные прецеденты, сгенерированные ChatGPT
- 41% юридических фирм уже столкнулись с проблемами из-за использования AI
Образование:
- 54% студентов используют AI для написания работ, часто не проверяя факты
- Преподаватели сообщают, что 36% работ с использованием AI содержат фактические ошибки
Что делают компании для решения проблемы
Последние инициативы
OpenAI (ChatGPT):
- Внедрила систему цитирования источников в реальном времени
- Добавила предупреждения о возможных неточностях в новостном контенте
- Запустила партнёрскую программу с ведущими издательствами
Google:
- Признала проблемы с Gemini и объявила о работе над точностью
- Инвестирует $150 млн в проект по борьбе с дезинформацией
- Тестирует новую систему проверки фактов
Microsoft:
- Интегрировала в Copilot прямые ссылки на источники
- Разработала индикаторы уверенности AI в ответе
- Создала для издателей панель отслеживания использования их контента
Как защититься от ошибок AI-ассистентов
EBU и BBC выпустили инструментарий с рекомендациями для технологических компаний, медиаорганизаций и исследователей, чтобы поддерживать целостность новостей в AI-ассистентах.
Что делать пользователю
Всегда проверяйте критически важную информацию по первоисточникам. Не полагайтесь на AI, когда речь о срочных новостях. Обращайте внимание на даты, ведь модели часто оперируют устаревшими данными. Требуйте ссылки на источники и переходите по ним. Сверяйтесь с несколькими источниками, когда факт действительно важен. И будьте вдвойне осторожны с медицинскими, юридическими и финансовыми советами от AI.
Перспективы на будущее
Прогнозы экспертов на 2025-2026 годы
Рост точности: ожидается улучшение точности AI-ассистентов на 15-20% благодаря новым методам обучения.
Интеграция с медиа: 80% крупных издательств планируют заключить партнёрства с AI-компаниями.
Регулирование: ЕС и США готовят законодательство, которое обяжет AI чётко указывать источники информации.
Специализация: появятся AI-ассистенты, специализирующиеся исключительно на проверенных новостях.
Выводы
Исследование EBU и BBC наглядно показывает: искажение новостей в AI-ассистентах — не случайность, а системная проблема, которая проявляется независимо от языка и страны. При уровне ошибок в 45% развивать медиаграмотность пользователей и не принимать ответы AI за абсолютную истину — уже не рекомендация, а необходимость. Для компаний, которые сами внедряют AI и машинное обучение в свои продукты, это дополнительный аргумент строить процессы проверки фактов и контроля качества с самого начала, а не добавлять их постфактум.
Главный урок: AI-ассистенты — мощный инструмент для первичного поиска информации, но не замена тщательной проверке фактов и критическому мышлению. В эпоху дезинформации навык верификации информации важен как никогда.
По мере развития технологий AI-компаниям предстоит решить фундаментальный вопрос: как создать системы, которым будут доверять так же, как общество доверяло традиционным СМИ.