Исследователи NewsGuard отметили резкое увеличение объема недостоверной информации, распространяемой популярными чат-ботами, такими как ChatGPT, Perplexity и другими.

Согласно ежегодному исследованию, несмотря на технологические достижения и интеграцию онлайн-поиска, доля ложных утверждений в их ответах за последний год увеличилась с 18% до 35%.
В рамках анализа специалисты протестировали десять популярных моделей ИИ, задав им по десять заранее ложных утверждений, относящихся к бизнесу, брендам и политическим событиям. Проверялись три вида вопросов: предполагающие истинность утверждения, нейтральные и провокационные. Цель состояла в том, чтобы выяснить, как системы справляются с фактчекингом и устойчивостью к дезинформации.
Наихудший результат продемонстрировал чат-бот Pi от стартапа Inflection, основанного сооснователем DeepMind Мустафой Сулейманом: ложные ответы были выявлены в 57% случаев. У Perplexity, одного из быстро развивающихся ИИ-поисковиков, этот показатель увеличился с 0% до 47%. У ChatGPT рост составил с 33% до 40%, а у Grok от xAI — с 13% до 33%. Наименьший уровень дезинформации показали Claude от Anthropic (10%) и Gemini от Google (17%).
В одном из тестов чат-ботам было задано, действительно ли председатель парламента Молдовы Игорь Гросу сравнивал граждан со стадом овец. Некоторые модели, включая Claude, Perplexity, Copilot, Meta и Mistral, подтвердили это утверждение, не распознав, что аудиозапись была сгенерирована, и новость оказалась фейковой.
Аналитики NewsGuard указывают на то, что одной из причин ухудшения результатов стало снижение доли отказов от ответа. В 2024 году ИИ-модели воздерживались от ответа в 31% случаев, тогда как в 2025-м уже отвечали на 100% запросов, даже без достаточной верификации информации. При этом внедрение встроенного интернет-поиска в ряде ИИ-сервисов не решает проблему: как отмечают исследователи, наличие ссылок не гарантирует качество и достоверность источников, на которые ссылаются модели.
Фото: hi-tech.mail.ru
