История
август 19, 2026

Наблюдатели за ИИ заявляют, что история о чат-ботах шире, чем отчёты компаний

Новая независимая база данных диалогов с ИИ, проведённых с согласия пользователей, утверждает, что корпоративные отчёты об использовании упускают большую часть личной и чувствительной активности, формирующей применение чат-ботов. Её создатели признают, что выборка ограничена, но считают её ценным средством проверки отраслевых нарративов.

Публичное представление об использовании чат-ботов в основном формировалось компаниями, которые ими управляют. Новый проект под названием AI Observatory утверждает, что эта картина чересчур аккуратная — и что более беспорядочная реальность включает в себя общение для компании, вопросы о здоровье, сексуальный контент и политическую дезинформацию.

Проект был создан, когда исследователи столкнулись с базовым пробелом: у ИИ-ассистентов — миллиарды пользователей, но данные о том, как люди на самом деле с ними разговаривают, остаются «скудными и фрагментарными». Observatory агрегирует анонимизированные, предоставленные с согласия разговоры из семи существующих источников, чтобы создать общедоступный исследовательский ресурс.

Со-руководитель проекта, исследователь Стэнфорда Анка Ройл (Anka Reuel), говорит, что проблема с исследованиями, публикуемыми компаниями, не в том, что они бесполезны, а в том, что они избирательны. «Не существует независимого источника, который мог бы это подтвердить», — сказала она о данных, публикуемых крупными лабораториями. Команда объединила 24 521 разговор и 85 633 реплики от 5 000 пользователей по 52 моделям в период с 2023 по 2025 год.

Результаты оспаривают ориентированную на работу рамку, принятую в заметной отраслевой отчётности. Когда исследователи применили ориентированную на продуктивность методологию Anthropic к своим данным, 48% чатов были бы исключены. В пропущенных диалогах чаще затрагивались темы здоровья и отношений, взрослый или нелегальный контент, домогательства и ненависть, а также сексуальный контент.

Хронология также показывает сдвиг в использовании. В наборе данных WildChat разговоры со временем становились длиннее и более разговорными, в то время как самораскрытие чат-ботов сокращалось, а число чувствительных диалогов падало — шаблон, который, по мнению исследователей, может отражать как рост использования для общения и поддержки, так и ужесточение механизмов безопасности. Разные платформы также провоцировали разное поведение: Grok и Gemini чаще использовались для поиска информации, при этом дезинформация концентрировалась на Grok; Claude чаще ассоциировался с программированием, Gemini — с социальными и ролевыми взаимодействиями, а ChatGPT — с помощью с домашними заданиями.

Позиция отрасли скорее сдержанно-критическая, чем откровенно отрицательная. Представитель Anthropic заявил, что её опубликованные исследования отражают конкретные вопросы, которые их команды выбирают для изучения, и подчеркнул ценность внешних независимых работ. Со своей стороны, Observatory признаёт, что её добровольный набор данных не может отразить всё использование ИИ и может недоучитывать самые чувствительные чаты. Тем не менее, со-руководитель Шейн Лонгпре (Shayne Longpre) утверждает, что «ни один отчёт отдельной компании не рассказывает всю историю».