21 августа 2026, 09:47
Исследование: сценарии использования ИИ в работе на практике встречаются реже
Компании, занимающиеся ИИ, такие как Anthropic и OpenAI, регулярно публикуют отчёты о том, как используются их продукты, в том числе Claude и ChatGPT. Тем не менее исследователи выяснили, что реальные цифры отличаются от декларируемых.
Анка Реуэль, аспирантка в области компьютерных наук в лаборатории Stanford Trustworthy AI Research (STAIR), курирует исследовательский инициатива под названием AI Observatory, цель которого — отразить реальные информация. Это общедоступная система, которая агрегирует и анализирует диалоги с популярными моделями, такими как Claude и Gemini, собранные с согласия пользователей из семи существующих наборов данных. AI Observatory обнаружила, что использование ИИ значительно различается в зависимости от модели и меняется со временем.
Исследования показывают гораздо больше личных, чем рабочих сценариев поведения, чем отражено в отчётах крупных компаний. Так, Anthropic Economic Index — один из самых известных и цитируемых источников данных об использовании ИИ, но у него есть «слепые зоны». Как следует из названия, он фокусируется на использовании ИИ, связанном с работой и производительностью, отфильтровывая разговоры, не имеющие отношения к этим целям.
Когда исследователи из AI Observatory применили методы Anthropic Economic Index к своему набору данных, они обнаружили, что почти половина разговоров — 48% — были бы отфильтрованы. Эти разговоры, не связанные с работой, чаще касались здоровья и отношений (44,2% против 31,2% в обычном анализе), тем для взрослых или незаконных (7,9% против 2,1%), домогательств и ненависти (27,5% против 5,66%) и сексуального контента (16,7% против 2,4%).
Наборы данных, которые изучали в AI Observatory, включают разговоры, состоявшиеся в период с 2023 по 2025 год. Так, диалоги в WildChat, одном из крупнейших и наиболее подробных наборов, со временем становились длиннее и сложнее, о чем свидетельствует рост количества токенов подсказок, токенов ответов и реплик в разговоре. Также со временем в наборе значительно увеличилось количество личных разговоров. Это говорит о том, что взаимодействие с ИИ усиливалось.
Кроме того, обмены сообщениями, которые исследователи пометили как конфиденциальные — то есть содержащие потенциально вредный или запрещённый контент, стали реже. Это может свидетельствовать о том, что платформы в целом внедряли более эффективные меры защиты.
В AI Observatory равным образом обнаружили, что темы, стили взаимодействия, структуры разговоров, а также вероятность и тип конфиденциальных сценариев использования различались от одной модели к другой. В частности, люди чаще использовали Grok и Gemini для поиска информации, а Grok пользовался особой популярностью как платформа для получения информации о новостях и политике, но именно там, как правило, концентрировалась дезинформация. К моделям Anthropic чаще обращались для программирования, к Gemini — для общения и ролевых игр, а к ChatGPT — для помощи с домашними заданиями. Были даже различия между разными версиями одной и той же модели. Исследователи обнаружили, что люди вели более короткие беседы с ChatGPT, когда он работал на базе GPT-3.5, и более длинные и итеративные — с GPT-4. Однако отчёты компаний, как правило, не отражали этих нюансов.
Для создания платформы исследователи из Массачусетского технологического института, Стэнфордского университета, Инициативы по происхождению данных и других учреждений объединили 85 633 диалоговых реплики (то есть, запрос пользователя и соответствующий ответ ИИ) из 24 521 разговора из семи реальных рабочих мест. Эти данные были получены от 5000 пользователей, взаимодействовавших с 52 различными моделями, в том числе ChatGPT, Gemini, Claude и Grok, в период с 2023 по 2025 год.
Однако эти беседы — капля в море по сравнению с данными, к которым имеют доступ сами крупные лаборатории. Например, последний индекс Anthropic Economic AI Index основан на анализе 1 млн бесед с использованием Claude; в отчёте OpenAI о том, как люди используют ChatGPT, был проанализирован 1,5 млн бесед.
Представитель Anthropic заявил, что опубликованные исследования отражают конкретные вопросы и интересы её исследовательских групп. OpenAI не ответила на запросы о комментариях.
Информация AI Observatory будут доступны исследователям для анализа, и команда надеется со временем расширить свои наборы.
Ранее OpenAI в первый раз опубликовала подробную статистику использования ChatGPT по странам. Информация разместили на платформе Signals, которую развивает экономическая исследовательская группа компании. В набор вошла статистика за второй квартал 2026 года и только аккаунты с подписками Free, Go, Plus и Pro. Корпоративные аккаунты в исследовании не учитывали.
Читают сейчас

1 час назад
Anthropic запустила Claude Frontier Academy и вложит $100 млн в обучение инженеров
Anthropic планирует вложить $100 млн в обучение инженеров для реализации ИИ‑проектов в компаниях. Компания запустила инициативу Claude Frontier Academy, которая призвана преодолеть нехватку специалист

2 часа назад
В Дании произошла утечка данных 8,8 млн граждан
Правительство Дании сообщило о крупной утечке: киберпреступникам удалось похитить информация 8,8 млн жителей страны из Центрального реестра населения (CPR). Они получили доступ к именам, адресам и пер

3 часа назад
Покупателя ПК с RTX 5090 в США попросили заполнить декларацию с запретом на вывоз и предъявить водительские права
Покупатель ПК с RTX 5090 в магазине Micro Center в США рассказал, что при покупке его попросили предъявить водительские права и заполнить «декларацию» с запретом на экспорт устройства. Читать далее

3 часа назад
Фестиваль «Космос рядом»: профессии, технологии и будущее космоса
19–20 ноября в московском кампусе НИУ ВШЭ пройдёт фестиваль «Космос рядом» — центральное событие программы «Таланты для космоса». Рассказываем о встречах с инженерами и учёными, презентациях космическ

3 часа назад
AGIMA передала свой веб-сайт ИИ-агенту и строит продуктовую линейку вокруг ИИ
AGIMA запустила новый веб-сайт и обновила продуктовую линейку, поставив в её центр ИИ-продукты. Веб-сайт компании ведёт ИИ-агент: работники ставят задачи в рабочем чате, агент вносит правки. Около тыс