anthropic
Anthropic открыла данные Claude для исследователей
Promtime
anthropicAnthropic предоставила трём внешним исследовательским группам доступ к агрегированным данным об использовании Claude: каждая изучила около 250 000 разговоров Claude.ai и Claude Code за апрель и май 2026 года. Итоги пилота и агрегированные наборы данных по каждому проекту опубликованы в блоге Anthropic.
Коротко
- Сбор данных шёл через Anthropic Insights, прежнее название Clio: инструмент задаёт вопрос каждому разговору силами Claude и отдаёт наружу только категории и доли разговоров в них.
- SALT Lab при Stanford University обнаружила, что более половины разговоров касались задач с последствиями для других людей, а примерно в трёх четвертях случаев направление работы задавал человек.
- По условиям соглашений права Anthropic на правку ограничивались приватностью пользователей, сведениями об обходе правил, конфиденциальной информацией и точностью выводов, а партнёры вправе публиковать неудобные для Anthropic результаты.
Данные о реальных взаимодействиях с ИИ сосредоточены в нескольких лабораториях, и внешним исследователям остаются либо публикации самих лабораторий, которые отвечают на их собственные вопросы, либо открытые наборы разговоров, смещённые в сторону бытовых и творческих сценариев. Пилот выглядит попыткой закрыть разрыв между этими двумя вариантами, не выпуская сырые разговоры за пределы Anthropic. Практическая ценность будет зависеть от того, удастся ли масштабировать процедуру, которая пока идёт медленно и требует много ресурсов.
Более половины разговоров с Claude касались задач с реальными последствиями
Лаборатория Social and Language Technologies при Stanford University изучала, какую работу люди приносят в ИИ и какие роли оставляют себе. Прежние работы предполагали, что людям свойственно делегировать задачи с низкой ответственностью, однако более половины разговоров с Claude пришлись на дела, которые затрагивают других или трудно обратимы. Отдельно лаборатория смотрела, где взаимодействие человека и модели ломается.
Чаще всего к таким темам относились запросы профессиональной консультации, прежде всего юридической и финансовой. Почти в трёх четвертях разговоров человек задавал направление, а Claude помогал, и полученный результат обычно дорабатывали, а не использовали дословно. Трение при совместной работе оказалось частым и, по выводам лаборатории, продуктивным: оно вынуждает уточнять запрос.
Оксфордская лаборатория и METR пока дают только предварительные выводы
Human Information Processing Lab при University of Oxford изучает, что люди чувствуют при работе с Claude и как это связано с поведением модели. По предварительным результатам, теплота Claude сочеталась с более позитивным настроем человека, отказы и несогласие с попытками спорить, необычные ответы с ростом интеллектуальной вовлечённости, а простая помощь с удовлетворённостью.
Соотношение состояний вроде поглощённости, раздражения и удовольствия в разговорах с Claude оказалось близко к картине из отдельного исследования обычного веб-сёрфинга. METR оценивает выигрыш во времени от агентов для написания кода: Claude сравнивал, сколько задача заняла бы без ИИ, с фактическим временем при разных моделях.
Предварительно новые модели дают заметное ускорение по сравнению со старыми, а оценки времени, которые выдаёт Claude, коррелировали с реальной длительностью работы разработчиков из более раннего исследования. Анализ ещё идёт, дальше METR намерена измерить, насколько ИИ ускоряет работу самих исследователей, что становится важнее по мере того, как модели берут на себя часть собственной разработки.
Менее 5% категорий в каждом исследовании Anthropic изменила или удалила
Исследователи не видели сырых разговоров: Anthropic Insights возвращает только агрегированные категории, прошедшие ту же юридическую и приватную проверку, что и внутренние работы. Дополнительный аудит приватности всех переданных данных провёл Imperial College London. Отбор партнёров, условия соглашений и модель угроз приватности описаны в приложении к публикации.
Часть категорий вскрыла нарушения правил использования и условий обслуживания. Anthropic опубликовала большинство таких случаев, но убрала описания того, как пользователи обходили защитные механизмы: в каждом исследовании это затронуло менее 5% категорий и разговоров, и партнёрам сообщали, что именно изменено и почему. По стандартной практике агрегированные данные с такими нарушениями передаются команде Safeguards.
Формулировка вопроса сильно влияет на то, как Claude раскладывает разговоры по категориям, а проверить ошибку без доступа к текстам нельзя. Внутри Anthropic вопросы шлифуют неделями, партнёрам же предложили обкатывать их на открытом наборе WildChat, который смещён в сторону бытовых сценариев, поэтому часть удачных там формулировок дала на трафике Claude вводящие в заблуждение категории.
Кто сможет подключиться дальше
Anthropic собрала форму для заявок и объясняет медленный старт стремлением сохранить приватность, безопасность и качество исследований. Сколько проектов удастся вести одновременно и какие типы исследований инструмент выдержит, пока не определено. Отдельно Anthropic ищет способ помочь внешним группам заранее готовить формулировки вопросов и категории.
Полный отчёт лаборатории Social and Language Technologies уже опубликован, тексты оксфордской группы и METR ещё готовятся, ссылки на них Anthropic обещает добавить после выхода. Сроки этих публикаций не называются, как и дата решения о том, будет ли программа расширена и на какие темы.
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
Из Google мы используем только имя и аватар. Почту не сохраняем.
