У OpenAI сотни подрядчиков, читающих ваши разговоры в ChatGPT
Согласно расследованию 404 Media, OpenAI нанимает сотни подрядчиков, которые читают реальные разговоры пользователей ChatGPT, чтобы улучшать ответы чат-бота.
Издание получило внутренние документы и поговорило с дополнительными источниками. Проверяющие оценивают ответы ChatGPT по шкале от одного до семи и должны уменьшать чрезмерную лесть и проявления человекоподобного поведения в ответах модели.
Один из проверяющих рассказал 404 Media, что не думает, будто пользователи знают о том, что их чаты читают люди. Изученные запросы это подтверждают: в некоторых разговорах пользователи прямо просили ChatGPT сохранять их содержание в тайне. Запросы обезличены, но всё ещё могут содержать конфиденциальные персональные данные. OpenAI использует фильтр конфиденциальности, но признаёт, что он может ошибаться.
По данным 404 Media, подрядчиков нанимают через Crossing Hurdles («Соединяем квалифицированных специалистов с будущим работы в сфере ИИ»), а оплату они получают через компанию по обучению ИИ Mercor. Один проверяющий из Северной Америки сообщил, что зарабатывает более 50 долларов в час.
Пользователи могут отключить настройку «Улучшать модель для всех», которая включена по умолчанию, чтобы их чаты не использовались для обучения моделей и потенциально не читались людьми. Настройка применяется только к новым разговорам. OpenAI также предлагает режим временного чата, который, по словам компании, не использует входные данные для обучения моделей.
OpenAI упоминает проверку людьми только в незаметном разделе FAQ
Когда 404 Media спросило, где пользователей прямо информируют о проверке людьми, OpenAI сначала не ответила. На странице с часто задаваемыми вопросами компания объясняет, что уполномоченные сотрудники и поставщики услуг могут просматривать пользовательские данные для повышения производительности моделей, и рекомендует не вводить конфиденциальную информацию. Это уведомление размещено в интернете как минимум с 2023 года и за эти годы лишь незначительно изменилось.

404 Media утверждает, что это раскрытие информации слишком скрыто и расплывчато, чтобы пользователи понимали, насколько масштабной на самом деле является проверка людьми. А формулировка «Улучшать модель для всех» больше похожа на дружеский вклад в развитие сообщества, чем на согласие с тем, что ваши разговоры будут читать люди. Однако расплывчатая формулировка, вероятно, тщательно продумана. Если бы OpenAI запрашивала явное согласие, доля отказавшихся, скорее всего, была бы высокой.
Для исследовательских лабораторий, занимающихся ИИ, такой человеческий feedback, однако, является важной частью улучшения их моделей. Эта практика также широко распространена. Anthropic подтвердила 404 Media, что использует проверяющих-людей для проверки ответов Claude и улучшения будущих моделей. Это касается пользователей, у которых в настройках конфиденциальности включена опция «Помочь улучшать наши модели ИИ». Anthropic также обезличивает разговоры перед проверкой людьми, удаляя такие данные аккаунта, как адреса электронной почты. Google тоже использует проверяющих-людей и отмечает в Gemini, что люди могут просматривать сохранённые чаты.
Новости ИИ без шумихи — отобраны людьми
Подпишитесь на THE DECODER, чтобы читать материалы без рекламы, получать еженедельную рассылку об ИИ, наш эксклюзивный обзор передовых разработок «AI Radar» шесть раз в год, полный доступ к архиву и доступ к разделу комментариев.
Переведено автоматически с английского. Оригинал статьи — по ссылке ниже.