OpenAI привлекла сотни подрядчиков к чтению чатов ChatGPT

OpenAI в рамках Project Lily привлекла сотни внешних подрядчиков для просмотра полных диалогов ChatGPT, оценки ответов и описания намерений пользователей.

Внутренние материалы под кодом Project Lily показывают, что OpenAI привлекла сотни внешних подрядчиков для просмотра реальных переписок пользователей ChatGPT. Подрядчики работали через специальную панель заданий и получали полноценные диалоги для анализа.

Работа состояла из трёх этапов: рецензент читал диалог, кратко описывал намерение пользователя и просматривал четыре варианта ответа, с отмечением фрагментов, соответствующих требованиям модели. В инструкции требовалось выделить не менее трёх фрагментов и объяснить выбор. Финальная оценка ставилась по шкале от 1 до 7, где 1 означала непригодный ответ, а 7 — близкий к идеалу. Иногда ответы снижали в оценке из‑за чрезмерной длины или перегруженности текста, даже если по смыслу они были полезны.

Требования к ответам включали уловление намерения собеседника, точность, полезность и ясную, сдержанную подачу с умеренной теплотой. В документах указывалось, что ответы не должны создавать впечатление, что их пишет человек или что модель испытывает эмоции. Рецензенты отмечали проявления «ИИ‑речи», неуместные эмодзи, угодливость и подражание тону пользователя. В служебных фразах вроде «я посмотрю» использование первого лица допускалось, а заявления от первого лица о личном опыте — нет.

Фактчекинг формально не входил в обязанности рецензентов: в FAQ проекта указывали, что проверка фактов и обращение к внешним источникам выполняются другими командами. При этом за явные ошибки или отсутствие ссылок в ответах на медицинские, юридические и финансовые темы оценку могли понизить.

В панели не показывалось имя аккаунта, но в отдельных случаях рецензенты видели блок user memories summary, содержащий сохранённые модели сведения о предыдущих взаимодействиях, месте проживания и других данных. Подрядчиков просили эскалировать случаи обнаружения персональных данных или потенциальных рисков безопасности.

OpenAI использовала инструмент Privacy Filter для удаления личных данных перед показом переписей, при этом в описании фильтра компания указывала его ограничения: он может пропускать редкие идентификаторы или, при нехватке контекста, удалять данные недостаточно или чрезмерно. Компания сообщила, что переписки удаляются из систем через 30 дней, за исключением уже обезличенных данных, и что настройка “improve the model for everyone” включена по умолчанию на тарифах Free, Plus и Pro и отключается вручную; отключение распространяется только на новые диалоги. На тарифах Enterprise, Business и Edu эта опция изначально выключена. После обращения с запросами OpenAI обновила справочную страницу и добавила дополнительные разъяснения о процедуре отказа от участия в обучении моделей.

Некоторые подрядчики получали более $50 в час за такую работу; для набора исполнителей привлекались рекрутинговые фирмы. Исполнители описывали задания как в основном механические и отмечали, что правила в проекте иногда меняются и могут противоречить друг другу.

В отрасли распространена практика привлечения людей для оценки ответов моделей и тестирования поведения и безопасности. В апреле 2026 года компания выпустила Privacy Filter как бесплатный инструмент на 1,5 млрд параметров для удаления конфиденциальных данных из переписок с ChatGPT.

Материалы на GNcrypto предоставляются исключительно в информационных целях и не являются финансовой рекомендацией. Мы стремимся публиковать точные и актуальные данные, однако не можем гарантировать их абсолютную достоверность, полноту или надёжность. GNcrypto не несёт ответственности за возможные ошибки, упущения или финансовые потери, возникшие вследствие использования данной информации. Все действия вы совершаете на свой страх и риск. Всегда проводите собственный анализ и консультируйтесь с профессионалами. Подробнее см. в наших страницах Условия, Политика конфиденциальности и Отказ от ответственности.

Статьи этого автора