Поручили задачу не по профилю: как использовать ChatGPT и не наделать ошибок

OpenAI проанализировала больше 800 000 рабочих сообщений от пользователей ChatGPT в США — и обнаружила, что заметная часть запросов относится к задачам из другой профессиональной области. Среди приведённых в отчёте сценариев — разбор договора, расчёт бюджета и поиск технической неполадки на сайте.

Один из возможных рабочих сценариев выглядит так: руководитель срочно передаёт непрофильную задачу, профильный специалист недоступен, а решение нужно подготовить быстро. ChatGPT в такой ситуации можно использовать для предварительного разбора. Однако исследование OpenAI ничего не говорит о том, насколько надёжен получившийся ответ, — оно фиксирует только содержание запросов. Поэтому разница между «попросить черновик» и «сдать готовое решение» здесь становится критичной.

Что показал анализ 800 тысяч рабочих сообщений

Исследование описано в отчёте OpenAI Work at the Frontier: How AI is Expanding What People Do at Work и разбирает рабочую переписку пользователей ChatGPT из США. Первый вывод: 16,8% всех рабочих сообщений касаются задач, которые в классификации исследования относятся к другой профессии. Если убрать «универсальные» действия — написание текстов, суммаризацию, планирование, — которые встречаются в разных профессиях сами по себе и не указывают на пересечение ролей, доля чужих задач среди оставшихся узкопрофильных запросов вырастает до 43,5%. Это два разных знаменателя: 16,8% — доля от всех рабочих сообщений, 43,5% — доля только среди узкопрофильных.

OpenAI называет этот паттерн task crossover — когда работа, исторически привязанная к одной профессии, появляется в запросах человека из другой. Важная оговорка: речь идёт о сообщениях, а не о людях. Исследование не утверждает, что почти половина сотрудников выполняет чужую работу, и не сообщает, довели ли пользователи такие задачи до конца и насколько качественным получился результат.

Какие чужие задачи передают ChatGPT

OpenAI приводит следующие сценарии:

  • владелец малого бизнеса самостоятельно готовит текст, разбирает договор или делает базовый финансовый анализ, не привлекая юриста или бухгалтера;
  • продавец изучает клиентский датасет, который в рамках профессиональной классификации относится к работе аналитика;
  • маркетолог ищет причину технической проблемы на сайте — задачи, относящейся к области разработки.

Согласно отчёту, два типа задач оказались особенно устойчивыми: финансовые расчёты и поиск технических проблем вошли в тройку самых частых задач из другой профессиональной области во всех семи рассмотренных группах. Этот вывод относится только к группам и выборке, проанализированным в исследовании.

Как поставить задачу: просить черновик, а не финал

Раз исследование фиксирует запросы из других профессиональных областей, возникает вопрос, как ограничить роль ChatGPT при работе с ними. Само исследование OpenAI не предлагает методику постановки запроса и не проверяет, какие формулировки повышают точность ответа. Дальше приведён редакционный сценарий, а не выводы OpenAI.

Шаг 1. Определите границы задачи. Решите заранее, что вам нужно получить на первом этапе: черновик текста, базовый финансовый расчёт, предварительный разбор договора, варианты поиска технической неполадки или исследовательский просмотр клиентских данных. Не поручайте модели окончательное решение задачи, если результат требует профессиональной проверки.

Шаг 2. Прямо ограничьте ожидаемый результат в самом запросе. Можно использовать такой шаблон:

«Мне поручили непрофильную задачу: [описание]. Используй только те данные, которые я укажу: [исходные данные]. Не додумывай и не предполагай то, чего в них нет. Подготовь предварительный [черновик / базовый анализ / варианты поиска проблемы].
Отдельно перечисли:
— допущения, которые пришлось сделать из-за пробелов в данных;
— данные, которых не хватает или которые неизвестны;
— утверждения, которые должен проверить [профильный специалист], прежде чем на них можно полагаться.
Ответ — черновик, а не готовое решение. Не оформляй и не подавай его как профессиональное заключение [юриста / бухгалтера / разработчика]»
.

Это авторский шаблон редакции, а не цитата из исследования OpenAI и не проверенный в нём способ повысить точность ответа.

Шаг 3. Сохраните за результатом статус черновика — и на словах, и по факту. Не называйте ответ ChatGPT «проверенным расчётом», «юридическим заключением» или «готовым техническим решением»: исследование не оценивало качество таких ответов, а только фиксировало содержание запросов.

Где нужна проверка профильного коллеги

В редакционном сценарии результат ChatGPT и финальное решение рассматриваются как разные этапы. Проверять результат должен человек с компетенциями в соответствующей области, а не сам чат-бот.

Задача Роль ChatGPT Финальная проверка
Материал или текст Предварительный черновик Ответственный за содержание или профильный коллега
Договор Предварительный разбор Юридический специалист
Финансы Базовый анализ или расчёт Финансовый специалист
Проблема на сайте Предварительный поиск возможной причины Разработчик или технический специалист
Клиентский датасет Исследовательский анализ Аналитик

Это редакционная схема процесса, а не результат исследования OpenAI: источник не сравнивал ответы ChatGPT с работой специалистов и не оценивал их точность.

Если проверить результат некому, его следует сохранить с пометкой «черновик» или «не проверено», а не выдавать за готовое решение. Для юридической, финансовой или технической задачи с существенными последствиями стоит привлечь внутреннего или внешнего профильного специалиста: просьба к модели перечислить спорные места не гарантирует, что она обнаружит все ошибки в собственном ответе.

Почему эти цифры нельзя переносить на Россию

Всё, о чём говорилось выше, — данные по пользователям ChatGPT из США. OpenAI не публиковала в этом отчёте сопоставимую статистику по России и не анализировала распределение задач между сотрудниками российских компаний. Поэтому 16,8% и 43,5% — это не показатели российского рынка труда, а результаты анализа конкретной выборки рабочих сообщений из США.

Сценарий, при котором непрофильную задачу нужно выполнить до обращения к специалисту, можно рассматривать как редакционный пример. Однако представлять его как доказанный российский тренд с конкретными показателями нельзя: для такого вывода нужны отдельные данные по России.

Исследование OpenAI показывает, что пользователи ChatGPT отправляют ему запросы, относящиеся к другим профессиональным областям. При этом оно не доказывает, что получившийся ответ равноценен работе, проверенной профильным экспертом. Поэтому результат чат-бота в таких задачах следует рассматривать как предварительный материал, если он не прошёл профессиональную проверку.

Читайте также

Похожие записи