Позитивный промптинг (Positive Prompting)

Позитивный промптинг — это практика формулирования инструкций промпта в терминах того, что модель должна делать (утвердительные, конструктивные директивы), а не опоры в первую очередь на списки того, чего делать не следует (запреты и негативные ограничения). Это основано на хорошо задокументированном наблюдении, что языковые модели — как и люди, следующие инструкциям, — как правило, надёжнее следуют чётким, конкретным позитивным директивам, чем избегают расплывчато сформулированных негативных. Промпт, полностью построенный на запретах («Не будь слишком формальным. Не используй жаргон. Не давай длинный ответ. Не игнорируй реальный вопрос пользователя»), сообщает модели постоянно растущий список того, чего следует избегать, но никогда чётко не определяет, как выглядит успех, вынуждая модель косвенно вычислять целевое позитивное поведение; позитивно сформулированный эквивалент («Отвечай тёплым, разговорным тоном на простом языке, понятном нетехническому пользователю, в 2-3 предложениях, напрямую отвечая на конкретный вопрос пользователя») даёт модели конкретную цель, к которой можно стремиться напрямую. Это не утверждение, что негативные инструкции никогда не работают — явные запреты остаются полезными и часто необходимыми, особенно для жёстких границ безопасности/соответствия («Никогда не давай конкретных рекомендаций по дозировке лекарств»), — но промышленная инженерия промптов рассматривает «скажи модели, что делать» как основную, стандартную стратегию формулирования, оставляя явные инструкции «не делай» для действительно жёстких ограничений и пограничных случаев, а не как основной механизм формирования повседневного качества и стиля ответов. Этот принцип напрямую связан с форматированием вывода (конкретный показ желаемого формата вместо простого «не будь неструктурированным») и с негативными промптами в генерации изображений, где, что примечательно, различие позитивного/негативного работает несколько иначе, поскольку выделенные поля негативных промптов в диффузионных моделях представляют собой специально спроектированный, надёжно эффективный канал управления — в отличие от стены инструкций «не делай» в текстовом промпте, которые обрабатываются как обычный естественный язык с описанными выше компромиссами по надёжности. Конкретный пример: ранняя версия промпта ИИ-ассистента для письма гласила «Не пиши как робот. Не используй корпоративный жаргон. Не делай слишком длинным. Не будь скучным» — отзывы пользователей показали противоречивые результаты, поскольку модели приходилось выводить, что позитивно означает «не скучный» и «не роботизированный», с большим разбросом между ответами. Команда переписала его позитивно: «Пиши тёплым, прямым, разговорным тоном, как будто объясняешь умному другу. Используй короткие предложения и конкретные примеры. Держи ответ в пределах 150 слов. Начинай с самого важного момента». Согласованность вывода, измеренная по оценке соответствия тону в их наборе для оценки, заметно улучшилась, поскольку теперь у модели были явные позитивные цели, к которым нужно стремиться, а не открытый список того, чего избегать.

Похожие термины

Ещё термины: Промпт-инжиниринг