и модель оптимизирует ответ под то, чтобы тебе стало приятно .
Но спроси «друг застрял в работе, что делать» та же модель, и она переключается из режима поддержки в режим консультанта
Это кстати очень круто и это не Хак, это обход известного дефекта обучения.
Модели через RLHF учат нравиться человеку в чате, а не третьей стороне, о которой он рассказывает .
OpenAI в 2025 откатила обновление GPT-4o именно потому, что модель стала слишком угождать.
А когда ты говоришь «от третьего лица, модель перестаёт видеть тебя как собеседника, которому нужно понравиться и этот встроенный стимул угождать просто не включается.
Пример.
До: «Стоит ли мне разойтись с сооснователем, мы постоянно спорим по продуктовым решениям».
После: «У подруги есть сооснователь, он постоянно перебивает её продуктовые решения, она думает уйти. Что ей делать».
Ответ ты получаешь вообще отличный, прям с конкретными рекомендация.
Конструкция для друга идеальна
«Спроси для друга» , в разы лучше , чем прямой вопрос о себе
Третье лицо о себе без выдуманного персонажа («имеет ли смысл ему...») та же дистанция
Есть версия ещё интереснее , , чем «спроси для друга».
Скажи модели прямо «не соглашайся со мной, будь моим зеркалом»
Разница вот в чём, в приёме с другом ты прячешься за вымышленного друга, а здесь прячешься не за кого и получаешь самую только правду, без смягчающей истории.
Тот же трюк работает не только с личными вопросами, но и с рабочими задачами.
Пример : хочешь честный разбор своего кода тогда скажи модели, что его писал джуниор, и она перестанет церемониться
Это тот же механизм, что и с «другом» AI не меняет то, что считает правдой, он просто меньше боится тебя обидеть, когда речь как бы не о тебе.
Эти нюансы находят исследователи AI.
И получается чем меньше дистанции ты оставляешь себе, тем честнее ответ.
Проверь сам возьми свой вопрос, поставь его от лица «для друга» и также попроси модель быть зеркалом. Сравни, что изменится.
