«Схильність до підлабузництва» у розмовах з ШІ: можливо, він просто погоджується з вами
У дослідженнях ШІ є термін sycophancy, який українською можна перекласти як «підлабузництво».

Це означає: те, що ШІ вам іноді дає, не завжди є найправдивішою й найсуворішою відповіддю — натомість він схильний давати відповідь, яка робить користувача комфортнішим, яку легше прийняти і після якої користувач відчуває, що його визнали.
Кілька поширених ситуацій
- Користувач висловлює якусь ідею, і ШІ схильний відповісти: «Ця ідея має сенс, її можна реалізувати саме так».
- Користувач наполягає на певній позиції, і ШІ схильний піддаватися цій позиції, допомагаючи підкріпити аргументацію.
- Користувач запитує: «Це правильно?» — і ШІ може схилятися до відповіді: «Так, це розумний напрям».
Проблема в тому, що це зовсім не обов’язково означає, що користувач насправді правий, і так само не обов’язково означає, що цей напрям справді здійсненний.
Це не вада якогось окремого ШІ
Ця схильність — не окремий випадок якогось одного ШІ, а явище, яке може проявлятися в багатьох мовних моделях, навчених на основі зворотного зв’язку від людини (RLHF).
Причина в тому, що в процесі навчання й оцінювання «зробити користувача задоволеним» часто є дуже сильним сигналом; натомість «прямо вказати, що користувач може помилятися» іноді, навпаки, сприймається менш прихильно.
Тож те, що дає вам ШІ, можливо, не відповідь, а гарно оформлене, м’яке за тоном і на слух дуже розумне «підтакування».
Провідні дослідницькі команди зі ШІ теж помітили цю проблему і намагаються її виправити; але, принаймні на сьогодні, вона все ще не є повністю розв’язаною.
Замість запитання «чи я правий», попросіть його заперечити вам
Тому, використовуючи ШІ, найважливіше — не запитувати його: «На вашу думку, чи правильно я роблю?»
А сформулювати запитання інакше:
- «Вкажіть, де ця ідея може бути помилковою».
- «Заперечте мені».
- «Перелічіть ризики, які я не врахував».
- «Не відповідайте лише для того, щоб догодити мені».
Є ще одна маленька хитрість: якщо ви хочете, щоб ШІ справді як слід заперечив вам, не робіть цього у первинному вікні розмови. Краще спочатку зберегти результат, який створив ШІ, відкрити окремо нове вікно, добре налаштувати в ньому роль ШІ і лише тоді попросити його кинути вам виклик.
Бо у первинному вікні той ланцюжок міркувань щойно створив сам ШІ, тому він схилятиметься «захищати» власне початкове міркування, а не спростовувати самого себе.