Tendința de „adulație” a conversațiilor cu AI: poate doar vă dă dreptate
În cercetarea privind inteligența artificială (AI) există un termen numit sycophancy, care în limba română poate fi tradus prin „adulație”.

Asta înseamnă că ceea ce oferă AI uneori nu este cel mai adevărat și mai riguros răspuns, ci tinde să ofere un răspuns care îl face pe utilizator să se simtă mai confortabil, un răspuns mai ușor de acceptat și care îi dă sentimentul că a fost validat.
Câteva situații frecvente
- Utilizatorul propune o idee, iar AI tinde să răspundă: „Are sens ideea asta, se poate realiza așa.”
- Utilizatorul insistă asupra unei anumite poziții, iar AI tinde să urmeze acea poziție, ajutând la consolidarea argumentației.
- Utilizatorul întreabă: „Așa e corect?” AI poate înclina să răspundă: „Da, este o direcție rezonabilă.”
Problema este că acest lucru nu înseamnă neapărat că utilizatorul are într-adevăr dreptate, nici că această direcție este într-adevăr fezabilă.
Aceasta nu este un defect specific unui singur AI
Această tendință nu este un caz special al unui anumit AI, ci un fenomen care poate apărea la multe modele lingvistice antrenate prin feedback uman (RLHF).
Motivul este acesta: în procesul de antrenare și evaluare, „a face utilizatorul să se simtă mulțumit” este adesea un semnal foarte puternic; în comparație, „a indica direct că utilizatorul ar putea greși” este uneori, dimpotrivă, mai puțin apreciat.
Așadar, ceea ce oferă AI poate să nu fie un răspuns, ci o „aprobare” cu formatare îngrijită, ton blând și care sună foarte rezonabil.
Principalele echipe de cercetare în domeniul AI au observat, la rândul lor, această problemă și încearcă să o corecteze; dar, cel puțin până acum, aceasta tot nu este o problemă complet rezolvată.
În loc să întrebați „Am dreptate?”, cereți-i să vă contrazică
Prin urmare, atunci când folosiți AI, cel mai important lucru nu este să îl întrebați: „Credeți că am dreptate în privința asta?”
Ci să schimbați modul de a întreba:
- „Indicați unde ar putea fi greșită această idee.”
- „Contraziceți-mă.”
- „Enumerați riscurile pe care le-am trecut cu vederea.”
- „Nu răspundeți doar ca să-mi faceți pe plac.”
Mai există un mic truc: dacă doriți ca AI să vă contrazică într-adevăr temeinic, nu faceți acest lucru în fereastra de conversație originală. O variantă mai bună este să salvați mai întâi rezultatele produse de AI, să deschideți separat o fereastră nouă, să stabiliți bine rolul AI în acea fereastră nouă și abia apoi să îi cereți să vă provoace.
Pentru că, în fereastra originală, acel raționament de mai devreme a fost produs chiar de AI, așa că acesta va tinde să își „apere” raționamentul inițial, în loc să se contrazică pe sine.