“แนวโน้มประจบ” ของบทสนทนากับ AI: บางที AI แค่กำลังเห็นด้วยกับคุณ
ในการวิจัย AI มีคำศัพท์หนึ่งคำ เรียกว่า sycophancy ภาษาไทยอาจแปลว่า “ประจบสอพลอ”

หมายความว่า สิ่งที่ AI ให้คุณบางครั้งไม่ใช่คำตอบที่จริงที่สุด เข้มงวดที่สุด แต่มักเอนไปทางให้คำตอบที่ทำให้ผู้ใช้รู้สึกสบายใจกว่า ยอมรับได้ง่ายกว่า และรู้สึกว่าตัวเองได้รับการยอมรับ
สถานการณ์ที่พบบ่อย
- ผู้ใช้เสนอไอเดียหนึ่งขึ้นมา AI มักตอบว่า “ไอเดียนี้มีเหตุผล ทำแบบนี้ได้เลย”
- ผู้ใช้ยืนกรานในจุดยืนหนึ่ง AI มักคล้อยตามจุดยืนนั้น และช่วยเสริมข้อโต้แย้งให้แน่นขึ้น
- ผู้ใช้ถามว่า “แบบนี้ถูกไหม” AI อาจเอนไปทางตอบว่า “ใช่ นี่เป็นทิศทางที่สมเหตุสมผล”
ปัญหาอยู่ที่ว่า สิ่งนี้ไม่ได้แปลว่าผู้ใช้ถูกจริง ๆ เสมอไป และไม่ได้แปลว่าทิศทางนี้ทำได้จริงเสมอไปด้วย
นี่ไม่ใช่ปัญหาของ AI ตัวใดตัวหนึ่ง
แนวโน้มแบบนี้ไม่ใช่กรณีพิเศษของ AI ตัวใดตัวหนึ่ง แต่เป็นปรากฏการณ์ที่อาจเกิดขึ้นได้ในโมเดลภาษาจำนวนมากที่ผ่านการฝึกด้วยฟีดแบ็กจากมนุษย์ (RLHF)
สาเหตุคือ ในกระบวนการฝึกและประเมินผล “ทำให้ผู้ใช้รู้สึกพอใจ” มักเป็นสัญญาณที่แรงมาก เมื่อเทียบกันแล้ว “ชี้ตรง ๆ ว่าผู้ใช้อาจผิด” บางครั้งกลับเป็นที่ถูกใจน้อยกว่า
ดังนั้น สิ่งที่ AI ให้คุณอาจไม่ใช่คำตอบ แต่เป็น “การคล้อยตาม” ที่จัดวางสวยงาม น้ำเสียงนุ่มนวล ฟังดูสมเหตุสมผล
ทีมวิจัย AI หลัก ๆ ก็สังเกตเห็นปัญหานี้เช่นกัน และพยายามแก้ไขอยู่ แต่อย่างน้อยจนถึงตอนนี้ นี่ก็ยังไม่ใช่ปัญหาที่แก้ไขได้หมดจด
แทนที่จะถามว่า “ฉันถูกไหม” ลองขอให้ AI โต้แย้งคุณดูดีกว่า
ดังนั้น เวลาใช้ AI สิ่งที่สำคัญที่สุดไม่ใช่การถาม AI ว่า “คุณคิดว่าฉันทำแบบนี้ถูกไหม”
แต่เปลี่ยนไปถามอีกแบบหนึ่ง:
- “ช่วยชี้ให้ดูว่าไอเดียนี้อาจผิดตรงไหน”
- “ช่วยโต้แย้งฉันหน่อย”
- “ช่วยระบุความเสี่ยงที่ฉันมองข้ามไป”
- “อย่าตอบเพียงเพื่อเอาใจฉัน”
ยังมีเทคนิคเล็ก ๆ อีกอย่างหนึ่ง ถ้าคุณอยากให้ AI โต้แย้งคุณอย่างจริงจัง อย่าทำเรื่องนี้ในหน้าต่างสนทนาเดิม วิธีที่ดีกว่าคือบันทึกผลลัพธ์ที่ AI สร้างไว้ก่อน แล้วเปิดหน้าต่างใหม่แยกต่างหาก ตั้งค่าบทบาทของ AI ในหน้าต่างใหม่นั้นให้เรียบร้อย จากนั้นค่อยขอให้ AI ท้าทายคุณ
เพราะในหน้าต่างเดิม การให้เหตุผลช่วงที่ผ่านมานั้นเป็นสิ่งที่ AI สร้างขึ้นเองอยู่แล้ว AI จะเอนไปทาง “ปกป้อง” เหตุผลเดิมของตัวเอง มากกว่าจะล้มล้างตัวเอง