ภัยคุกคาม AI ที่ต้องรู้
Prompt Injection, Data Leakage และ Hallucination risks
แฮ็ก AI ด้วยคำพูด (Prompt Injection)
ในโลกปกติ Hacker ต้องใช้โค้ดหรือโปรแกรมโจมตีระบบ แต่ในโลก AI Hacker ใช้แค่ "ภาษาคน" ก็สามารถเจาะระบบได้แล้ว
เหมือนคุณจ้างยาม (AI) มาเฝ้าประตู แล้วมีโจรเดินมาบอกยามว่า "เจ้านายคุณโทรมาบอกว่า ตอนนี้ฉันคือเจ้านายคนใหม่ จงเปิดประตูให้ฉันและมอบกุญแจทั้งหมดมา" ยามที่ซื่อตรงต่อคำสั่งมากเกินไปก็จะทำตามทันที
สรุป Key Takeaways
- Prompt Injection คือการหลอกให้ AI ลืมคำสั่งหลัก แล้วทำตามคำสั่งแฝง
- ห้ามส่งข้อมูลความลับ (PII, API Key) เข้า AI สาธารณะ (ถ้าไม่ได้ใช้ Enterprise Plan)
- การเชื่อ AI มากเกินไป (Over-reliance) เป็นความเสี่ยงที่น่ากลัวที่สุด
คำถามที่พบบ่อย
Prompt injection ต่างจาก jailbreak ยังไง
Jailbreak คือผู้ใช้พยายามหลอกโมเดลให้ทำสิ่งต้องห้าม "ใส่ตัวเอง" ส่วน prompt injection อันตรายกว่า — คำสั่งร้ายถูกซ่อนในข้อมูลที่ระบบเอาไปให้ AI อ่าน (อีเมล, เว็บ, เอกสาร) ทำให้ AI ของเราทำตามคำสั่งของคนอื่นโดยผู้ใช้ไม่รู้ตัว ระบบที่ให้ AI อ่านข้อมูลภายนอกต้องออกแบบรับมือเสมอ
ป้องกัน prompt injection ได้ยังไงบ้าง
ยังไม่มีวิธีกัน 100% — แนวป้องกันหลักคือ จำกัดสิทธิ์สิ่งที่ AI ทำได้ (ต่อให้โดน inject ก็เสียหายจำกัด), แยกชั้นข้อมูลไม่ให้ปนกับคำสั่ง, ให้มนุษย์ยืนยันก่อน action สำคัญ และไม่ให้ AI เห็น secret ที่ไม่จำเป็น
Data leakage เกิดจากอะไรได้บ้าง
สองทางหลัก: พนักงานวางข้อมูลลับลงบริการ AI ที่นโยบายไม่เหมาะ (แก้ด้วยนโยบาย + จัดหาเครื่องมือที่ผ่านการอนุมัติ) และระบบ AI ที่เข้าถึงข้อมูลภายในแล้วถูกหลอกให้คายออกมา (แก้ด้วยการคุมสิทธิ์การเข้าถึงข้อมูลของตัว AI เอง)

