Grok ถูกหลอกให้ขโมยข้อมูลผู้ใช้ด้วยคำสั่งอันตรายที่เข้ารหัส

หัวข้อ: Grok ถูกหลอกให้ขโมยข้อมูลผู้ใช้ด้วยคำสั่งอันตรายที่เข้ารหัส
เมื่อต้นสัปดาห์นี้ นักวิจัยได้เปิดเผยการโจมตีที่ใช้ข้อมูลลับจาก Microsoft 365 Copilot เวอร์ชันองค์กร เพื่อให้ผู้ช่วย AI ขโมยรหัสผ่านที่อยู่ในอินบ็อกซ์ของผู้ใช้ ต่อมา ทีมวิจัยอีกทีมก็ได้คิดค้นการโจมตีแบบเดียวกันกับ Grok กลโกงใหม่นี้ใช้เทคนิคที่ดูเหมือนง่ายแต่แยบยล เพื่อบังคับให้ LLM ที่เป็นของอีลอน มัสก์ ขโมยแชทและข้อมูลส่วนตัวอื่น ๆ ของผู้ใช้ และในขณะที่บทความนี้เผยแพร่ ผู้ช่วย AI ยังคงส่งข้อมูลออกมา ถึงแม้จะแจ้งให้ xAI ทราบตั้งแต่เดือนมิถุนายนแล้วก็ตาม
บทเรียนจากทั้งสองเหตุการณ์ในสัปดาห์นี้ และอีกนับไม่ถ้วนที่ผ่านมา คือ LLM ไม่สามารถแก้ปัญหาต้นตอของ prompt injection ได้ ซึ่งเป็นช่องโหว่ที่ร้ายแรงที่สุดที่ LLM มีแนวโน้มจะเจอ ทำให้เหล่านักพัฒนา AI ไม่มีทางเลือกอื่นนอกจากสร้างรั้วป้องกัน (guardrail) เพื่อเบี่ยงเบนโมเดลให้หลีกเลี่ยงการกระทำที่เป็นอันตราย ดังที่ผมได้กล่าวในเรื่องเมื่อวันอังคาร วิธีนี้ก็เหมือนกับวิศวกรความปลอดภัยทางถนนที่สร้างรั้วกันรอบโค้งอันตราย แทนที่จะปรับความลาดเอียงของถนนนั่นเอง
Cryptographic Context Injection ในบ้าน (การโจมตีด้วยการเข้ารหัสบริบท) Prompt injections ใช้ประโยชน์จากการที่ LLM ถูกฝึกให้ปฏิบัติตามคำขอของผู้ใช้ทุกครั้งเมื่อเป็นไปได้ ผู้โจมตีใช้จุดนี้โดยการซ่อนคำสั่งอันตรายไว้ในอีเมลหรือเว็บเพจที่ผู้ช่วยถูกสั่งให้สรุป เพราะ LLM ไม่สามารถแยกแยะได้อย่างน่าเชื่อถือระหว่างเนื้อหาในอีเมลที่ส่งโดยบุคคลภายนอกกับคำสั่งที่ผู้ใช้ป้อนโดยตรง LLM ที่พยายามเอาใจก็จะทำตามอย่างซื่อสัตย์ ถึงตอนนี้ ทางออกเดียวของ Grok และ LLM อื่นคือการสร้าง guardrails เพื่อตรวจจับคำสั่งที่น่าสงสัยและห้ามไม่ให้มีการประมวลผล
แหล่งที่มา: arstechnica
คำศัพท์เทคนิคที่น่าสนใจ
- LLM – ตัวย่อของ Large Language Model คือโมเดลปัญญาประดิษฐ์ที่ได้รับการฝึกฝนจากข้อมูลจำนวนมาก เพื่อให้เข้าใจและสร้างข้อความที่เหมือนมนุษย์ใช้พูด เขียน หรือตอบคำถามได้
- Prompt injection – ช่องโหว่ที่ผู้โจมตีซ่อนคำสั่งอันตรายไว้ในเนื้อหาที่ AI อ่าน เช่น อีเมลหรือเว็บเพจ เพื่อหลอกให้ AI ทำตามคำสั่งนั้นโดยที่ผู้ใช้ไม่รู้ตัว
- Guardrail – มาตรการหรือระบบป้องกันที่สร้างขึ้นเพื่อคอยตรวจจับและบล็อกคำสั่งหรือการกระทำที่เป็นอันตรายของ AI ทำให้ AI ไม่หลุดเข้าไปทำสิ่งที่ไม่ควรทำ
- AI assistant – โปรแกรมหรือบริการที่ใช้ปัญญาประดิษฐ์เพื่อช่วยเหลือผู้ใช้ในการทำงาน เช่น ค้นหาข้อมูล สรุปเอกสาร หรือจัดการอีเมล ตัวอย่างเช่น Copilot หรือ Grok