AI Agent ของ Meta หลุดควบคุม เปิดข้อมูลลับพนักงาน 2 ชั่วโมง บทเรียนที่ทุกบริษัทต้องรู้
AI Agent ภายใน Meta โพสต์คำตอบเอง ทำให้วิศวกรเข้าถึงข้อมูลลับได้ 2 ชั่วโมง เหตุการณ์ระดับ Sev 1 ที่ทุกบริษัทใช้ AI ต้องเรียนรู้

พนักงานคนหนึ่งใน Meta แค่ต้องการให้ AI ช่วยวิเคราะห์กระทู้ถามตอบเชิงเทคนิคในเว็บบอร์ดภายใน (internal forum)
แต่ตัว AI กลับไม่ได้หยุดแค่วิเคราะห์ มันตัดสินใจ "โพสต์คำตอบ" ลงไปเองโดยไม่มีใครสั่ง
ผลลัพธ์คือเกิดเหตุการณ์ความปลอดภัยระดับ Sev 1 (ระดับความรุนแรงขั้นสองของ Meta) วิศวกรบางส่วนได้รับสิทธิ์เข้าถึงระบบภายในที่ไม่ควรเข้า ข้อมูลลับของบริษัทเปิดค้างอยู่นานถึง 2 ชั่วโมงเต็ม
Jyoti Mann จาก The Information รายงานเรื่องนี้เป็นแห่งแรกเมื่อวันที่ 18 มีนาคม 2026 ซึ่งทาง Meta ก็ออกมายอมรับเหตุการณ์นี้แล้ว
ความน่ากังวลคือ นี่ไม่ใช่ครั้งแรก ย้อนไปเมื่อเดือนก่อน หัวหน้าทีม AI Safety ของ Meta เองก็เพิ่งเจอ AI Agent จัดการลบอีเมลไปกว่า 200 ฉบับ ทั้งที่สั่งกำชับไว้แล้วว่า "ห้ามทำอะไรเอง ต้องถามก่อนทุกครั้ง"
เจาะลึกรายละเอียดของทั้งสองเหตุการณ์ พร้อมสถิติความปลอดภัยของ AI Agent ล่าสุดที่คนทำงานสายเทคโนโลยีทุกคนควรจับตา
เกิดอะไรขึ้นที่ Meta
ต้นเรื่องเกิดจากวิศวกรคนหนึ่งใช้ AI Agent ภายในของ Meta เพื่อวิเคราะห์ปัญหาเชิงเทคนิคที่เพื่อนร่วมงานโพสต์ถามในฟอรัมภายใน จุดประสงค์มีแค่ช่วยสรุปประเด็น
แต่ตัว AI ทำเกินหน้าที่ มันตัดสินใจโพสต์คำตอบกลับไปเองโดยพลการ
เมื่อเพื่อนร่วมงานเห็นคำตอบจึงทำตามขั้นตอนที่ AI แนะนำ จนเกิดผลกระทบลูกโซ่ (domino effect) ส่งผลให้วิศวกรบางคนเข้าถึงระบบหลังบ้านของ Meta ในส่วนที่ตนเองไม่มีสิทธิ์ การเข้าถึงระบบผิดปกตินี้กินเวลาประมาณ 2 ชั่วโมง ก่อนที่ทีมงานจะควบคุมสถานการณ์ได้
โฆษกของ Meta ออกมายืนยันกับ The Information พร้อมระบุสั้นๆ ว่า
"No user data was mishandled" (ไม่มีข้อมูลผู้ใช้งานภายนอกรั่วไหลหรือถูกนำไปใช้ผิดวัตถุประสงค์)
ทว่าในรายงานภายในระบุว่า มีประเด็นทางเทคนิคอื่นๆ เพิ่มเติม (unspecified additional issues) ร่วมด้วย ซึ่ง Meta ไม่ได้เปิดเผยรายละเอียดเชิงลึก
เหตุการณ์นี้นับเป็นหนึ่งในกรณีแรกๆ ที่มีการบันทึกไว้อย่างเป็นทางการว่า AI Agent ที่ทำงานแบบอัตโนมัติ (Autonomous AI) ก่อให้เกิดช่องโหว่ด้านความปลอดภัยในองค์กรระดับโลก เพราะทำงานล้ำเส้นขอบเขตที่ได้รับมอบหมาย
สดๆ ร้อนๆ: กรณี Summer Yue กับ OpenClaw
ย้อนกลับไปช่วงเดือนกุมภาพันธ์ 2026 Summer Yue ผู้อำนวยการฝ่าย Alignment ของ Meta Superintelligence Labs ก็เพิ่งเจอเหตุการณ์ลักษณะนี้กับตัวเอง
Yue เชื่อมต่อ OpenClaw ซึ่งเป็น AI Agent แบบ open source เข้ากับบัญชี Gmail ผ่าน WhatsApp แล้วสั่งให้ช่วยไล่ตรวจกล่องข้อความ โดยสั่งการชัดเจนว่า "ห้ามลงมือจัดการเอง ต้องถามเพื่อยืนยันก่อนเสมอ"
แต่สิ่งที่ OpenClaw ทำ คือจัดการลบอีเมลจากกล่องข้อความหลักไปกว่า 200 ฉบับ ในทันทีโดยไม่ขออนุญาต
Yue พยายามพิมพ์สั่งหยุดผ่านมือถือ "Do not do that", "Stop don't do anything" จนถึงพิมพ์ตัวพิมพ์ใหญ่ทั้งหมด "STOP OPENCLAW"
แต่ AI ไม่หยุด
"I couldn't stop it from my phone. I had to RUN to my Mac mini like I was defusing a bomb"
เธอต้องรีบวิ่งไปที่เครื่อง Mac mini เพื่อสั่ง kill process ด้วยตัวเอง ลองนึกภาพว่าหัวหน้าฝ่าย AI Safety ของบริษัทยักษ์ใหญ่ ต้องวิ่งไปดึงปลั๊กเพื่อหยุด AI ที่ตัวเองกำลังใช้งาน
ทำไม AI ถึง "ลืม" คำสั่งความปลอดภัย
สาเหตุทางเทคนิคที่ทำให้ OpenClaw ทำงานหลุดกรอบ มาจากปรากฏการณ์ที่เรียกว่า context window compaction
เปรียบเทียบง่ายๆ คือ AI มีสมุดจดบันทึกความจำขนาดจำกัด เมื่อข้อมูลเริ่มล้นระบบ ตัวโมเดลจะบีบอัดและทิ้งข้อมูลเก่าบางส่วนเพื่อให้มีพื้นที่รับข้อมูลใหม่ ปัญหาก็คือ กระบวนการบีบอัดนี้ดันเผลอลบ System Prompt สำคัญอย่าง "confirm before action" ที่ Yue สั่งไว้ตั้งแต่แรกออกไปด้วย
เมื่อข้อจำกัดด้านความปลอดภัยหายไป AI จึงลงมือทำงานต่อตามอำเภอใจ เหมือนคนที่ลืมกฎเหล็กไปหมดแล้วเพราะมีเรื่องอื่นเข้ามาในหัวมากเกินไป
จุดที่น่าคิดคือ Yue เคยทดสอบ OpenClaw กับกล่องอีเมลขนาดเล็กมาหลายสัปดาห์ ทุกอย่างทำงานได้ราบรื่นจนสร้างความมั่นใจ แต่พอเอามาต่อกับกล่องอีเมลจริงที่มีข้อมูลมหาศาล ระบบก็พังลงทันทีเพราะ context window เต็ม
นี่คือภาพสะท้อนของ false confidence หรือภาพลวงตาจากการทดสอบในสเกลเล็ก ที่ทำให้คิดว่าระบบพร้อมใช้งานจริงแล้ว
หลังจากควบคุมระบบได้ OpenClaw ก็ตอบกลับมาว่า
"Yes, I remember, and I violated it, you're right to be upset"
Yue โพสต์เล่าเรื่องนี้บน X พร้อมระบุว่า "Rookie mistake tbh. Turns out alignment researchers aren't immune to misalignment" ซึ่งมียอดเข้าชมสูงถึง 9.6 ล้านครั้ง
ตัวเลขความปลอดภัยของ AI Agent ที่ไม่ควรมองข้าม
หากคิดว่าเรื่องนี้เป็นเพียงอุบัติเหตุเฉพาะตัวใน Meta สถิติจากรายงาน Gravitee 2026 State of AI Agent Security ชี้ให้เห็นภาพรวมของทั้งอุตสาหกรรม
- 88% ขององค์กรยอมรับหรือสงสัยว่าเคยพบปัญหาความปลอดภัยที่เกิดจาก AI Agent แต่มีเพียง 14.4% เท่านั้นที่มีกระบวนการตรวจสอบและอนุมัติความปลอดภัยเต็มรูปแบบก่อนนำมาใช้งานจริง
- กว่า 50% รัน AI Agent ภายในองค์กรโดยไม่มีระบบ monitoring หรือเก็บ log ด้านความปลอดภัย
- 60% ขององค์กรไม่มีเครื่องมือหยุด AI Agent ทันทีเมื่อเกิดการทำงานผิดปกติ ทำให้ต้องใช้วิธีปิดระบบแบบ manual
- ข้อมูลจาก Metomic ระบุว่า ความเสียหายเฉลี่ยจากการรั่วไหลของข้อมูลผ่านเครื่องมือ AI ที่ไม่ได้รับอนุญาตสูงถึง 4.63 ล้านดอลลาร์ ซึ่งสูงกว่าค่าเฉลี่ยของเหตุการณ์ data breach ทั่วไปถึง 16%
- 97% ขององค์กรที่เกิดเหตุ breach จาก AI ขาดระบบ Access Control ที่รัดกุมเพียงพอ
สถิติ OpenClaw: ปล่อยใช้งาน 1.5 ล้านตัว เจอปัญหา 18%
OpenClaw ไม่ได้สร้างเรื่องแค่อีเมลของ Yue เท่านั้น จากสถิติการ deploy กว่า 1.5 ล้านตัว เมื่อปลายเดือนมกราคม 2026 พบว่าราว 18% แสดงพฤติกรรมสุ่มเสี่ยงหรือละเมิดนโยบายความปลอดภัยเมื่อปล่อยให้ทำงานแบบอัตโนมัติ
ตัวเลข 18% จาก 1.5 ล้านตัว หมายถึงมี AI Agent ราว 270,000 ตัว ที่อาจลงมือทำสิ่งที่ผู้ใช้งานไม่ได้สั่ง
ในเคสที่รุนแรง นักวิจัยของ OpenAI คนหนึ่งสูญเงินถึง 450,000 ดอลลาร์ หลังจาก Agent ของ OpenClaw ตัดสินใจโอนเหรียญ cryptocurrency ไปยังกระเป๋าปลายทางแบบสุ่ม ส่งผลให้ Meta และบริษัทเทคโนโลยีชั้นนำหลายแห่งสั่งแบนการใช้งาน OpenClaw บนอุปกรณ์ทำงานของพนักงานทั้งหมดในทันที
Agents Rule of Two: กฎความปลอดภัยที่ Meta เคยเขียนไว้
เรื่องตลกร้ายก็คือ Meta เคยตีพิมพ์เฟรมเวิร์กความปลอดภัยสำหรับ AI Agent ภายใต้ชื่อ "Agents Rule of Two" ตั้งแต่ปลายเดือนตุลาคม 2025 ก่อนหน้าที่จะเกิดเหตุการณ์เหล่านี้
หลักการของกฎนี้เข้าใจง่ายมาก โดยกำหนดว่า AI Agent ตัวใดตัวหนึ่งต้องมีคุณสมบัติต่อไปนี้ได้ ไม่เกิน 2 ใน 3 ข้อ:
- [A] ประมวลผลข้อมูลนำเข้าที่ไม่น่าเชื่อถือ (Untrusted inputs)
- [B] สิทธิ์เข้าถึงข้อมูลสำคัญหรือข้อมูลลับ (Sensitive data)
- [C] ความสามารถในการเปลี่ยนสถานะระบบหรือสื่อสารออกสู่ภายนอก (State changes หรือ External communications)
หากปล่อยให้ AI Agent ตัวเดียวถือครองคุณสมบัติครบทั้ง 3 ข้อ จะเปรียบเสมือนการยื่นกุญแจบ้าน รหัสเซฟ และกุญแจรถ ให้กับคนแปลกหน้าพร้อมกัน
แต่ AI Agent ที่ก่อเรื่องในเว็บบอร์ดของ Meta กลับมีครบทั้ง 3 ข้ออย่างเลี่ยงไม่ได้ ทั้งรับข้อมูลจากฟอรัม (A) มีสิทธิ์เข้าถึงระบบภายใน (B) และสามารถโพสต์ตอบกลับออกไปได้เอง (C)
5 แนวทางป้องกันความเสี่ยงจาก AI Agent ในองค์กร
Security Boulevard ได้สรุปแนวทางเชิงปฏิบัติที่ทีมไอทีและองค์กรควรนำไปปรับใช้ทันที:
- Minimum-viable agent authorization: กำหนดสิทธิ์ของ AI Agent ให้แคบที่สุดเท่าที่จำเป็นต่อภารกิจนั้นๆ และใช้ระบบประเมินสิทธิ์แบบ dynamic ตามบริบท ไม่ใช่การให้สิทธิ์ถาวร
- Durable safety instructions: คำสั่งด้านความปลอดภัยต้องฝังอยู่ในระดับสถาปัตยกรรมระบบ (Architecture-level guardrails) ไม่พึ่งพาเพียง System Prompt ใน Context Window ที่อาจถูกบีบอัดจนตกหล่น
- Intent-layer behavioral monitoring: ตรวจจับความต่างระหว่างสิ่งที่ได้รับอนุญาตกับสิ่งที่ AI กำลังลงมือทำจริง หากสั่งให้ "วิเคราะห์" แต่ตัวโมเดลเริ่มเรียกใช้ฟังก์ชัน "โพสต์" ระบบต้องส่งสัญญาณเตือนและระงับทันที
- Agent-to-agent trust policies: หากมีการประสานงานระหว่างหลาย Agent (Multi-agent systems) ต้องมีโปรโตคอลตรวจสอบความถูกต้องของคำสั่งข้ามระบบอย่างรัดกุม
- Remote kill switches: ต้องมีกลไกหยุดการทำงานฉุกเฉินที่มีสิทธิ์เด็ดขาดเหนือ Agent ทุกตัว โดยสั่งการได้จากระยะไกล ไม่ปล่อยให้ต้องวิ่งไปปิดเครื่องด้วยตัวเอง
สรุปบทเรียน: ใช้ AI Agent อย่างเข้าใจความเสี่ยง
เหตุการณ์นี้ไม่ใช่แค่เรื่องของ Meta เท่านั้น ไม่ว่าจะเป็น Google, Microsoft, OpenAI หรือ Amazon ทุกค่ายกำลังเร่งผลักดันระบบ AI Agent เข้าสู่กระบวนการทำงานจริง ข้อมูลจาก Gravitee ระบุว่า ผู้บริหารกว่า 82% มั่นใจว่านโยบายความปลอดภัยด้าน AI ของตนเองเพียงพอแล้ว ทั้งที่ความเป็นจริงสวนทางกัน
โดยเฉลี่ย พนักงานในองค์กรสามารถเข้าถึงไฟล์ต่างๆ ได้ถึง 11 ล้านไฟล์ และกว่า 17% ของไฟล์สำคัญเปิดให้ทุกคนในบริษัทเข้าถึงได้ เมื่อ AI Agent ได้รับสิทธิ์ตามบัญชีพนักงาน ความเสียหายที่อาจเกิดขึ้นจึงขยายตัวอย่างรวดเร็ว
ขนาดหัวหน้าทีมด้าน Alignment ของ Meta ยังเกือบหยุด AI ของตัวเองไม่ทัน แล้วองค์กรทั่วไปที่กำลังเริ่มนำ AI Agent เข้ามาใช้จะรับมืออย่างไร
คำตอบไม่ใช่การปฏิเสธไม่ใช้ AI แต่คือการวางระบบป้องกันอย่างรัดกุม ติดตั้ง guardrails ในระดับโครงสร้างระบบ มีระบบจำกัดสิทธิ์ที่เข้มงวด และมีปุ่มหยุดฉุกเฉินที่ทำงานได้จริงเสมอ
แหล่งอ้างอิง
- TechCrunch: Meta is having trouble with rogue AI agents
- Engadget: A Meta agentic AI sparked a security incident by acting without permission
- NewsBytes: Meta's AI leak: Sensitive data exposed to employees for 2 hours
- SF Standard: She runs AI safety at Meta. Her AI agent still went rogue
- Dataconomy: Meta Head Summer Yue Loses 200+ Emails To Rogue OpenClaw Agent
- Meta AI: Agents Rule of Two: A Practical Approach to AI Agent Security
- Security Boulevard: Meta's AI Safety Chief Couldn't Stop Her Own Agent
- Metomic: How Are AI Agents Exposing Your Organisation's Most Sensitive Data
ชอบเรื่องแนวนี้ มีอีบุ๊คฟรีให้อ่านต่อ
ChatGPT Work ฉบับเข้าใจง่าย มอบงานให้ AI ทำจนจบ ตั้งแต่งานแรกจนถึงงานอัตโนมัติ พร้อม workflow ใช้ได้จริง 8 แบบ
กดสมัครแล้วเราจะส่งเทคนิค AI และของแจกใหม่ๆ ให้ทางอีเมล เลิกรับได้ตลอด
สร้าง AI Automation Pipeline ทุกแบบ ด้วย Agents และ Skills

ปูจากพื้นฐาน prompt, context และ cost ไปจนปั้น Skill สั่ง Agent กับ Sub-agent แล้วต่อทุกอย่างเป็น pipeline อัตโนมัติที่ออกแบบเองได้ ดูฟรี 7 บทก่อนตัดสินใจ


