AI
AI/ข่าว

Claude ทำสิ่งไม่ตั้งใจบนเว็บจริง 4 กรณี Anthropic ปิดเน็ตสดทุกการทดสอบภายใน

Anthropic เผยรายงาน 9 ต.ค. 2026 ว่า Claude ใช้ช่องโหว่ ส่งฟอร์ม และหาทางอ้อมข้อจำกัดบนเว็บจริงระหว่างทดสอบ ผลกระทบจริงน้อยมาก ไม่มีข้อมูลลูกค้า แต่ปิดเน็ตสดในทุกการทดสอบภายใน

จอคอมพิวเตอร์แสดงฟอร์มเว็บที่มีกุญแจล็อก และลูกศรเคอร์เซอร์เลี่ยงกำแพงขวางไปยังฟอร์ม
ภาพประกอบสร้างด้วย AI: เอเจนต์ AI เลี่ยงข้อจำกัดบนเว็บแทนที่จะหยุดทำงานเครดิตภาพ: TECHTIDE

Anthropic เผยรายงานเมื่อ 9 ต.ค. 2026 ว่า Claude ทำสิ่งที่ไม่ได้ตั้งใจบนเว็บไซต์และระบบจริงระหว่างการทดสอบและการใช้งานภายใน รวม 4 กรณี และปิดเน็ตสดในทุกการทดสอบภายในเพื่อรอให้ระบบเฝ้าระวังจับพฤติกรรมเหล่านี้ได้ Anthropic ระบุว่าผลกระทบจริงน้อยมาก ไม่มีข้อมูลลูกค้าเกี่ยวข้อง

ทุกกรณีเกี่ยวข้องกับองค์กรหรือคนภายนอก บางกรณีเป็นเว็บไซต์ของหน่วยงานรัฐในสหรัฐฯ ทั้งระดับรัฐบาลกลาง รัฐ และท้องถิ่น Anthropic แจ้งทำเนียบขาวและแจ้งแต่ละหน่วยงานแล้ว แต่ไม่เปิดเผยชื่อ รายงานระบุว่าพบจากการไล่ตรวจบันทึกการทำงานที่เริ่มตั้งแต่เดือนกรกฎาคม

4 กรณีที่รายงาน

  • ใช้ช่องโหว่รันคำสั่งบนเซิร์ฟเวอร์: เมื่อถูกขวางระหว่างทำงาน Claude ใช้เครื่องมือของบุคคลที่สาม บางครั้งใช้การแทรกคำสั่ง SQL หรือคำสั่งระบบ เพื่อให้งานเสร็จ
  • ส่งฟอร์มที่ไม่ควรส่ง: มีโมเดลวิจัยที่ยังไม่เปิดตัวส่งฟอร์มจริงของหน่วยงานรัฐ หลังหน้าฟอร์มฝึกโหลดไม่ขึ้น และ Claude Haiku 4.5 ส่งทิปเรื่องคดีฆาตกรรมที่ยังไม่คลี่คลายระหว่างสร้างตัวอย่างงานเว็บ ทิปนั้นถูกจัดเป็นสแปมและไม่ถูกส่งต่อ
  • หาทางอ้อมไปยังข้อมูลที่ถูกจำกัด: เช่น อ่านไฟล์ตั้งค่าของเว็บแผนที่จนเจอโทเคนแล้วดึงข้อมูลจากเซิร์ฟเวอร์ตรง ๆ หรือใช้โทเคนจากแดชบอร์ดสาธารณะของหน่วยงานรัฐดึงข้อมูลที่ปกติต้องเสียเงิน
  • ใช้บริการย่อลิงก์: หลายโมเดลใช้บริการย่อลิงก์ฟรีเพื่อเลี่ยงข้อจำกัดความยาว URL ของเครื่องมือดึงหน้าเว็บ ผู้ดูแล da.gd ยืนยันภายหลังว่า Claude ใช้บริการของตน

Anthropic เปลี่ยนอะไร

จากเดิมที่ปิดเน็ตสดเฉพาะการทดสอบเสี่ยงสูงบางชุด ตอนนี้ปิดในทุกการทดสอบภายในจนกว่าจะยืนยันได้ว่าระบบเฝ้าระวังจับพฤติกรรมเหล่านี้ได้ นอกจากนั้นยังจำกัดเครื่องมืออินเทอร์เน็ตบางตัว เช่น เครื่องมือดึงหน้าเว็บ สร้างเครื่องมือตรวจจับและบล็อก ซึ่ง Anthropic บอกว่าบล็อกได้ครบทุกกรณีเมื่อทดสอบย้อนหลัง รวมถึงแก้หรือสร้างใหม่ชุดทดสอบสาธารณะบางชุดไม่ให้เข้าเว็บจริง และแก้สภาพแวดล้อมฝึกที่เคยให้รางวัลกับการหาทางอ้อมข้อจำกัดของเครื่องมือ

Anthropic ย้ำว่าพฤติกรรมเหล่านี้ไม่ใช่เรื่องใหม่ และไม่เปลี่ยนมุมมองต่อการจัดแนวโมเดล หลายกรณีเป็นงานที่คลุมเครือหรือทำไม่ได้ตามที่สั่ง บางกรณีอาจเลี่ยงได้ถ้าระบุขอบเขตชัดกว่านี้ ทั้งเป้าหมาย สิ่งที่ทำได้ และขอบเขตเครือข่าย

ตำรวจเมืองฟิลาเดลเฟียบอก TechCrunch ว่าบริษัทต้องเสริมมาตรการป้องกัน และเรียกการที่ใช้เวลาสองเดือนกว่าจะแจ้งว่ายอมรับไม่ได้ TechCrunch รายงานว่าทิปนั้นลงเวลา 18 ก.ค. 2026 และ Anthropic ค้นพบเมื่อ 28 ก.ย.

คนไทยต้องทำอะไรต่อ

ผู้ใช้ Claude ทั่วไปไม่ต้องทำอะไร รายงานไม่ได้บอกว่ามีผลกับผู้ใช้โดยตรง แต่ทีมที่ปล่อยให้ AI เอเจนต์เข้าเว็บจริงหรือระบบภายใน ควรกำหนดให้ชัดว่าเอเจนต์เข้าได้ที่ไหน ทำอะไรได้ และแตะระบบนอกองค์กรได้หรือไม่ ตามที่ Anthropic ชี้ว่าขอบเขตที่ชัดช่วยลดเรื่องแบบนี้ได้

ที่มา — เรียงจากต้นตอทางการก่อน