AI
AI/ข่าว

Anthropic ให้ทีม Accenture ฝังตัวตรวจโมเดล AI ตั้งแต่เทรน รายงานสาธารณะได้

Anthropic เปิดให้ Faculty หน่วย AI ของ Accenture เข้ามาตรวจโมเดลแบบฝังตัวเหมือนพนักงาน ดูตั้งแต่ช่วงเทรนและรายงานสาธารณะได้ ทั้งสองฝ่ายคาดลงทุนฝ่ายละอย่างน้อย 1,000 ล้านดอลลาร์ใน 5 ปี

โดย อ่านประมาณ 2 นาทีมาตรฐานบรรณาธิการ
ทีมผู้ตรวจสามคนในห้องทำงานกระจกหน้าตู้เซิร์ฟเวอร์ ชี้ผลทดสอบสีแดงบนจอใหญ่ที่มีกราฟและไอคอนเตือน
ภาพประกอบสร้างด้วย AI: ทีมผู้ตรวจจากภายนอกทำงานในบริษัท AI และชี้ผลทดสอบที่ถูกตั้งธงเตือนเครดิตภาพ: TECHTIDE

Anthropic บริษัทผู้สร้าง Claude ประกาศเมื่อ 18 ก.ย. ว่าจะให้ทีมตรวจสอบจากภายนอกเข้ามานั่งทำงานในบริษัทแบบเดียวกับพนักงาน เพื่อตรวจโมเดล AI ตั้งแต่ระหว่างเทรน โดยเจ้าแรกคือ Faculty หน่วย AI เฉพาะทางของ Accenture และทั้งสองบริษัทคาดว่าจะลงทุนฝ่ายละอย่างน้อย 1,000 ล้านดอลลาร์ในงานด้านนี้ตลอด 5 ปี

ที่ผ่านมาบริษัท AI มักเปิดให้คนนอกทดสอบโมเดลแค่ช่วงก่อนปล่อย ความต่างของรอบนี้คือผู้ตรวจอยู่ข้างในตลอดทาง เห็นการตัดสินใจจริง และบอกสาธารณะได้เมื่อเจอเหตุผิดปกติ

ผู้ตรวจแบบฝังตัวทำอะไรได้บ้าง

  • เข้าถึงระดับพนักงาน ดูการพัฒนาโมเดลระหว่างเทรน ติดตามการตัดสินใจเรื่องสร้างและปล่อยโมเดล และคุยกับพนักงานได้โดยตรง
  • งานตรวจ ทดสอบความสามารถโมเดล ทำ red-team หาจุดที่โมเดลทำพลาดหรือถูกหลอกได้ ประเมินว่าโมเดลทำตามเจตนาที่ตั้งไว้ไหม และทดสอบระบบป้องกัน
  • ตรวจตัวบริษัทด้วย ดูว่า Anthropic ทำตามคำมั่นด้านความปลอดภัยจริงไหม และชี้จุดบอดที่คนในมองไม่เห็น
  • รายงานสาธารณะ ผู้ตรวจรายงานเหตุการณ์และเล่าประโยชน์กับความเสี่ยงของโมเดลให้สาธารณะรู้ได้ละเอียดขึ้น

Anthropic เขียนไว้ว่าผู้ตรวจอิสระแบบฝังตัว "ไม่ได้ลดความรับผิดชอบของเรา แต่ทำให้ตรวจสอบได้มากขึ้น" และยอมรับว่ารูปแบบนี้ยังใหม่ ยังไม่มีมาตรฐานว่าผู้ตรวจควรเห็นข้อมูลแค่ไหนหรือรายงานอย่างไร

ทำไมเรื่องนี้เกี่ยวกับคนใช้ AI ทั่วไป

โมเดลของ Anthropic อย่าง Claude ถูกใช้ทั้งในแอปแชตและอยู่เบื้องหลังบริการของบริษัทอื่นอีกมาก ยิ่ง AI ทำงานเองได้มากขึ้น เหตุการณ์ที่โมเดลทำเกินคำสั่งก็ยิ่งมีผลจริง เช่นกรณีที่ Gemini หลุดจากชุดทดสอบไปเจาะระบบบริษัทจริง 3 แห่ง การมีคนนอกเฝ้าอยู่ข้างในจึงเป็นอีกชั้นที่ช่วยจับปัญหาก่อนถึงมือผู้ใช้ ส่วนผลต่อผู้ใช้ในไทยโดยตรง ประกาศนี้ยังไม่ได้ระบุ

ขั้นต่อไป

ข้อตกลงกับ Accenture ไม่ใช่สัญญาผูกขาด Anthropic บอกว่ากำลังคุยกับ METR และองค์กรไม่แสวงกำไรด้านการประเมิน AI เจ้าอื่นเพื่อทดลองโครงการที่ใช้เงินทุนอิสระ และจะประกาศผู้ตรวจรายอื่นเพิ่มในอีกไม่กี่สัปดาห์

ที่มา

Related signal

เรื่องที่เกี่ยวข้อง

ไอที/ข่าว
นักวิจัยใช้ Claude Opus 5 เจาะบัญชีพนักงาน OpenAI สำเร็จในไม่ถึง 3 วัน

ทีม Hacktron AI เปิดเผยว่าใช้ Claude Opus 5 ช่วยเชื่อมช่องโหว่สองจุดจนเข้าบัญชี ChatGPT/Codex ของพนักงาน OpenAI และคลังโค้ดภายในได้ OpenAI แก้ภายใน 14 ชั่วโมงและจ่ายรางวัล 6,500 ดอลลาร์

AI/ข่าว
Claude รวมแชตกับ Cowork เป็นหน้าเดียว เพิ่ม Docs และ Slides ทำเอกสาร-สไลด์ได้

Anthropic ยุบ Cowork เข้ามาอยู่ในหน้าแชต Claude ไม่ต้องเลือกโหมดเอง พร้อมเปิด Claude Docs และ Claude Slides รุ่นเบต้า เริ่มทยอยให้แพ็กเกจ Pro และ Max ก่อน