ความเป็นอิสระที่มีปุ่มหยุด
เอเจนต์อัตโนมัติมีประโยชน์จนถึงวินาทีที่มันทำสิ่งที่ย้อนกลับไม่ได้ EDDI 6.2.0 เพิ่มการกำกับดูแลแบบมีมนุษย์ร่วมตัดสินใจ ด้วยจุดอนุมัติที่ชัดเจนใน 3 ระดับความละเอียด หนุนด้วยนโยบายหมดเวลา การตรวจจับลูป และสถานะที่อยู่รอดหลังการรีสตาร์ต การอนุมัติเป็นเรื่องของคอนฟิก ไม่ใช่โค้ดแอปพลิเคชันที่ต้องเขียนเอง
ทำไมจุดอนุมัติจึงควรอยู่ในแพลตฟอร์ม
ทีมส่วนใหญ่ต่อการอนุมัติไว้ที่ชั้นแอปพลิเคชัน: คิวตรงนี้ เว็บฮุกตรงนั้น แฟล็กในฐานข้อมูลอีกที่หนึ่ง วิธีนี้พังทันทีที่โปรเซสรีสตาร์ต ผู้อนุมัติออฟไลน์ หรือเอเจนต์วนส่งคำขอเดิมซ้ำ EDDI วางจุดอนุมัติไว้ในไปป์ไลน์การสนทนาโดยตรง เทิร์นที่ถูกหยุดจะยังคงหยุดอยู่ อินพุตที่แทรกเข้ามาจะถูกปฏิเสธด้วย 409 Conflict ที่ชัดเจน และทุกการตัดสินใจถูกบันทึกในเส้นทางตรวจสอบเดียวกับวงจรชีวิตส่วนที่เหลือของเอเจนต์
การอนุมัติสามระดับ
- การอนุมัติระดับเทิร์น: แอ็กชัน
PAUSE_CONVERSATIONหยุดไปป์ไลน์ทั้งหมด จนกว่าจะมีคนสั่งดำเนินการต่อ อินพุตของผู้ใช้ที่ตามมาจะได้รับ409 Conflictจึงไม่มีสิ่งใดแซงหน้าการตัดสินใจที่ค้างอยู่ - การกำกับรายการเรียกใช้เครื่องมือ: การเรียกใช้เครื่องมือแต่ละครั้งกำหนดให้ต้องผ่านการอนุมัติจากมนุษย์ก่อนทำงานได้ รายการอนุญาตและรายการยกเว้นแบบ glob ระบุได้แม่นยำว่าสิ่งใดต้องผ่านการอนุมัติ ครอบคลุมเครื่องมือในตัว, HTTP, MCP, A2A, แบบไดนามิก และเครื่องมือหน่วยความจำ
- การอนุมัติเฟสของกลุ่ม: เฟสการอภิปรายแบบหลายเอเจนต์กำหนดให้ต้องมีการอนุมัติจากมนุษย์ได้ที่ระดับ
PHASEหรือTASKเพื่อไม่ให้กลุ่มข้ามจากการวางแผนไปสู่การลงมือโดยไม่มีการกำกับ
นโยบายหมดเวลา
มนุษย์ไม่ใช่บริการที่พร้อมใช้งานตลอดเวลา ทุกจุดอนุมัติจึงต้องประกาศว่าจะเกิดอะไรขึ้นเมื่อไม่มีใครตอบทันเวลา:
WAIT_INDEFINITELY: การทำงานหยุดค้างไว้จนกว่าจะมีคนตัดสินใจ เหมาะกับงานที่ไม่ควรเกิดขึ้นโดยไม่มีคนดูแลAUTO_APPROVE: ดำเนินการต่อเมื่อหมดช่วงเวลารอ เหมาะกับงานความเสี่ยงต่ำที่การกำกับเป็นเพียงการสุ่มตรวจ ไม่ใช่ด่านบังคับAUTO_REJECT: ปฏิเสธการดำเนินการที่ค้างอยู่ และให้เอเจนต์เดินต่อตามเส้นทางกรณีถูกปฏิเสธABORT: ยุติการทำงานทันที เป็นทางเลือกที่ปลอดภัยที่สุดสำหรับปฏิบัติการที่ย้อนกลับไม่ได้หรือมีผลกระทบกว้าง
สร้างมาเพื่อการใช้งานจริง
ระบบอนุมัติวัดกันที่วันแย่ที่สุด: การรีสตาร์ตกลางการตรวจสอบ เอเจนต์ที่ถามคำถามเดิมซ้ำ และผู้อนุมัติที่ใช้ชีวิตอยู่ใน Slack มากกว่าในหน้าจัดการ
- ตัวป้องกันการไม่คืบหน้า: EDDI สร้างลายนิ้วมือให้ทุกการหยุด เมื่อลายนิ้วมือเดิมปรากฏซ้ำหลังการตัดสินใจอัตโนมัติ ระบบจะรู้ว่าเป็นลูปอนุมัติไม่รู้จบและตัดวงจรนั้น แทนที่จะเผาโทเคนไปเรื่อย ๆ
- การกู้คืนหลังระบบล่ม: การอนุมัติที่ค้างอยู่ยังคงอยู่หลังเซิร์ฟเวอร์รีสตาร์ต และตัวจับเวลาหมดเวลาจะถูกตั้งใหม่โดยอัตโนมัติ การดีพลอยแบบทยอยจึงไม่ทำให้การตัดสินใจที่กำลังดำเนินอยู่หายไปเงียบ ๆ
- การอนุมัติผ่าน Slack: การ์ด Block Kit แบบโต้ตอบนำการตัดสินใจไปหาผู้อนุมัติ พร้อมตัวอย่างอาร์กิวเมนต์ที่ปกปิดข้อมูลอ่อนไหว และรายชื่อผู้อนุมัติที่ได้รับอนุญาตเท่านั้นจึงจะกดได้
- การอนุมัติผ่าน MCP: ไคลเอนต์ภายนอกเรียกดูรายการอนุมัติที่ค้างอยู่ และอนุมัติหรือปฏิเสธผ่านเครื่องมือ MCP ซึ่งเป็นส่วนหนึ่งของเครื่องมือ 77 รายการ ทำให้ IDE หรือไคลเอนต์เอเจนต์กลายเป็นระนาบควบคุม
การกำกับดูแลและการปฏิบัติตามกฎระเบียบ
การกำกับดูแลโดยมนุษย์ไม่ใช่แค่ความชอบเชิงปฏิบัติการ แต่เป็นข้อกำหนดตามกฎระเบียบ จุดอนุมัติทำให้การกำกับดูแลโดยมนุษย์ตามมาตรา 14 ของ EU AI Act มีรูปธรรม: บุคคลที่ระบุตัวตนได้เป็นผู้อนุมัติการกระทำเฉพาะเรื่อง และการตัดสินใจนั้นถูกบันทึกไว้ เมื่อรวมกับกรอบการปฏิบัติตามกฎระเบียบของ EDDI และเส้นทางตรวจสอบแบบ HMAC-SHA256 คุณสามารถแสดงต่อผู้ตรวจสอบได้ทั้งว่าเอเจนต์ทำอะไร และใครอนุญาตเมื่อใด