ระบบตรวจสอบสถานะการทำงาน (Observability)
แพลตฟอร์มนี้มาพร้อมกับชุดซอฟต์แวร์ระบบตรวจสอบสถานะการทำงาน (observability stack) ประกอบไปด้วยข้อมูลชี้วัด (metrics) ล็อก (logs) และประวัติการร้องขอ (traces) แบบติดตั้งภายในระบบตัวเอง (self-hosted) ซึ่งถูกพัฒนาให้มีการแยกส่วนข้อมูลเป็นรายองค์กรอย่างสมบูรณ์ ข้อมูลการวัดระยะไกล (telemetry) ของลูกค้ารายหนึ่งจะไม่มีทางมองเห็นได้โดยลูกค้ารายอื่นอย่างเด็ดขาด โดยผู้ดูแลระบบสามารถตรวจสอบรายละเอียดผ่านแดชบอร์ดต่าง ๆ ได้โดยไม่มีการส่งข้อมูลใด ๆ ออกไปยังระบบคลาวด์ภายนอก
ผู้ที่มีสิทธิ์ในการเข้าถึงข้อมูลนี้
Org admin สามารถเข้าถึงแดชบอร์ดเฉพาะขององค์กรของตนเองได้ ส่วน Platform admin จะสามารถเข้าถึงแดชบอร์ดทั้งหมดได้ โดยสามารถเปิดแดชบอร์ดได้โดยตรงผ่าน console หรือเข้าใช้งานผ่าน Grafana หากผู้ดูแลแพลตฟอร์มเปิดช่องทางให้เข้าใช้งาน
ข้อมูลที่คุณสามารถตรวจสอบได้
- ปริมาณการใช้งานและค่าใช้จ่าย: ปริมาณ token และยอดเงิน USD แยกตามรายองค์กร โปรเจกต์ กลุ่ม ผู้ใช้งาน และโมเดล
- ยอดประหยัดจากการใช้งานแคช: อัตราการตรวจพบข้อมูลในแคช (hit rate) และยอดค่าใช้จ่ายที่ประหยัดไปได้จริง
- กิจกรรมการใช้งาน MCP: ปริมาณการเรียกใช้งานเครื่องมือแยกตามรายโปรเจกต์ เมื่อมีการใช้ระบบ MCP
- ประสิทธิภาพการทำงานของการร้องขอ: ปริมาณการรับส่งข้อมูล (throughput) และอัตราการเกิดข้อผิดพลาดหรือการร้องขอที่ถูกบล็อก

การแยกส่วนข้อมูลในแต่ละองค์กร
ข้อมูลชี้วัด ล็อก และประวัติการร้องขอของแต่ละองค์กร จะถูกแยกเก็บเป็นรายผู้เช่า (isolated tenant) และแดชบอร์ดจะถูกกำหนดขีดความสามารถการมองเห็นตามระดับองค์กรของผู้รับชมเท่านั้น โครงสร้างการจัดเก็บข้อมูลลักษณะนี้ช่วยรักษาสิทธิความเป็นส่วนตัวของข้อมูลระบบผู้เช่าได้อย่างสมบูรณ์ โดยระยะเวลาการจัดเก็บข้อมูลชี้วัด ล็อก และประวัติการร้องขอ จะถูกกำหนดโดยวิศวกรระบบแพลตฟอร์ม ดูรายละเอียดเพิ่มเติมได้ที่ ระบบตรวจสอบสถานะการทำงานของแพลตฟอร์ม
ขั้นตอนต่อไป
- งบประมาณและขีดจำกัด — นำข้อมูลจากแดชบอร์ดไปกำหนดขีดจำกัดงบประมาณ
- ประวัติการใช้งาน (Audit log) — ตรวจสอบประวัติว่าใครเป็นผู้ดำเนินการแก้ไขค่าใดบ้าง