Monitoring

บทความหมวด Monitoring จากทีม Dot Enterprise · ทั้งหมด 56 บทความ

หมวด Monitoring หนูรวมไว้ 56 บทความค่ะ พิมพ์คำที่อยากรู้ได้เลย หนูจะหาให้เฉพาะในหมวดนี้นะคะ เมี้ยว!

Monitoring

Workshop: ตั้งค่า On-Call Alerting ด้วย Prometheus + Alertmanager + PagerDuty

การมีระบบ Monitoring ที่ดีไม่เพียงพอหากไม่มี On-Call Alerting ที่สามารถแจ้งเตือนทีมได้ทันเวลาเมื่อเกิดปัญหาในเวลากลางคืนหรือวันหยุด การตั้ง Alertmanager…

Monitoring

Workshop: Monitor Kubernetes Cluster ด้วย Prometheus + Grafana

การรัน Kubernetes cluster ใน production โดยไม่มี monitoring ที่เหมาะสมเปรียบเหมือนการขับรถโดยปิดตา เราไม่เห็น pod ที่กำลัง crash loop ไม่รู้ว่า node ไหน…

Monitoring

Error Budget และการวางแผน Release

ทีมพัฒนาต้องตัดสินใจทุกวันว่าควร release ฟีเจอร์ใหม่เร็วแค่ไหน รับความเสี่ยงได้เท่าไหร่ และเมื่อไหร่ควรหยุดเพื่อเน้นแก้ปัญหา เสถียรภาพ การตัดสินใจแบบอาศัย…

Monitoring

SLO SLI SLA: Define Service Level Objectives ให้ชัดเจน

การรันระบบ production แบบไม่มีเป้าหมายด้าน reliability ที่ชัดเจน เป็นหนึ่งในสาเหตุหลักที่ทำให้ทีมวิศวกรและทีมธุรกิจไม่เข้าใจกันเรื่องคุณภาพบริการ ทีมหนึ่ง…

Monitoring

Observability vs Monitoring: ความต่างของ Metrics, Logs, Traces

คำว่า Monitoring และ Observability มักถูกใช้สลับกันในหลายทีม แต่ในทางปฏิบัติแล้วสองแนวคิดนี้ไม่ใช่สิ่งเดียวกัน Monitoring เน้นตอบคำถามที่ถูกคาดเดาไว้ล่วง…

Monitoring

Monitoring Strategy: เลือก Metrics ที่ควร Monitor

ปัญหาที่ทีม DevOps เจอบ่อยที่สุดไม่ใช่ "Metrics ไม่พอ" แต่เป็น "Metrics เยอะเกินจนไม่รู้จะดูอะไร" หรือในอีกมุมคือ เก็บทุกอย่างแต่ไม่มี Metric ไหนบอกได้ว่า…

Monitoring

Prometheus Client Libraries: Instrument Python/Node.js/Go Applications

การเลือก Prometheus client library สำหรับภาษาที่ใช้งานเป็นการตัดสินใจที่ส่งผลต่อ reliability, memory footprint และความสะดวกในการ maintain ระยะยาว แต่ละ…

Monitoring

Instrumentation: เพิ่ม Metrics ใน Application

การจะรู้ว่าแอปพลิเคชันทำงานดีหรือไม่ เพียงแค่เช็คว่า process ยังรันอยู่ไม่พอ เพราะแอปอาจรันได้แต่ตอบช้า มี error เยอะ หรือใช้ทรัพยากรเกินงบ การใส่…