Networking tutorial - IT technology blog

Giám Sát Dịch Vụ Mạng Chủ Động với Prometheus Blackbox Exporter: HTTP, TCP, DNS và ICMP Không Cần Agent

Prometheus Blackbox Exporter cho phép bạn chủ động giám sát HTTP endpoint, TCP port, DNS record và kết nối ICMP từ bên ngoài — không cần agent hay thay đổi code. Hướng dẫn này bao gồm cài đặt, bốn loại probe, cấu hình relabeling trong Prometheus và các mẹo thực tế từ sáu tháng sử dụng thực tế.
DevOps tutorial - IT technology blog

Làm Chủ Prometheus Alertmanager: Routing, Grouping, Inhibition và Gửi Cảnh Báo Thông Minh đến Telegram và PagerDuty

Các tính năng routing, grouping và inhibition của Prometheus Alertmanager là thứ phân biệt monitoring hoạt động được với alerting chuẩn production. Hướng dẫn này trình bày cách cấu hình alertmanager.yml có cấu trúc với routing theo team, grouping giảm nhiễu, inhibition rules để triệt tiêu alert storms, và tích hợp thực tế với Telegram và PagerDuty.
DevOps tutorial - IT technology blog

Continuous Profiling với Grafana Pyroscope trên Kubernetes: Tìm Bottleneck CPU và Memory trong Production

Grafana Pyroscope mang continuous profiling lên Kubernetes, cho phép bạn thu thập flame graph CPU và memory từ ứng dụng production liên tục 24/7. Bài viết hướng dẫn triển khai Pyroscope qua Helm, scrape ứng dụng Go bằng pull mode, instrument Python với SDK, và đọc flame graph để tìm bottleneck thực sự — không cần đoán mò.
Networking tutorial - IT technology blog

Giám Sát Hiệu Năng Mạng Linux với Prometheus và Grafana: Hướng Dẫn Từ A đến Z

Hướng dẫn giám sát hiệu năng mạng Linux với Prometheus, node_exporter và Grafana. Bài viết bao gồm cài đặt, các PromQL query quan trọng cho TCP retransmit và packet drop, cách cấu hình Grafana dashboard và alerting rule cho môi trường production — đúc kết từ kinh nghiệm thực tế xử lý sự cố bão hòa mạng âm thầm.
DevOps tutorial - IT technology blog

Quan sát Toàn diện trong DevOps: Hướng dẫn về OpenTelemetry

Hướng dẫn này minh họa cách triển khai khả năng quan sát toàn diện trong DevOps bằng OpenTelemetry. Tìm hiểu cách hợp nhất dấu vết, chỉ số và nhật ký để phản ứng sự cố nhanh hơn và hiểu sâu hơn về các hệ thống phân tán của bạn, hoàn chỉnh với các ví dụ mã thực tế.