AI tutorial - IT technology blog

Cách Deploy Arize Phoenix trên Docker: Giám sát và Debug LLM, RAG, và AI Agent theo Thời gian Thực

Arize Phoenix là nền tảng observability mã nguồn mở giúp bạn theo dõi toàn bộ trace theo thời gian thực — từng lời gọi LLM, bước RAG retrieval đến từng hành động của AI agent. Hướng dẫn này sẽ giúp bạn deploy Phoenix bằng Docker và kết nối ứng dụng Python để bắt đầu giám sát prompt, completion, latency và điểm đánh giá ngay từ ngày đầu.
AI tutorial - IT technology blog

Đánh Giá LLM: Phương Pháp và Công Cụ Thực Tế Để Đo Chất Lượng Mô Hình AI Trên Production

Đánh giá LLM là thực hành đo lường có hệ thống xem đầu ra của mô hình AI có chính xác, liên quan và an toàn hay không — không chỉ là nhanh. Hướng dẫn này trình bày cách thiết lập thực tế với DeepEval và RAGAS, tích hợp CI/CD, và chiến lược giám sát production từ kinh nghiệm triển khai thực tế.