Skip to content
ITNotes ITNotes

From Terminal to Cloud

  • AI
  • Linux
  • Networking
  • HomeLab
  • Programming
  • DevOps
  • Tiếng Việt
    • English
    • Tiếng Việt
    • 日本語
  • AI
  • Linux
  • Networking
  • HomeLab
  • Programming
  • DevOps
  • Tiếng Việt
    • English
    • Tiếng Việt
    • 日本語
Home » LLM » Trang 3
AI tutorial - IT technology blog
Posted inAI

Triển khai Text Generation Inference (TGI) với Docker để phục vụ LLM hiệu năng cao

Tháng 5 22, 2026
Loại bỏ các wrapper Python chậm chạp cho LLM. Tìm hiểu cách triển khai Text Generation Inference (TGI) với Docker để đạt throughput cao và latency thấp cho các dịch vụ AI.
Read More
AI tutorial - IT technology blog
Posted inAI

Tự triển khai Langfuse (Self-Hosting): Hướng dẫn thực tế về LLM Observability

Tháng 5 22, 2026
Loại bỏ việc phỏng đoán trong phát triển AI. Hướng dẫn thực tế này sẽ giúp bạn tự triển khai Langfuse để giám sát LLM toàn diện, từ độ trễ RAG đến chi phí token.
Read More
AI tutorial - IT technology blog
Posted inAI

Xây dựng AI Agent tin cậy với Smolagents: Chuyển dịch sang logic lấy mã nguồn làm trung tâm

Tháng 5 20, 2026
Vượt xa khỏi JSON tool-calling thiếu ổn định. Hướng dẫn này sẽ giúp bạn xây dựng các AI agent tự trị với smolagents, có khả năng viết và thực thi mã Python để giải quyết các tác vụ phức tạp.
Read More
AI tutorial - IT technology blog
Posted inAI

Làm chủ Llama-Factory: Hướng dẫn chuyên gia về Fine-Tuning LLM trên Linux

Tháng 5 17, 2026
Loại bỏ các phản hồi AI chung chung. Làm chủ Llama-Factory trên Linux để fine-tune LLM cho nhu cầu cụ thể của bạn bằng quy trình WebUI và CLI chuyên nghiệp.
Read More
AI tutorial - IT technology blog
Posted inAI

Đừng “Vibe Check” Prompt nữa: Hướng dẫn thực hành DeepEval

Tháng 5 11, 2026
Vượt qua các bước "vibe check" thủ công và học cách tự động hóa quy trình đảm bảo chất lượng LLM. Hướng dẫn này hướng dẫn cách sử dụng DeepEval để unit test prompt về tính trung thực, sự liên quan và ảo giác.
Read More
AI tutorial - IT technology blog
Posted inAI

Xây dựng AI Research Agent thời gian thực: Hướng dẫn LangChain và Tavily API

Tháng 5 9, 2026
Xây dựng AI Research Agent sẵn sàng cho môi trường production bằng LangChain và Tavily. Tìm hiểu cách kết nối LLM với internet để tổng hợp dữ liệu chính xác theo thời gian thực bằng Python.
Read More
AI tutorial - IT technology blog
Posted inAI

Xây dựng Hộp thư Thông minh hơn: Tự động hóa Phân loại Email với LangChain và Gmail API

Tháng 5 7, 2026
Loại bỏ quy trình phân loại thủ công. Tìm hiểu cách xây dựng hệ thống chuyên nghiệp sử dụng LangChain để phân loại email và Gmail API để tự động soạn thảo, rút ngắn thời gian phản hồi từ hàng giờ xuống còn vài phút.
Read More
AI tutorial - IT technology blog
Posted inAI

Tăng tốc độ LLM cục bộ: Hướng dẫn thực hành Speculative Decoding

Tháng 5 6, 2026
Tăng tốc độ LLM cục bộ của bạn lên gấp 2 lần hoặc hơn. Hướng dẫn này bao gồm cách thiết lập thực tế cho Speculative Decoding bằng llama.cpp và vLLM trên GPU dân dụng.
Read More
AI tutorial - IT technology blog
Posted inAI

Ngừng xây dựng các Bot hay quên: Hướng dẫn về bộ nhớ AI dài hạn với Mem0

Tháng 5 3, 2026
Các AI agent không nên quên bạn là ai. Hướng dẫn này chỉ cho bạn cách sử dụng Mem0 và Python để triển khai bộ nhớ dài hạn bền vững, giúp bot ghi nhớ sở thích người dùng qua các phiên làm việc và giảm chi phí token.
Read More
AI tutorial - IT technology blog
Posted inAI

Ngừng lãng phí Credit: Tối ưu hóa chi phí LLM với GPTCache và Redis

Tháng 5 1, 2026
Giảm 80% chi phí API LLM và cắt giảm độ trễ từ hàng giây xuống hàng mili giây. Hướng dẫn này tìm hiểu cách triển khai semantic caching cấp độ production bằng GPTCache và Redis.
Read More

Phân trang bài viết

Previous page 1 2 3 4 5 Next page
Copyright 2026 — ITNotes. All rights reserved.
Privacy Policy | Terms of Service | Contact: [email protected] DMCA.com Protection Status
Scroll to Top