Giảm chi phí API LLM: tối ưu token, chọn mô hình phù hợp, triển khai prompt caching, nên dùng khi chi phí AI tăng cao hoặc sắp ra mắt tính năng AI.