Mối lo ở đây là chi phí và uy tín, khác với prompt injection (bảo vệ dữ liệu). Xếp phòng thủ theo thứ tự rẻ đến đắt.
1. Chặn ẩn danh. Yêu cầu đăng nhập cho tính năng tốn tiền. Nếu vẫn cho dùng thử, giới hạn theo IP + device fingerprint và cho hạn mức nhỏ.
2. Chặn ở tầng đầu vào — rẻ nhất, làm trước tiên.
- Giới hạn độ dài input theo ký tự và theo token.
- Giới hạn số request mỗi phút và mỗi ngày cho từng tài khoản.
- Chặn số hội thoại chạy song song trên một tài khoản.
3. Kiểm duyệt nội dung. Chạy input qua endpoint moderation trước khi gọi model chính — rẻ hơn nhiều so với để model sinh rồi mới chặn ở đầu ra.
4. Phát hiện dùng sai mục đích. Người dùng biến chatbot hỗ trợ sản phẩm thành trợ lý viết code hay dịch thuật vẫn tốn tiền của bạn. Đưa phạm vi vào system prompt, và theo dõi tỷ lệ câu hỏi ngoài phạm vi theo từng tài khoản như một tín hiệu lạm dụng.
5. Xử lý theo mức độ. Cảnh báo → giảm tốc (throttle) → tạm khoá tính năng → khoá tài khoản. Ghi log đầy đủ để đối chiếu khi người dùng khiếu nại.
Tín hiệu đáng theo dõi: số token mỗi người dùng mỗi ngày lệch xa trung vị, request đều đặn như máy, prompt lặp lại gần giống nhau ở tần suất cao.