AI trả lời sai dù đã được cung cấp tài liệu: kiểm tra nguyên nhân từ đâu?
Hướng dẫn điều tra AI và RAG trả lời sai bằng cách kiểm tra tài liệu, ingestion, chunking, embedding, retrieval, Top-K, reranking, prompt, citation và evaluation.

AI trả lời sai dù doanh nghiệp đã cung cấp tài liệu không có nghĩa model không đọc được tài liệu. Lỗi có thể nằm ở tài liệu nguồn, ingestion, chunking, metadata, embedding, retrieval, reranking, prompt, permission, memory, citation hoặc generation.
Sai lầm phổ biến là đổi model hoặc sửa prompt ngay. Nếu chunk đúng không được retrieve và đưa vào prompt cuối, model gần như không có cơ hội trả lời chính xác.
Nguyên tắc cốt lõi
Trước khi tối ưu model, hãy chứng minh dữ liệu đúng đã được ingest, chunk đúng có thể được retrieve, và model thực sự nhận được context đúng.
Bước đầu
Phân loại lỗi ở data, retrieval hay generation
Không điều tra toàn bộ hệ thống cùng lúc.
Chọn một câu hỏi cụ thể bị trả lời sai, xác định đáp án đúng và đoạn tài liệu gốc hỗ trợ đáp án. Sau đó theo dõi toàn bộ pipeline của đúng câu hỏi đó.






