ReRead / Dual-Process Prompting là gì?
ReRead (hay Dual-Process Prompting) là kỹ thuật yêu cầu AI đọc lại câu hỏi nhiều lần trước khi trả lời, tách rõ phần hiểu đề và phần giải quyết đề. Giống như khi mình làm bài thi, đọc kỹ câu hỏi hai lần rồi mới bắt tay viết, thay vì liều đọc lướt rồi làm đại.
Trong thực tế, kỹ thuật này thêm vào prompt một chỉ dẫn đơn giản kiểu: “Read the question again”, kèm theo việc cho AI chia quá trình thành hai giai đoạn. Giai đoạn một là suy nghĩ chậm, phân tích đề. Giai đoạn hai là thực hiện và trả lời. Nghiên cứu cho thấy đúng là có cải thiện độ chính xác trên các bài toán cần suy luận nhiều bước, đặc biệt với các model nhỏ.
Tại sao AI lại cần “đọc lại” câu hỏi?
Có một sự thật hơi ngược đời: đôi khi model ngôn ngữ trả lời sai không phải vì “ngu”, mà vì đọc hiểu đề sai. Hiện tượng này người ta gọi là goal misgeneralization — AI hiểu nhầm mục tiêu thật sự của câu hỏi, rồi tự tin giải một bài khác.
Mình hay gặp ví dụ kinh điển: câu hỏi kiểu “Kết quả của 3 cộng với product của 4 và 5 là bao nhiêu? Hãy trả lời chỉ bằng một chữ số.”. Nhiều model lao vào cộng hết mọi thứ lại (3+4+5=12) và quên mất yêu cầu trả lời ngắn gọn. Khi có ReRead, model dừng lại, đọc lại, nhận ra chữ “product” và yêu cầu “một chữ số”, và câu trả lời đúng hơn hẳn.
Dual-Process là gì, liên quan gì đến não người?
Cái tên Dual-Process lấy ý tưởng từ lý thuyết tư duy của nhà tâm lý học Daniel Kahneman: hệ thống 1 (System 1) nhanh, trực giác, tự động; hệ thống 2 (System 2) chậm, cân nhắc, tốn công. Con người hay sai ở những lúc dùng System 1 cho việc cần System 2, như tính nhầm tiền tip khi đang mệt.
AI cũng tương tự. Lượt suy luận đầu tiên thường mang tính “phản xạ”: nhìn từ khóa quen thuộc rồi tràn tới kết luận. ReRead chính là cách ép model chuyển sang “System 2” — dừng, tái đọc input gốc, kiểm tra lại mục tiêu, rồi mới hành động. Nói cách khác, đây là một biến thể rẻ tiền và dễ dùng của kỹ thuật suy luận chậm mà các reasoning model hiện đại đang làm tự động bên trong.
Cách dùng ReRead trong prompt như thế nào?
Cách đơn giản nhất mình hay dùng chỉ gồm hai dòng thêm vào cuối prompt:
1. “Read the question again, then think step by step.” (Đọc lại câu hỏi, sau đó suy nghĩ từng bước.)
2. Yêu cầu output chia hai phần: phần PHÂN TÍCH ĐỀ (AI nhắc lại yêu cầu bằng ngôn ngữ của nó) và phần TRẢ LỜI.
Bước AI nhắc lại đề bằng ngôn ngữ riêng cực kỳ quan trọng. Vì khi buộc model paraphrase lại yêu cầu, nó buộc phải xử lý ý nghĩa thay vì chỉ khớp từ khóa. Nếu AI nhắc sai đề, bạn cũng phát hiện ngay được prompt của mình đang nhập nhằng chỗ nào — coi như debug miễn phí.
ReRead có thật sự hiệu quả không?
Theo paper “Re-Reading Improves Reasoning in Large Language Models” (nhóm nghiên cứu năm 2023), kỹ thuật READ (REading Again and again) giúp tăng độ chính xác đáng kể trên các bộ benchmark như GSM8K hay Sports Understanding, và hiệu quả rõ nhất với prompt một lần, không cần gọi API nhiều vòng. Chi phí gần như bằng không — chỉ thêm vài chục token.
Góc nhìn cá nhân của mình: đây là một trong những kỹ thuật “lời rắn rẻ mạt” nhất mà bạn nên mặc định bỏ vào prompt khi làm việc với các model nhỏ hoặc khi câu hỏi có nhiều điều kiện ràng buộc. Với các reasoning model đời mới đã tự suy luận dài, lợi ích bớt rõ, nhưng vẫn không hại gì. Còn nếu bạn đang xây sản phẩm cho người dùng, ReRead rẻ hơn nhiều so với chạy lại toàn bộ truy vấn nhiều lần.
ReRead khác gì Chain-of-Thought?
Chain-of-Thought (CoT) là bảo AI suy nghĩ từng bước trước khi trả lời. ReRead bổ thêm một lớp phía trước: đọc lại và xác nhận đề trước khi bắt đầu chuỗi suy nghĩ. Hai cái kết hợp với nhau rất thuận — đọc lại để không giải sai đề, CoT để không tính sai từng bước. Bạn có thể xem bài Chain-of-Thought là gì để hiểu rõ phần sau.
Ngoài ra ReRead cũng gần họ hàng với Self-Ask, kỹ thuật cho AI tự đặt các câu hỏi phụ. Khác biệt nằm ở chỗ Self-Ask phân rã vấn đề thành nhiều câu hỏi con, còn ReRead chỉ tập trung vào việc thấu hiểu đầu vào gốc càng sâu càng tốt.
Khi nào nên dùng ReRead?
Dùng khi: câu hỏi dài, có nhiều điều kiện kèm theo (ví dụ “trả lời ngắn”, “chỉ dùng tiếng Việt”, “bỏ qua trường hợp X”); bài toán nhiều bước dễ hiểu nhầm đề; hoặc khi dùng model nhỏ muốn vắt thêm chút độ chính xác miễn phí.
Không cần lạm dụng khi: câu hỏi đơn giản một bước, hoặc đã dùng model reasoning tự suy luận sâu. Thêm ReRead vào mọi prompt một cách máy móc chỉ làm tốn token mà lợi ích biên rất nhỏ. Kỹ thuật tốt là biết khi nào dùng, chứ không phải dùng luôn luôn.
Kết luận
ReRead / Dual-Process Prompting là lời nhắc nhỏ với sức nặng lớn: bắt AI chậm lại, đọc lại đề, xác nhận đúng mục tiêu rồi mới giải. Nó rẻ, dễ áp dụng, và khắc phục đúng loại lỗi phổ biến nhất — hiểu sai đề. Lần tới viết prompt, thử thêm một dòng “read the question again” và so sánh kết quả, nhiều khi bạn sẽ ngạc nhiên đấy.

