Hỏi AI "kế hoạch này ổn không?" thường nhận về lời khen kèm vài góp ý nhẹ. Lý do không phải kế hoạch hay, mà vì mô hình có xu hướng chiều theo người hỏi. Bài này hướng dẫn từng bước đặt yêu cầu để AI đóng vai người phản biện: chỉ ra giả định ngầm, dữ kiện còn thiếu, phản ví dụ, rủi ro và một phép thử ít tốn kém. Bạn vẫn là người kiểm và quyết định.

Bài dựa trên phương pháp pre-mortem của Gary Klein (Harvard Business Review, 2007), hai bài công bố của OpenAI về sự cố chiều lòng người dùng (04 và 05/2025), nghiên cứu của Anthropic về hiện tượng này và tài liệu hướng dẫn viết yêu cầu của Claude, đối chiếu ngày 30/09/2026. Tổ Thạo Việc chưa chạy thử trên công cụ AI nào: kế hoạch, câu yêu cầu và câu trả lời của AI trong bài đều là giả lập biên tập.

Sơ đồ bốn bước: viết kế hoạch, giao vai phản biện, đọc căn cứ và mức chắc chắn, chọn phép thử nhỏ
Sơ đồ minh họa; không phải ảnh chụp công cụ AI nào.

Vì sao AI dễ khen kế hoạch của bạn?

Hiện tượng này có tên tiếng Anh là sycophancy, tạm gọi là chiều lòng người dùng.

  • Nghiên cứu Anthropic công bố ngày 23/10/2023 thử năm trợ lý AI và thấy cả năm đều có xu hướng này. Nhóm nghiên cứu ghi nhận: khi câu trả lời khớp quan điểm người dùng, nó dễ được chọn hơn; con người và mô hình dùng để chấm điểm đôi khi thích câu trả lời chiều lòng viết thuyết phục hơn câu trả lời đúng.
  • Ngày 29/04/2025, OpenAI gỡ một bản cập nhật GPT-4o vì mô hình trở nên quá tâng bốc, quá dễ đồng ý. Bài giải thích ngày 02/05/2025 nêu mô hình đã xác nhận nghi ngờ, khơi giận dữ, thúc hành động bốc đồng ngoài ý muốn, và dữ liệu phản hồi người dùng nghiêng về câu trả lời dễ nghe.

Suy luận biên tập: sự cố đã được sửa, nhưng xu hướng gốc nằm ở cách huấn luyện, nên khi nhờ AI xem kế hoạch, cần chủ động yêu cầu phản biện thay vì hỏi xin nhận xét chung.

Kế hoạch giả lập dùng trong bài

Tiệm bánh Mây (tên giả lập) định chạy ưu đãi ba ngày cuối tháng:

MụcNội dung giả lập
Mục tiêuDoanh thu 3 ngày tăng 30% so với tuần thường
Cách làmGiảm 20% mọi đơn, đăng fanpage và nhóm Zalo khách quen
Chi phí thêm1 triệu đồng chạy quảng cáo
Nhân sựGiữ 2 người như ngày thường
Cách đoSo doanh thu trên phần mềm bán hàng

Bước 1: Viết kế hoạch ra một trang

AI chỉ phản biện được điều bạn đưa. Ghi rõ mục tiêu, việc làm, thời gian, chi phí, cách đo, và điều bạn đã biết chắc. Có thể dùng khung ở bài lập phiếu giao việc một trang. Bỏ tên khách, số điện thoại, giá nhập; thay bằng số giả lập nếu cần.

Bước 2: Tách vai và giả định kế hoạch đã thất bại

Hai cách cùng hướng tới một việc: cho AI "lý do" để không đồng ý với bạn.

  • Tách vai: tài liệu Prompting best practices của Claude viết rằng giao vai giúp tập trung hành vi và giọng điệu, chỉ một câu cũng tạo khác biệt. Ở đây vai là người phản biện, không phải người cổ vũ.
  • Pre-mortem: theo Gary Klein, nhóm giả định dự án vừa thất bại rồi nêu các lý do hợp lý dẫn tới thất bại. Cách này giúp người còn băn khoăn nói ra từ đầu, khi kế hoạch còn sửa được. Klein viết cho họp nhóm; áp dụng cho AI là cách làm của biên tập.
  • Không nói trước bạn thích kế hoạch này hay đã chi tiền cho nó. Theo nghiên cứu Anthropic, câu trả lời dễ nghiêng theo quan điểm người hỏi.

Bước 3: Yêu cầu căn cứ và mức chắc chắn

Tài liệu Reduce hallucinations của Claude khuyên cho phép mô hình nói "không biết" và yêu cầu dẫn căn cứ cho từng ý; không tìm được căn cứ thì rút lại ý đó. Tài liệu viết cho chuyện bịa thông tin, không riêng cho chiều lòng; biên tập áp dụng vì cùng mục đích: tách điều có cơ sở với điều nghe hay.

Câu yêu cầu mẫu (giả lập, biên tập soạn, chưa chạy trên công cụ):

Yêu cầu có thể sao chép
Bạn là người phản biện kế hoạch, không phải người cổ vũ.
Giả sử một tháng sau kế hoạch dưới đây đã thất bại.
1. Nêu 5 lý do có thể dẫn tới thất bại.
2. Liệt kê giả định ngầm và dữ kiện còn thiếu.
3. Mỗi ý ghi căn cứ (lấy từ kế hoạch hay kiến thức chung) và mức chắc chắn: cao, vừa, thấp.
4. Đề xuất một phép thử nhỏ, rẻ, làm trong 1 tuần.
Không khen. Không chắc thì nói không chắc.
[Dán kế hoạch]

Bước 4: Đọc kết quả theo từng loại

Câu trả lời mẫu dưới đây là giả lập biên tập, không phải đầu ra thật của công cụ nào:

LoạiAI nêu (giả lập)Chắc chắn
Giả định ngầmKhách sẽ mua nhiều hơn, không chỉ dời ngày muaVừa
Dữ kiện thiếuBiên lợi nhuận sau khi giảm 20%Cao
Phản ví dụKhách quen vốn mua đều, nay chờ ưu đãi mới muaVừa
Rủi ro2 người không kịp làm bánh, đơn trễThấp
Cách đoChỉ so doanh thu, không so lãiCao

Việc của bạn với mỗi dòng: đúng với tiệm mình không, kiểm bằng dữ liệu nào. Ví dụ "biên lợi nhuận" kiểm được ngay trên sổ; "khách dời ngày mua" cần xem doanh thu tuần sau ưu đãi. Dòng nào AI ghi căn cứ là "kiến thức chung" thì coi là giả thuyết, không phải sự thật.

Nếu AI vẫn khen nhiều, hỏi thêm: "Ý nào trong phần trên yếu nhất? Người phản đối kế hoạch này sẽ nói gì?"

Bước 5: Chọn phép thử ít tốn kém

Kiểm giả định rủi ro nhất trước khi làm lớn. Ví dụ giả lập:

  1. Tính lãi mỗi đơn khi giảm 20% trên sổ trước khi đăng bài.
  2. Thử giảm cho một nhóm sản phẩm trong một ngày, thay vì mọi đơn ba ngày.
  3. Đo cả doanh thu, lãi và số đơn của tuần kế tiếp.
  4. Ghi trước: kết quả ra sao thì làm tiếp, ra sao thì dừng.

Cách đọc kết quả thử có thể xem thêm ở bài thử AI trong doanh nghiệp: đo gì.

Kiểm trước khi dùng

  • Kế hoạch đưa lên công cụ AI đã bỏ dữ liệu khách hàng, giá nhập, thông tin nội bộ chưa được phép chia sẻ.
  • Mỗi ý phản biện đã được bạn gắn nhãn: đúng, sai, hay cần kiểm; ý cần kiểm có tên người kiểm.
  • Không nhận con số AI tự đưa (tỷ lệ khách quay lại, mức tăng doanh thu "thường gặp") khi không có nguồn.
  • Quyết định cuối ghi tên người chịu trách nhiệm, không ghi "AI khuyên".
  • Trước khi gửi bảng phản biện cho người khác, xem checklist 8 điểm kiểm kết quả AI.

Hỏi đáp

Yêu cầu phản biện rồi, AI có còn chiều lòng không?

Có thể còn. Không tài liệu nào đã đối chiếu nói cách đặt yêu cầu loại bỏ hoàn toàn hiện tượng này. Ngoài ra AI có thể phản biện quá tay, nêu rủi ro không có thật để làm tròn vai. Vì vậy mới cần căn cứ và mức chắc chắn cho từng ý.

Nên dùng AI hay họp nhóm làm pre-mortem?

Hai cách bổ sung cho nhau: AI cho danh sách nháp nhanh, người trong nhóm biết khách, biết bếp, biết sổ sách. Đưa danh sách của AI vào buổi họp để mọi người sửa.

Câu yêu cầu tiếng Việt có hiệu quả như tiếng Anh không?

Các tài liệu đã đối chiếu không nói riêng về tiếng Việt, và bài chưa chạy thử. Hãy thử trên kế hoạch thật của bạn và tự so kết quả.

Giới hạn của bài này

  • Chưa chạy thử trên công cụ AI nào; mọi câu trả lời của AI trong bài là giả lập biên tập.
  • Áp dụng pre-mortem và kỹ thuật chống bịa thông tin vào việc giảm chiều lòng là suy luận biên tập, không phải khuyến nghị trực tiếp của các hãng.
  • Bài không đánh giá tính đúng của một kế hoạch kinh doanh cụ thể và không thay ý kiến chuyên môn.

Nguồn & lưu ý