Từ bảng ra nhận xét: bắt AI tính sai, suy diễn quá đà
Đọc nhận xét AI đưa ra từ một bảng số liệu, tự kiểm từng con số, và nhận ra khi AI kết luận vượt quá những gì bảng chứng minh.
Kiểm tra lần cuối: 26/9/2026.
Sau bài này bạn sẽ: đọc được nhận xét AI đưa ra từ một bảng, tự kiểm ít nhất một con số, và chỉ ra được câu nào suy diễn vượt quá dữ liệu
⏱ khoảng 18 phút (đã tính thời gian chuyển qua lại giữa các app) · 💻 Cần máy tính · Tài khoản công cụ AI: 15+
Vì sao quan trọng

Sau ba bài, cô Hạnh gộp sổ hai tuần thành một bảng sạch mới. Cô hỏi AI: "nhận xét gì từ bảng này, nên vẽ biểu đồ gì?" AI trả lời rất gọn gàng, có số, có kết luận, nghe như một nhân viên phân tích giỏi. Nhưng gọn gàng không phải là đúng — có hai kiểu sai hay gặp: tính sai con số (cộng nhầm, đếm nhầm), và đúng số nhưng nói quá (kết luận nguyên nhân hay "có vấn đề" trong khi bảng chỉ cho thấy một khác biệt, chưa chứng minh được vì sao).
Nhận xét đúng và nhận xét tính sai
Đối chiếu đúng với bảng
- “Kem dưỡng thu tiền nhiều nhất — 2.560 nghìn đồng, dù chỉ bán 8 sản phẩm.”
- “Mặt nạ bán được nhiều sản phẩm nhất — 25 sản phẩm, nhưng thu tiền ít hơn vì giá rẻ.”
- “Đà Nẵng có tổng tiền cao nhất trong ba vùng.”
Sai khi đối chiếu lại
- “Tổng cả bảng là 8.355 nghìn đồng” — cộng sai, đối chiếu lại chỉ ra 6.505.
- “Vùng Hà Nội có tổng tiền cao nhất” — ngược hẳn: Hà Nội thực ra thấp nhất.
- “Son bán được nhiều sản phẩm nhất” — nhầm: Mặt nạ mới là sản phẩm bán nhiều số lượng nhất.
Bảng chỉ trả lời được "cái gì" (số nào cao, số nào thấp) — không tự trả lời được "vì sao". Ví dụ minh họa cho kiểu suy diễn quá đà (câu ví dụ, không phải câu AI đã nói trong lần chạy thật ở bài này): nếu AI viết "Hà Nội bán kém vì khách Hà Nội ít dùng mỹ phẩm", con số Hà Nội thấp nhất là đúng — nhưng lý do "ít dùng mỹ phẩm" thì bảng không hề ghi lại. Đây là suy diễn vượt quá dữ liệu: phải gạch bỏ phần lý do, hoặc hỏi lại xem AI dựa vào đâu mà nói vậy.
Thử ngay — xin nhận xét và biểu đồ, rồi tự soi lại
▶ Thử ngay
Bấm Chép câu lệnh dưới đây (bảng gộp hai tuần, dữ liệu bịa ra để tập luyện) rồi dán vào Gemini hoặc ChatGPT.
Câu lệnh để dán vào AI
Đây là sổ đơn hàng gộp hai tuần của tiệm mỹ phẩm, dữ liệu bịa ra để tập luyện, không phải khách thật. Đọc bảng CSV dưới đây rồi cho mình: (1) 2 đến 3 nhận xét quan trọng nhất, mỗi nhận xét phải có số cụ thể lấy từ đúng bảng này; (2) nên vẽ một biểu đồ gì để trình bày dễ hiểu nhất, vẽ trục gì. Ngày,Khách,Vùng,Sản phẩm,Số lượng,Đơn giá (nghìn đồng),Thành tiền (nghìn đồng) 03/06/2026,Chị Hoa,Hà Nội,Son,2,150,300 03/06/2026,Anh Tùng,Đà Nẵng,Kem dưỡng,1,320,320 04/06/2026,Chị Mai,Hà Nội,Mặt nạ,5,45,225 04/06/2026,Chị Lan,Cần Thơ,Sữa rửa mặt,3,90,270 05/06/2026,Anh Phúc,Hà Nội,Son,1,150,150 05/06/2026,Chị Yến,Đà Nẵng,Mặt nạ,10,45,450 06/06/2026,Chị Hương,Cần Thơ,Kem dưỡng,2,320,640 06/06/2026,Chị Hoa,Hà Nội,Sữa rửa mặt,1,90,90 07/06/2026,Anh Đức,Đà Nẵng,Son,3,150,450 07/06/2026,Chị Mai,Hà Nội,Kem dưỡng,1,320,320 10/06/2026,Chị Hoa,Hà Nội,Son,2,150,300 11/06/2026,Anh Tùng,Hà Nội,Kem dưỡng,1,320,320 12/06/2026,Chị Mai,Đà Nẵng,Mặt nạ,4,45,180 13/06/2026,Chị Lan,Đà Nẵng,Sữa rửa mặt,3,90,270 14/06/2026,Chị Hương,Cần Thơ,Kem dưỡng,2,320,640 15/06/2026,Anh Phúc,Hà Nội,Son,1,150,150 16/06/2026,Chị Yến,Đà Nẵng,Mặt nạ,6,45,270 17/06/2026,Anh Đức,Đà Nẵng,Son,3,150,450 18/06/2026,Chị Hoa,Hà Nội,Sữa rửa mặt,1,90,90 19/06/2026,Chị Mai,Cần Thơ,Kem dưỡng,1,320,320 20/06/2026,Chị Bích,Cần Thơ,Son,2,150,300
- Dán câu lệnh có bảng gộp 21 dòng vào khung chat.
- Gửi đi, chờ ChatGPT đưa nhận xét và gợi ý biểu đồ.
- Đọc từng số ChatGPT nêu ra.
- Tự cộng lại bằng Excel/Google Sheets hoặc máy tính bỏ túi, so từng số.
Xem một kết quả mẫu
Kết quả của bạn khác là bình thường. Hãy so 3 điểm dưới đây, không so từng chữ.
Chạy thật ngày 26/9/2026 trên ChatGPT và Gemini bản miễn phí, trình duyệt điện thoại, không đăng nhập.
ChatGPT trả lời nguyên văn:
Kem dưỡng tạo doanh thu cao nhất: tổng cộng 2.560 nghìn đồng, chiếm khoảng 30,6% tổng doanh thu 8.355 nghìn đồng.
Son bán được nhiều dòng đơn vị nhất: tổng 14 sản phẩm, so với 11 mặt nạ, 8 sữa rửa mặt và 7 kem dưỡng.
Hà Nội có doanh thu cao nhất: 2.645 nghìn đồng, tiếp theo là Đà Nẵng 2.070 nghìn đồng và Cần Thơ 2.190 nghìn đồng.
[…] Chiều cao các cột lần lượt: Son 2.100, Kem dưỡng 2.560, Mặt nạ 1.125, Sữa rửa mặt 630.Người soạn bài đã tự cộng lại bằng Python trên đúng 21 dòng để xác nhận đề bài (bạn chỉ cần tự cộng lại bằng Excel/Google Sheets hoặc máy tính bỏ túi như ở phần Câu kiểm tra dưới đây, không cần dùng Python): Kem dưỡng đúng 2.560 — số này ChatGPT nói đúng. Nhưng: tổng cả bảng thật ra là 6.505, không phải 8.355; Mặt nạ mới là sản phẩm bán nhiều số lượng nhất (25 sản phẩm), không phải Son (14) — ChatGPT liệt kê Mặt nạ chỉ 11, sai hẳn; và vùng có doanh thu cao nhất thật ra là Đà Nẵng (2.390), còn Hà Nội thấp nhất (1.945) — ChatGPT nói ngược hoàn toàn, bảo Hà Nội cao nhất. Ngay trong phần gợi ý biểu đồ, số "Sữa rửa mặt 630" cũng sai — đúng phải là 720; ba cột còn lại (Son 2.100, Kem dưỡng 2.560, Mặt nạ 1.125) thì đúng. ChatGPT còn viết thêm một câu giải thích biểu đồ rằng Kem dưỡng "chỉ bán 7 sản phẩm" — số đúng theo bảng là 8, một lỗi nhỏ nữa nằm ngay cạnh những số đã đúng. Một cột sai lẻ giữa các cột đúng là đúng kiểu lỗi khó phát hiện nhất: phải tự đối chiếu từng số trên biểu đồ, không chỉ nhìn hình có vẽ được hay không.
Gemini trả lời cùng câu hỏi, cùng bảng: tổng đúng 6.505, Kem dưỡng đúng 2.560 (8 sản phẩm), Mặt nạ đúng 25 sản phẩm thu 1.125, Đà Nẵng đúng 2.390 dẫn đầu, Cần Thơ 2.170, Hà Nội 1.945 — khớp hoàn toàn với số tự tính lại.
Cùng một bảng, cùng một câu hỏi: Gemini đúng toàn bộ, ChatGPT đúng một phần và sai nặng ở tổng và xếp hạng vùng. Đây chính là lý do bạn không được tin cả khối trả lời chỉ vì một con số trong đó đối chiếu đúng.

So 3 điểm:
- Số Kem dưỡng thu tiền nhiều nhất (2.560) đúng với bảng — kiểm được bằng cách tự cộng lại.
- Số tổng cả bảng và số xếp hạng theo vùng SAI hẳn — đối chiếu lộ ra ngay khi tự cộng lại.
- Trong cùng một câu trả lời, có số đúng và có số sai — không thể tin cả khối chỉ vì một phần đúng.
Con số đúng, nhưng nằm cạnh con số sai
ChatGPT vừa cho bạn thấy đúng điều bài học cảnh báo: một câu trả lời có thể vừa đúng vừa sai cùng lúc. Số "Kem dưỡng 2.560" đối chiếu đúng. Nhưng ngay cạnh đó, "tổng 8.355" và "Hà Nội cao nhất" lại sai hẳn — và ChatGPT viết cả hai với giọng chắc chắn y hệt nhau, không có tín hiệu nào báo trước câu nào đáng ngờ hơn câu nào.
Đây là lý do "đọc thấy một số đúng" không phải bằng chứng để tin toàn bộ câu trả lời. Việc của bạn: chọn từng số ra đối chiếu, không đối chiếu cả đoạn văn.
Kết quả khác dự kiến?
Nhận xét cần soi lại — sửa đúng chỗ
- AI cộng nhầm tổng cả bảng → tự cộng lại bằng Excel hoặc máy tính bỏ túi, chỉ ra đúng dòng bị cộng sai.
- AI xếp hạng nhầm vùng hoặc sản phẩm (trộn tổng tiền với số đơn) → hỏi lại rõ: “xếp theo Thành tiền hay theo số đơn?”
- AI đề xuất hành động (ngừng bán, cắt vùng) dựa trên quá ít dữ liệu → nhắc: “chỉ nêu số, đừng đề xuất hành động, mẫu còn nhỏ”.
- Biểu đồ AI gợi ý không hợp bảng (gợi ý biểu đồ tròn cho dữ liệu theo ngày) → chọn cột cho so sánh giữa các nhóm, chọn đường cho biến động theo thời gian.
Câu kiểm tra
Làm trên việc thật của bạn
Chọn một bảng số liệu thật của bạn — doanh thu tháng, danh sách chi tiêu, số buổi học của con. Bỏ tên khách hoặc tên nhân viên trước khi dán; số liệu doanh thu, chi phí của công ty chỉ dán vào AI miễn phí khi được phép — không chắc thì làm tròn số hoặc đổi tên nhóm (Vùng A, Sản phẩm 1). Chép khung dưới, dán bảng của bạn vào:
Câu lệnh để dán vào AI
Đây là bảng dữ liệu của tôi, dữ liệu thật/dữ liệu bịa để tập luyện. Cho tôi 2 đến 3 nhận xét, mỗi nhận xét phải trích đúng số có trong bảng. Nếu không đủ dữ liệu để kết luận nguyên nhân, hãy nói rõ "chưa đủ dữ liệu để kết luận", đừng đoán thêm. [dán bảng dạng CSV — dòng đầu là tên cột]
Đọc lại từng nhận xét: câu nào chỉ nêu số có trong bảng, câu nào suy thêm nguyên nhân hoặc đề xuất hành động. Tự cộng lại ít nhất một con số để chắc chắn.
Tự chấm
Tóm lại
- Bảng dài, con số nhiều — càng phải tự cộng lại ít nhất một chỗ trước khi tin.
- Nhận xét đáng tin chỉ nêu số có trong bảng; suy ra nguyên nhân hay đề xuất hành động thì cần thêm dữ liệu.
- Mẫu dữ liệu nhỏ (vài tuần, vài chục dòng) không đủ để kết luận "vùng có vấn đề" hay "ngừng bán".
Tên và giao diện sản phẩm thuộc về chủ sở hữu tương ứng. BaoPeak không liên kết, không được tài trợ bởi các công ty này.