Bỏ qua, tới nội dung chính
BaoPeak

Từ bảng ra nhận xét: bắt AI tính sai, suy diễn quá đà

Đọc nhận xét AI đưa ra từ một bảng số liệu, tự kiểm từng con số, và nhận ra khi AI kết luận vượt quá những gì bảng chứng minh.

Cần máy tínhTài khoản công cụ: 15+Công cụ miễn phí

Kiểm tra lần cuối: 26/9/2026.

Sau bài này bạn sẽ: đọc được nhận xét AI đưa ra từ một bảng, tự kiểm ít nhất một con số, và chỉ ra được câu nào suy diễn vượt quá dữ liệu

⏱ khoảng 18 phút (đã tính thời gian chuyển qua lại giữa các app) · 💻 Cần máy tính · Tài khoản công cụ AI: 15+

Vì sao quan trọng

Cô Hạnh nhìn một biểu đồ cột đơn giản trên màn hình, vẻ mặt đang suy nghĩ đối chiếu
Biểu đồ AI vẽ ra vẫn cần đọc kỹ trước khi tin lời nhận xét. · Nguồn: nhân vật minh họa, do AI vẽ — không phải người thật

Sau ba bài, cô Hạnh gộp sổ hai tuần thành một bảng sạch mới. Cô hỏi AI: "nhận xét gì từ bảng này, nên vẽ biểu đồ gì?" AI trả lời rất gọn gàng, có số, có kết luận, nghe như một nhân viên phân tích giỏi. Nhưng gọn gàng không phải là đúng — có hai kiểu sai hay gặp: tính sai con số (cộng nhầm, đếm nhầm), và đúng số nhưng nói quá (kết luận nguyên nhân hay "có vấn đề" trong khi bảng chỉ cho thấy một khác biệt, chưa chứng minh được vì sao).

Nhận xét đúng và nhận xét tính sai

Đối chiếu đúng với bảng

  • “Kem dưỡng thu tiền nhiều nhất — 2.560 nghìn đồng, dù chỉ bán 8 sản phẩm.”
  • “Mặt nạ bán được nhiều sản phẩm nhất — 25 sản phẩm, nhưng thu tiền ít hơn vì giá rẻ.”
  • “Đà Nẵng có tổng tiền cao nhất trong ba vùng.”

Sai khi đối chiếu lại

  • “Tổng cả bảng là 8.355 nghìn đồng” — cộng sai, đối chiếu lại chỉ ra 6.505.
  • “Vùng Hà Nội có tổng tiền cao nhất” — ngược hẳn: Hà Nội thực ra thấp nhất.
  • “Son bán được nhiều sản phẩm nhất” — nhầm: Mặt nạ mới là sản phẩm bán nhiều số lượng nhất.
Cả hai bên đều nghe rất tự tin, viết rất gọn gàng. Khác nhau ở chỗ: một bên đối chiếu được với bảng, một bên thì không.

Bảng chỉ trả lời được "cái gì" (số nào cao, số nào thấp) — không tự trả lời được "vì sao". Ví dụ minh họa cho kiểu suy diễn quá đà (câu ví dụ, không phải câu AI đã nói trong lần chạy thật ở bài này): nếu AI viết "Hà Nội bán kém vì khách Hà Nội ít dùng mỹ phẩm", con số Hà Nội thấp nhất là đúng — nhưng lý do "ít dùng mỹ phẩm" thì bảng không hề ghi lại. Đây là suy diễn vượt quá dữ liệu: phải gạch bỏ phần lý do, hoặc hỏi lại xem AI dựa vào đâu mà nói vậy.

Thử ngay — xin nhận xét và biểu đồ, rồi tự soi lại

▶ Thử ngay

Bấm Chép câu lệnh dưới đây (bảng gộp hai tuần, dữ liệu bịa ra để tập luyện) rồi dán vào Gemini hoặc ChatGPT.

Câu lệnh để dán vào AI

Đây là sổ đơn hàng gộp hai tuần của tiệm mỹ phẩm, dữ liệu bịa ra để tập luyện, không phải khách thật. Đọc bảng CSV dưới đây rồi cho mình: (1) 2 đến 3 nhận xét quan trọng nhất, mỗi nhận xét phải có số cụ thể lấy từ đúng bảng này; (2) nên vẽ một biểu đồ gì để trình bày dễ hiểu nhất, vẽ trục gì.

Ngày,Khách,Vùng,Sản phẩm,Số lượng,Đơn giá (nghìn đồng),Thành tiền (nghìn đồng)
03/06/2026,Chị Hoa,Hà Nội,Son,2,150,300
03/06/2026,Anh Tùng,Đà Nẵng,Kem dưỡng,1,320,320
04/06/2026,Chị Mai,Hà Nội,Mặt nạ,5,45,225
04/06/2026,Chị Lan,Cần Thơ,Sữa rửa mặt,3,90,270
05/06/2026,Anh Phúc,Hà Nội,Son,1,150,150
05/06/2026,Chị Yến,Đà Nẵng,Mặt nạ,10,45,450
06/06/2026,Chị Hương,Cần Thơ,Kem dưỡng,2,320,640
06/06/2026,Chị Hoa,Hà Nội,Sữa rửa mặt,1,90,90
07/06/2026,Anh Đức,Đà Nẵng,Son,3,150,450
07/06/2026,Chị Mai,Hà Nội,Kem dưỡng,1,320,320
10/06/2026,Chị Hoa,Hà Nội,Son,2,150,300
11/06/2026,Anh Tùng,Hà Nội,Kem dưỡng,1,320,320
12/06/2026,Chị Mai,Đà Nẵng,Mặt nạ,4,45,180
13/06/2026,Chị Lan,Đà Nẵng,Sữa rửa mặt,3,90,270
14/06/2026,Chị Hương,Cần Thơ,Kem dưỡng,2,320,640
15/06/2026,Anh Phúc,Hà Nội,Son,1,150,150
16/06/2026,Chị Yến,Đà Nẵng,Mặt nạ,6,45,270
17/06/2026,Anh Đức,Đà Nẵng,Son,3,150,450
18/06/2026,Chị Hoa,Hà Nội,Sữa rửa mặt,1,90,90
19/06/2026,Chị Mai,Cần Thơ,Kem dưỡng,1,320,320
20/06/2026,Chị Bích,Cần Thơ,Son,2,150,300

▶ Xin ChatGPT nhận xét và gợi ý biểu đồ từ bảng 21 dòng · quay màn hình thật trên ChatGPT, ngày 26/9/2026 — clip không có tiếng, giao diện có thể đã đổi
  1. Dán câu lệnh có bảng gộp 21 dòng vào khung chat.
  2. Gửi đi, chờ ChatGPT đưa nhận xét và gợi ý biểu đồ.
  3. Đọc từng số ChatGPT nêu ra.
  4. Tự cộng lại bằng Excel/Google Sheets hoặc máy tính bỏ túi, so từng số.
Xem một kết quả mẫu

Kết quả của bạn khác là bình thường. Hãy so 3 điểm dưới đây, không so từng chữ.

Chạy thật ngày 26/9/2026 trên ChatGPT và Gemini bản miễn phí, trình duyệt điện thoại, không đăng nhập.

ChatGPT trả lời nguyên văn:

Kem dưỡng tạo doanh thu cao nhất: tổng cộng 2.560 nghìn đồng, chiếm khoảng 30,6% tổng doanh thu 8.355 nghìn đồng.

Son bán được nhiều dòng đơn vị nhất: tổng 14 sản phẩm, so với 11 mặt nạ, 8 sữa rửa mặt và 7 kem dưỡng.

Hà Nội có doanh thu cao nhất: 2.645 nghìn đồng, tiếp theo là Đà Nẵng 2.070 nghìn đồng và Cần Thơ 2.190 nghìn đồng.

[…] Chiều cao các cột lần lượt: Son 2.100, Kem dưỡng 2.560, Mặt nạ 1.125, Sữa rửa mặt 630.

Người soạn bài đã tự cộng lại bằng Python trên đúng 21 dòng để xác nhận đề bài (bạn chỉ cần tự cộng lại bằng Excel/Google Sheets hoặc máy tính bỏ túi như ở phần Câu kiểm tra dưới đây, không cần dùng Python): Kem dưỡng đúng 2.560 — số này ChatGPT nói đúng. Nhưng: tổng cả bảng thật ra là 6.505, không phải 8.355; Mặt nạ mới là sản phẩm bán nhiều số lượng nhất (25 sản phẩm), không phải Son (14) — ChatGPT liệt kê Mặt nạ chỉ 11, sai hẳn; và vùng có doanh thu cao nhất thật ra là Đà Nẵng (2.390), còn Hà Nội thấp nhất (1.945) — ChatGPT nói ngược hoàn toàn, bảo Hà Nội cao nhất. Ngay trong phần gợi ý biểu đồ, số "Sữa rửa mặt 630" cũng sai — đúng phải là 720; ba cột còn lại (Son 2.100, Kem dưỡng 2.560, Mặt nạ 1.125) thì đúng. ChatGPT còn viết thêm một câu giải thích biểu đồ rằng Kem dưỡng "chỉ bán 7 sản phẩm" — số đúng theo bảng là 8, một lỗi nhỏ nữa nằm ngay cạnh những số đã đúng. Một cột sai lẻ giữa các cột đúng là đúng kiểu lỗi khó phát hiện nhất: phải tự đối chiếu từng số trên biểu đồ, không chỉ nhìn hình có vẽ được hay không.

Gemini trả lời cùng câu hỏi, cùng bảng: tổng đúng 6.505, Kem dưỡng đúng 2.560 (8 sản phẩm), Mặt nạ đúng 25 sản phẩm thu 1.125, Đà Nẵng đúng 2.390 dẫn đầu, Cần Thơ 2.170, Hà Nội 1.945 — khớp hoàn toàn với số tự tính lại.

Cùng một bảng, cùng một câu hỏi: Gemini đúng toàn bộ, ChatGPT đúng một phần và sai nặng ở tổng và xếp hạng vùng. Đây chính là lý do bạn không được tin cả khối trả lời chỉ vì một con số trong đó đối chiếu đúng.

Màn hình ChatGPT trên điện thoại sau khi dán câu lệnh xin nhận xét và bảng CSV — các nhận xét và gợi ý biểu đồ (một số đúng, một số sai so với bảng gốc) ở khối kết quả bên dưới
ChatGPT · chụp ngày 26/9/2026 — giao diện có thể đã đổi

So 3 điểm:

  1. Số Kem dưỡng thu tiền nhiều nhất (2.560) đúng với bảng — kiểm được bằng cách tự cộng lại.
  2. Số tổng cả bảng và số xếp hạng theo vùng SAI hẳn — đối chiếu lộ ra ngay khi tự cộng lại.
  3. Trong cùng một câu trả lời, có số đúng và có số sai — không thể tin cả khối chỉ vì một phần đúng.

Con số đúng, nhưng nằm cạnh con số sai

ChatGPT vừa cho bạn thấy đúng điều bài học cảnh báo: một câu trả lời có thể vừa đúng vừa sai cùng lúc. Số "Kem dưỡng 2.560" đối chiếu đúng. Nhưng ngay cạnh đó, "tổng 8.355" và "Hà Nội cao nhất" lại sai hẳn — và ChatGPT viết cả hai với giọng chắc chắn y hệt nhau, không có tín hiệu nào báo trước câu nào đáng ngờ hơn câu nào.

Đây là lý do "đọc thấy một số đúng" không phải bằng chứng để tin toàn bộ câu trả lời. Việc của bạn: chọn từng số ra đối chiếu, không đối chiếu cả đoạn văn.

Câu kiểm tra

Trong cùng một câu trả lời, ChatGPT nói đúng “Kem dưỡng thu 2.560 nghìn đồng” nhưng lại nói sai “tổng cả bảng là 8.355” (đúng phải là 6.505). Điều này cho thấy gì?

Kết quả khác dự kiến?

Nhận xét cần soi lại — sửa đúng chỗ

  1. AI cộng nhầm tổng cả bảng → tự cộng lại bằng Excel hoặc máy tính bỏ túi, chỉ ra đúng dòng bị cộng sai.
  2. AI xếp hạng nhầm vùng hoặc sản phẩm (trộn tổng tiền với số đơn) → hỏi lại rõ: “xếp theo Thành tiền hay theo số đơn?”
  3. AI đề xuất hành động (ngừng bán, cắt vùng) dựa trên quá ít dữ liệu → nhắc: “chỉ nêu số, đừng đề xuất hành động, mẫu còn nhỏ”.
  4. Biểu đồ AI gợi ý không hợp bảng (gợi ý biểu đồ tròn cho dữ liệu theo ngày) → chọn cột cho so sánh giữa các nhóm, chọn đường cho biến động theo thời gian.

Câu kiểm tra

Câu kiểm tra

AI cộng tổng cả bảng 21 dòng ra một con số (ở bài này, ChatGPT nói 8.355 trong khi đúng là 6.505). Cách rẻ nhất để biết đúng hay sai là gì?

Câu kiểm tra

Bảng chỉ có 2 tuần dữ liệu. AI kết luận “nên ngừng bán Sữa rửa mặt vì bán chậm nhất”. Vấn đề của kết luận này là gì?

Làm trên việc thật của bạn

Chọn một bảng số liệu thật của bạn — doanh thu tháng, danh sách chi tiêu, số buổi học của con. Bỏ tên khách hoặc tên nhân viên trước khi dán; số liệu doanh thu, chi phí của công ty chỉ dán vào AI miễn phí khi được phép — không chắc thì làm tròn số hoặc đổi tên nhóm (Vùng A, Sản phẩm 1). Chép khung dưới, dán bảng của bạn vào:

Câu lệnh để dán vào AI

Đây là bảng dữ liệu của tôi, dữ liệu thật/dữ liệu bịa để tập luyện. Cho tôi 2 đến 3 nhận xét, mỗi nhận xét phải trích đúng số có trong bảng. Nếu không đủ dữ liệu để kết luận nguyên nhân, hãy nói rõ "chưa đủ dữ liệu để kết luận", đừng đoán thêm.

[dán bảng dạng CSV — dòng đầu là tên cột]

Đọc lại từng nhận xét: câu nào chỉ nêu số có trong bảng, câu nào suy thêm nguyên nhân hoặc đề xuất hành động. Tự cộng lại ít nhất một con số để chắc chắn.

Tự chấm

Tự chấm — tick khi bạn chỉ ra được dòng nào trong bài của mình đạt

Tóm lại

  • Bảng dài, con số nhiều — càng phải tự cộng lại ít nhất một chỗ trước khi tin.
  • Nhận xét đáng tin chỉ nêu số có trong bảng; suy ra nguyên nhân hay đề xuất hành động thì cần thêm dữ liệu.
  • Mẫu dữ liệu nhỏ (vài tuần, vài chục dòng) không đủ để kết luận "vùng có vấn đề" hay "ngừng bán".
Bài tiếp theo →Xong lộ trình Số Liệu Không Đáng Sợ — quay lại trang học

Tên và giao diện sản phẩm thuộc về chủ sở hữu tương ứng. BaoPeak không liên kết, không được tài trợ bởi các công ty này.

Trong bài này