Vì sao AI bịa: nó đoán chữ tiếp theo
Tự tay bắt AI "đoán chữ" bằng cách chạy cùng một câu hai lần, và biết một đoạn về năng lượng nó tốn mỗi lượt hỏi.
Kiểm tra lần cuối: 26/9/2026.
Sau bài này bạn sẽ: giải thích được bằng lời của mình vì sao AI “đoán chữ tiếp theo” chứ không tra cứu, và thấy điều đó qua một phép thử tự tay làm
⏱ khoảng 15 phút (đã tính thời gian chuyển qua lại giữa các app) · 📱 Chỉ cần điện thoại · Tài khoản công cụ AI: 15+
Vì sao quan trọng

Ở bài 2, bạn đã thấy AI ghi sai tên tác giả, tên tạp chí dù đường link vẫn mở được. Câu hỏi còn để ngỏ: vì sao nó bịa mà vẫn nghe rất tự tin?
Câu trả lời nằm ở cách nó được dựng. AI chat không có một kho "sự thật" để tra. Lúc huấn luyệnĐọc cả thư viện để đoán chữ, rồi được huấn luyện viên chấm để trả lời hữu ích (RLHF), nó chỉ làm đi làm lại đúng một việc, hàng nghìn tỷ lần: che một chữ, đoán chữ đó. Cứ thế cho tới khi nó nắm được "chữ nào hay đi sau chữ nào" ở gần như mọi chủ đề. Kết quả không phải một cuốn từ điển, mà là một file lớn chứa "cảm giác" về chữ — không giữ nguyên văn cuốn sách nào nó đã đọc.
Bàn phím điện thoại của bạn làm đúng một việc y hệt, chỉ nhỏ hơn nhiều: gõ "Kính gửi", nó gợi ý "anh", "chị", "quý khách" — đoán một hai chữ tiếp theo. AI chat làm phép đoán đó, nhưng đoán cả một đoạn văn, mỗi lần đọc lại toàn bộ câu hỏi rồi mới đoán tiếp một mảnh chữ. Với nó, viết ra một câu đúng và viết ra một câu nghe hợp lý là cùng một việc.
Thử ngay — chạy cùng một câu lệnh hai lần
▶ Thử ngay
Bạn sẽ gửi đúng một câu giống hệt nhau trong hai đoạn chat mới khác nhau, cùng một công cụ. Nếu AI chỉ "tra ra" một câu trả lời có sẵn, hai lần phải giống nhau. Nếu nó đang đoán từng mảnh chữ theo xác suất, hai lần có thể khác nhau dù cùng một câu hỏi.
Câu lệnh để dán vào AI
Viết tiếp thành đúng ba câu, giọng vui vẻ, đừng lặp lại nguyên văn câu đầu: "Sáng nay trời mưa,"
- Gửi câu lệnh trên trong đoạn chat mới này. Đọc kỹ ba câu AI viết ra.
- Mở một đoạn chat mới khác (không phải nhắn tiếp trong đoạn cũ). Dán lại y nguyên câu lệnh đó, gửi.
- So hai kết quả: câu nào giống, câu nào khác?
- Dán câu lệnh vào một đoạn chat mới.
- Gửi và đọc ba câu ChatGPT viết ra.
- Lượt 2 (đoạn chat mới khác, cùng câu lệnh) và bản Gemini đọc ở khối chữ bên dưới — cả ba lần ra ba hướng khác nhau.
Xem một kết quả mẫu
Kết quả của bạn khác là bình thường. Hãy so 3 điểm dưới đây, không so từng chữ.
Chạy thật 26/9/2026 trên ChatGPT bản miễn phí (không đăng nhập), hai đoạn chat mới độc lập, cùng câu lệnh:
Lượt 1:
Sáng nay trời mưa, nhưng chẳng đủ sức làm mình mất vui. Đường phố ướt át mà lòng vẫn cứ rộn ràng như có chuyện hay sắp đến. Thôi thì mang theo chiếc ô, nở nụ cười và bắt đầu ngày mới thật tươi!

Lượt 2:
Sáng nay trời mưa, đường phố bỗng mát rượi và cây cối trông cũng tươi tỉnh hơn hẳn. Mình tranh thủ pha một ly cà phê nóng, ngồi nghe tiếng mưa tí tách và thấy ngày mới thật dễ chịu. Ngoài kia có ướt một chút cũng chẳng sao, miễn là tâm trạng vẫn vui như nắng!
Hai đoạn khác nhau gần như hoàn toàn, dù xuất phát từ đúng một câu lệnh, cùng một công cụ, cách nhau vài phút. Trên Gemini bản miễn phí (cùng ngày), cùng câu lệnh đó lại ra một hướng thứ ba: cảnh "cuộn mình trong chăn ấm, nhâm nhi tách trà nóng" — không giống bản nào ở trên. Ba bản, ba hướng viết khác nhau, từ đúng một câu lệnh. Đây không phải lỗi: ở mỗi mảnh chữ, mô hình (phần tính toán ra câu trả lời, đôi khi gọi là "bộ não" của AI) không luôn chọn phương án "cao điểm nhất", mà bốc theo xác suất trong một tập các mảnh chữ hợp lý.
So 3 điểm:
- Hai lần chạy ra hai đoạn văn không giống hệt nhau, dù cùng một câu lệnh.
- Cả hai đều đúng ba câu, giọng vui vẻ — đúng yêu cầu, chỉ khác ở cách viết.
- Bạn giải thích được vì sao khác nhau: mỗi lần AI bốc một mảnh chữ theo xác suất, không tra lại một câu có sẵn.
Từ khi bạn gõ tới khi AI trả lời
Một lượt trả lời, nhìn theo từng bước bên trong
- 1
Bạn gõ câu hỏi
AI đọc toàn bộ câu hỏi và mọi chữ đã viết ra trước đó trong đoạn chat.
- 2
Tính xác suất
Với hàng trăm nghìn mảnh chữ có thể, mảnh nào "hợp" tiếp theo được tính một điểm cao thấp.
- 3
Bốc một mảnh
Không luôn lấy mảnh cao điểm nhất — có phần ngẫu nhiên, giống xúc xắc có gia trọng.
- 4
Nối vào rồi lặp lại
Mảnh vừa chọn được nối vào, rồi cả câu lại được đọc lại từ đầu để đoán mảnh kế tiếp.
Điều này giải thích luôn câu hỏi còn treo từ bài 2: vì sao AI bịa mà vẫn tự tin. Với nó, một câu có thật và một câu bịa ra đều được ghép bằng đúng một cách — chọn mảnh chữ nghe hợp lý nhất. Không có bước nào bên trong tự hỏi "cái này tôi có thật sự biết không". Trả lời cho hợp, không phải trả lời cho đúng.
Mỗi lượt hỏi cũng tốn một chút điện
AI không chỉ "nghĩ" trong đầu bạn — mỗi lượt gửi đi, câu hỏi được xử lý trên máy chủ rất lớn, và việc đó tốn điện thật. Google (hãng làm ra Gemini) công bố số đo của chính họ vào tháng 8 năm 2025:
0,24 Wh (oát-giờ) điện cho một lượt hỏi chữ (văn bản) ở mức giữa trên app Gemini, tương đương bật một chiếc tivi chưa tới 9 giây (Google Cloud Blog — Measuring the environmental impact of AI inference, 21/8/2025)Một lượt hỏi chữ thường không đáng kể. Nhưng tạo ảnh, tạo video, hay chế độCách dùng AI trong 1 lượt: chat nhanh, thinking, search, deep research, voice, ảnh/video, file, Projects, agent, coding agent; chọn theo việc, quan trọng hơn tên tool "suy nghĩ sâu" (bài 5) chạy nhiều bước hơn thì tốn nhiều hơn, vì mỗi bước lại là hàng nghìn lượt "đoán mảnh chữ" y như trên. Không có con số nào để nhớ thuộc lòng ở đây; điều đáng nhớ là: mỗi lượt hỏi đều có một chi phí tính toán thật, kể cả khi màn hình trước mặt bạn không cho thấy điều đó.
Kết quả khác dự kiến?
Hai lượt ra giống hệt nhau, hoặc khác quá xa
- Hai lượt giống hệt từng chữ → hiếm nhưng có thể xảy ra với câu lệnh rất ràng buộc. Thử lại với một câu lệnh mở hơn.
- Một trong hai lượt sai yêu cầu (không đúng ba câu, hoặc không vui) → AI đoán lệch, không phải lỗi máy. Xem lại câu lệnh có chỗ mơ hồ không (bài 3).
- Bạn thấy khó chịu vì "không có gì chắc chắn cả" → bình thường. Bài 6 và bài 8 dạy cách kiểm chứng khi cần chắc chắn hơn.
Câu kiểm tra
Làm trên việc thật của bạn
Nghĩ về một câu bạn hay hỏi AI (viết tin nhắn, xin ý tưởng, dịch một câu…). Gửi câu đó trong hai đoạn chat mới như bạn vừa làm ở trên, rồi tự trả lời:
Câu tự hỏi mình — không gửi cho AI
Hai kết quả của tôi khác nhau ở chỗ nào? Kết quả nào tôi thích hơn, và vì sao? Nếu phải chọn một để dùng thật, tôi sẽ chọn kết quả nào — và tôi còn cần sửa gì trước khi dùng?
Đây là câu bạn tự hỏi mình, ngay trong ghi chú hoặc đầu bạn, sau khi so hai kết quả — không phải câu để gửi cho AI.
Tự chấm
Tóm lại
- AI chat không tra một kho sự thật — nó đoán từng mảnh chữ, dựa trên xác suất "chữ nào hay đi sau chữ nào".
- Cùng một câu lệnh có thể ra hai kết quả khác nhau, vì mỗi lần nó bốc chữ theo xác suất, không lấy lại một câu có sẵn.
- Mỗi lượt hỏi cũng tốn một chi phí tính toán và điện năng thật, dù bạn không nhìn thấy điều đó trên màn hình.
Tên và giao diện sản phẩm thuộc về chủ sở hữu tương ứng. BaoPeak không liên kết, không được tài trợ bởi các công ty này.
Giao việc rõ: Mục tiêu – Bối cảnh – Đầu ra – Rà soát
Biến một câu lệnh cụt thành câu lệnh đủ bốn phần, để AI làm đúng việc ngay lần đầu.
Chọn đúng chế độ: trò chuyện, tìm kiếm, suy nghĩ sâu
Trước mỗi câu hỏi, tự hỏi hai câu để chọn đúng chế độ — và nhận ra khi AI đang trả lời "từ trí nhớ" thay vì tra cứu.