Tháng 7 năm 2025, Bộ Việc làm và Quan hệ Lao động Úc nhận bản báo cáo rà soát hệ thống xử phạt người nhận trợ cấp, do Deloitte thực hiện với giá khoảng 439.000 đô la Úc. Vài tuần sau, một nhà nghiên cứu luật của Đại học Sydney đọc kỹ phần tài liệu tham khảo và thấy những cuốn sách chưa từng được viết ra.
Deloitte phải sửa báo cáo, thừa nhận có dùng AI, và hoàn lại một phần tiền. Vụ việc nghe như chuyện của hãng tư vấn lớn, nhưng kiểu lỗi đó có thể xảy ra ở bất kỳ ai đang dùng AI để soạn công văn, thuyết minh hay báo cáo giải trình. Bài này đi qua chuyện gì đã xảy ra, ba kiểu AI bịa trích dẫn, và cách soát trước khi ký.
Chuyện gì đã xảy ra
Báo cáo rà soát khung tuân thủ, một hệ thống tự động xử phạt người nhận trợ cấp khi họ bỏ lỡ nghĩa vụ như buổi hẹn tìm việc. Người phát hiện lỗi là Chris Rudge, nhà nghiên cứu luật phúc lợi và y tế của Đại học Sydney. Ông thấy ba loại vấn đề:
- Báo cáo dẫn những công trình nghiên cứu không tồn tại, gán cho những học giả có thật, trong đó có giáo sư luật Lisa Burton Crawford của Đại học Sydney và một nhà nghiên cứu của Đại học Lund, Thuỵ Điển.
- Một cuốn sách được gán cho giáo sư Crawford thuộc một lĩnh vực nằm ngoài chuyên môn của bà. Chính chi tiết lạc chỗ này khiến người đọc sinh nghi.
- Nặng nhất: báo cáo trích một đoạn văn không có thật trong bản án vụ Amato với Chính phủ Liên bang, một vụ án lớn về đòi nợ trợ cấp, và gán cho các đoạn 25 và 26 của phán quyết.
Ngày 26/9/2025, bản sửa lại được đăng. Ở phần phương pháp, Deloitte ghi thêm rằng nhóm thực hiện đã dùng một chuỗi công cụ dựa trên mô hình Azure OpenAI GPT-4o, do chính bộ đặt hàng cấp bản quyền và chạy trên hạ tầng của bộ, để lấp các chỗ trống trong phần đối chiếu và tài liệu. Hãng đồng ý hoàn khoản thanh toán cuối của hợp đồng, được báo chí Úc đưa tin là khoảng 98.000 đô la Úc.
Deloitte khẳng định những chỗ sửa không làm thay đổi nội dung, kết luận và kiến nghị của báo cáo. Một thượng nghị sĩ Úc thì nói thẳng rằng hãng đã dùng AI rất sai cách: trích sai lời thẩm phán và dẫn những tài liệu không tồn tại.
Tháng 11/2025, báo chí Canada phát hiện bản kế hoạch nhân lực y tế dài 526 trang mà Deloitte làm cho tỉnh Newfoundland và Labrador, trị giá khoảng 1,6 triệu đô la Canada, có ít nhất bốn trích dẫn tới những bài nghiên cứu không tồn tại. Các trích dẫn đó được dùng để đỡ cho phần phân tích chi phí và hiệu quả. Deloitte thừa nhận bốn trích dẫn sai, cho biết AI chỉ được dùng có chọn lọc để hỗ trợ một số ít trích dẫn, và giữ nguyên các kiến nghị.
Ba kiểu AI bịa trích dẫn
Mô hình ngôn ngữ viết theo xác suất. Nó sinh ra câu chữ nghe hợp lý nhất, chứ nó không tra cứu rồi chép lại. Vì vậy một tên sách, một số hiệu văn bản hay một câu trích có thể trôi chảy tới mức người đọc không nghĩ tới chuyện kiểm tra. Nhìn lại hai vụ trên, có ba kiểu lỗi, xếp theo mức khó phát hiện tăng dần:
| Kiểu lỗi | Ví dụ trong vụ Deloitte | Tương đương trong nghề kế toán ở Việt Nam |
|---|---|---|
| 1. Tài liệu không tồn tại | Sách và bài nghiên cứu chưa từng được viết, gán cho người có thật | Một thông tư, một công văn với số hiệu nghe rất đúng kiểu nhưng tra không ra |
| 2. Tài liệu có thật nhưng gán sai | Sách lạc lĩnh vực, gán cho một giáo sư luật | Nghị định có thật nhưng được gán cho nội dung thuộc một nghị định khác, hoặc ghi sai ngày hiệu lực |
| 3. Văn bản có thật, câu trích bịa | Bản án Amato có thật, đoạn 25 và 26 được trích thì không có | "Theo khoản 3 Điều 5 Nghị định…" có thật, nhưng khoản 3 không hề nói điều được trích |
Kiểu thứ ba nguy hiểm nhất, vì nó qua được bước kiểm tra lười. Tra tên văn bản thấy có thật là nhiều người dừng lại. Trong khi cái sai nằm ở chỗ văn bản đó không nói điều mình vừa trích.
Cách soát trích dẫn trước khi ký
Trích dẫn là phần AI hay sai nhất, lại là phần người ký chịu trách nhiệm trực tiếp. Một quy trình soát đủ dùng cho công văn, thuyết minh báo cáo tài chính hay hồ sơ giải trình:
- Lập danh sách mọi trích dẫn trong bản nháp: số hiệu văn bản, điều, khoản, điểm, và mọi câu đặt trong ngoặc kép.
- Mở tận nơi từng văn bản ở nguồn chính thức, không mở qua đường dẫn do chính AI đưa ra.
- Đối chiếu bốn thứ: số hiệu, ngày ban hành, tình trạng hiệu lực, và đúng điều khoản được nhắc.
- Đọc nguyên văn điều khoản và so với câu trích. Đây là bước bắt được kiểu lỗi thứ ba.
- Ghi lại việc soát: ai soát, soát lúc nào, soát ở nguồn nào. Đây là bằng chứng mình đã làm đủ phần việc của người ký.
Với văn bản pháp luật Việt Nam, bước ba còn một cái bẫy riêng: văn bản gốc có thể đã bị sửa đổi. Một điều luật đúng nguyên văn năm ban hành vẫn có thể sai so với bản đang có hiệu lực. Muốn chắc, phải xem cả danh sách văn bản sửa đổi, bổ sung.
AI làm tốt việc gom ý, dựng dàn bài, viết lại cho gọn, và gợi ý nên tra những văn bản nào. Việc xác nhận một văn bản có tồn tại và nói đúng điều mình trích thì phải làm bằng tra cứu, và người tra phải là người sẽ đứng tên.
Cái giá thật của một trích dẫn sai
Khoản tiền hoàn lại chỉ là phần nhỏ. Ở cả hai vụ, Deloitte đều khẳng định kết luận của báo cáo không đổi. Nhưng người đọc không còn cách nào biết chắc điều đó, vì chính phần căn cứ dựng nên kết luận đã có chỗ không thật. Uy tín của cả bản báo cáo phụ thuộc vào chỗ yếu nhất của nó.
Với người làm kế toán, điều này còn rõ hơn. Một công văn giải trình gửi cơ quan thuế dẫn sai điều khoản không chỉ làm hỏng lập luận ở chỗ đó. Nó khiến người đọc nghi ngờ mọi thứ còn lại trong hồ sơ.
Kết lại
AI giúp soạn nhanh hơn nhiều lần. Đổi lại, nó chuyển trọng tâm công việc từ viết sang kiểm. Người dùng AI giỏi là người biết chỗ nào AI hay sai và dành thời gian soát đúng chỗ đó.
Phép thử đơn giản trước khi ký bất kỳ văn bản nào có phần do AI soạn: mỗi trích dẫn trong đó, mình đã tự mở ra đọc chưa? Nếu câu trả lời là chưa, văn bản đó chưa sẵn sàng để ký.
Học cách kiểm đầu ra của AI
Khoá AI Thực Chiến Cho Kế Toán của Mèo Cam mở đầu bằng đúng chuyện này. Bài 0.2 Ba kiểu sai của AI mà kế toán bắt buộc phải nhận ra nằm trong Level 0 miễn phí, có chứng nhận. Level 1 kết thúc bằng quy trình tự kiểm bốn bước trước khi dùng bất kỳ đầu ra nào của máy.
Câu hỏi thường gặp
Deloitte đồng ý hoàn khoản thanh toán cuối của hợp đồng, được báo chí Úc đưa tin là khoảng 98.000 AUD, trên tổng giá trị hợp đồng khoảng 439.000 AUD. Bản báo cáo sửa lại được công bố ngày 26/9/2025.
Báo cáo dẫn những công trình nghiên cứu không tồn tại, gán cho những học giả có thật như giáo sư luật Lisa Burton Crawford của Đại học Sydney, và trích một đoạn không có thật trong bản án vụ Amato với Chính phủ Liên bang, gán cho các đoạn 25 và 26 của phán quyết.
Bản sửa lại của báo cáo ghi rõ nhóm thực hiện đã dùng một chuỗi công cụ dựa trên mô hình Azure OpenAI GPT-4o, do chính bộ đặt hàng cấp bản quyền và chạy trên hạ tầng của bộ.
Mô hình ngôn ngữ tạo ra văn bản theo xác suất, nên nó có thể sinh ra một tên sách, một số hiệu văn bản hay một câu trích nghe rất hợp lý mà không hề tồn tại. Nó không tra cứu rồi chép lại, nên trích dẫn trôi chảy chưa chắc là trích dẫn thật.
Mở tận nơi từng văn bản được dẫn, đối chiếu số hiệu, ngày ban hành, tình trạng hiệu lực và đúng điều khoản được nhắc. Kiểu lỗi nguy hiểm nhất là văn bản có thật nhưng nội dung được trích lại không có trong văn bản đó, nên không thể chỉ kiểm tên văn bản.
Không. Cũng trong năm 2025, một báo cáo kế hoạch nhân lực y tế trị giá 1,6 triệu CAD mà Deloitte làm cho tỉnh Newfoundland và Labrador của Canada bị phát hiện có ít nhất bốn trích dẫn tới những bài nghiên cứu không tồn tại.
Nguồn tham khảo
Fortune, Deloitte to partially refund Australian government over AI-generated errors, 07/10/2025
The Register, Deloitte refunds Australian government over AI in report, 06/10/2025
OECD.AI, sự cố ghi nhận ngày 05/10/2025
Fortune, Deloitte report for Canadian government contained fabricated citations, 25/11/2025
CBC News, N.L. asks Deloitte to carry out review after incorrect citations found