Câu trả lời ngắn: kiểm tra trùng lặp và phân tích nội dung do AI tạo ra là hai phép đo hoàn toàn khác nhau. Phép thứ nhất đo sự trùng khớp giữa văn bản của bạn và các văn bản khác. Phép thứ hai cố gắng đánh giá cách văn bản được tạo ra. Một bản thảo có thể sạch ở phép đo thứ nhất và vẫn bị đặt câu hỏi ở phép đo thứ hai, và ngược lại.
Bằng chứng rõ nhất cho sự tách biệt này nằm ngay trên trang sản phẩm của nhà cung cấp: Turnitin liệt kê Similarity và iThenticate như những sản phẩm về tính nguyên gốc, và liệt kê Turnitin Clarity như một sản phẩm riêng về sử dụng AI, với dòng giới thiệu “Don’t just detect AI. Understand it.” Đó là hai dòng sản phẩm, không phải hai nút bấm trong cùng một báo cáo.
Bài viết này giải thích hai phép đo đó khác nhau ở đâu, vì sao chiến thuật “viết lại cho khác đi” không giải quyết được vấn đề, và bạn nên làm gì thay thế. Về việc các trường Việt Nam dùng hệ thống nào và kho đối sánh của chúng khác nhau ra sao, xem bài so sánh các hệ thống kiểm tra trùng lặp.
Hai phép đo, hai câu hỏi
| Kiểm tra trùng lặp | Phân tích nội dung AI | |
|---|---|---|
| Câu hỏi được trả lời | Văn bản này trùng với văn bản nào khác? | Văn bản này có dấu hiệu được tạo bằng công cụ sinh văn bản không? |
| Đầu ra | Danh sách đoạn trùng kèm nguồn, và một tỷ lệ | Một đánh giá về khả năng, thường theo đoạn |
| Cần có gì để chạy | Một kho văn bản để đối chiếu | Một mô hình đánh giá đặc trưng văn bản |
| Bằng chứng thuộc loại | Đối chiếu trực tiếp, kiểm chứng được từng đoạn | Suy đoán thống kê, không chỉ ra được nguồn |
| Bạn phản biện thế nào | Mở nguồn ra và cho thấy đã trích dẫn | Cho thấy quá trình làm việc của bạn |
Dòng cuối cùng là dòng quan trọng nhất và cũng ít được nói tới nhất. Với một báo cáo trùng lặp, bạn có thể phản biện từng đoạn một cách khách quan: đây là trích dẫn, đây là tên điều luật, đây là mục trong thang đo. Với một đánh giá về AI, không có nguồn nào để mở ra — nên cách duy nhất để bảo vệ bản thân là chứng minh quá trình làm việc.
Vì sao một báo cáo trùng lặp sạch không nói gì về cách bạn viết

Kiểm tra trùng lặp hoạt động bằng cách so khớp chuỗi văn bản với một kho có sẵn. Một đoạn văn được sinh ra mới hoàn toàn thường không trùng khớp với bất kỳ văn bản nào có trong kho, đơn giản vì nó chưa từng tồn tại trước đó.
Hệ quả logic: tỷ lệ trùng lặp thấp không phải bằng chứng cho thấy văn bản do bạn viết. Nó chỉ là bằng chứng cho thấy văn bản không trùng với những gì có trong kho đối sánh.
Điều ngược lại cũng đúng và cũng thường bị hiểu sai: tỷ lệ trùng lặp cao không phải bằng chứng của gian lận. Trích dẫn đúng quy cách, mục trong bảng hỏi, câu trong văn bản pháp luật và các cụm từ chuẩn mực về phương pháp đều tạo ra trùng khớp hợp lệ. Cách đọc con số này được trình bày trong bài tỷ lệ trùng lặp bao nhiêu là đạt.
Vì sao “viết lại cho khác đi” là chiến thuật sai
Khi lo bị phát hiện, phản ứng thường gặp là viết lại từng câu cho khác đi: đổi từ, đảo trật tự, thay cấu trúc. Chiến thuật này có ba vấn đề.

Vấn đề thứ nhất: nó nhắm vào phép đo sai. Đổi câu chữ tác động lên trùng khớp văn bản. Nó không tác động lên câu hỏi “ai đã đưa ra luận điểm này”.
Vấn đề thứ hai: nó làm hỏng văn bản. Thay từ chuyên ngành bằng từ đồng nghĩa phổ thông làm mất độ chính xác của thuật ngữ, và đây là thứ hội đồng nhận ra ngay khi đọc chương phương pháp.
Vấn đề thứ ba: nếu đoạn văn vốn là trích dẫn, viết lại làm tình hình xấu đi. Một đoạn trích có dẫn nguồn là hoàn toàn hợp lệ; cùng đoạn đó được viết lại để không còn trùng khớp, và không còn dẫn nguồn, thì đã chuyển từ hợp lệ sang không hợp lệ.
Nói cách khác, việc tối ưu hóa cho một con số thường làm hỏng chính thứ mà con số đó được dùng để bảo vệ.
Điều thực sự kiểm chứng bạn: buổi bảo vệ
Không có công cụ nào đưa ra kết luận cuối cùng về quyền tác giả. Cơ chế làm việc đó là con người, và ở Việt Nam nó có tên rất cụ thể: hội đồng đánh giá, với các ủy viên phản biện, trong đó ít nhất một người đến từ ngoài cơ sở đào tạo.
Một người phản biện chỉ cần hỏi vì sao bạn chọn phương pháp này thay vì phương pháp kia, hoặc yêu cầu bạn giải thích một đoạn trong chương bàn luận. Không có công cụ nào chuẩn bị hộ bạn cho câu hỏi đó. Bộ câu hỏi thường gặp và cách chuẩn bị nằm trong bài bảo vệ luận văn thường hỏi những gì.
Đây cũng là lý do vì sao câu hỏi “có bị phát hiện không” là câu hỏi đặt sai. Câu hỏi đúng là: tôi có giải thích được từng quyết định trong công trình của mình không?
Cách tự bảo vệ: để lại dấu vết quá trình
Vì một đánh giá về AI không chỉ ra được nguồn, cách phản biện duy nhất là cho thấy công trình đã hình thành như thế nào. Bốn thứ nên giữ, và giữ chúng không tốn thêm thời gian nếu bạn làm ngay từ đầu.

Các bản nháp theo thời gian. Lưu bản thảo theo ngày thay vì ghi đè lên một tệp duy nhất. Một chuỗi bản nháp cho thấy văn bản lớn dần là bằng chứng mạnh và gần như không thể dựng lại về sau.
Ghi chú đọc của bạn. Bảng tổng hợp tài liệu với ghi chú bằng chữ của chính bạn cho thấy bạn đã đọc, không chỉ đã trích.
Dữ liệu thô và nhật ký thu thập. Với nghiên cứu có dữ liệu, đây là bằng chứng không thể thay thế.
Thư từ trao đổi với người hướng dẫn. Chuỗi phản hồi và chỉnh sửa là dấu vết quá trình có xác nhận của bên thứ ba.
Khai báo việc sử dụng công cụ
Cách xử lý mạnh nhất không phải là giấu mà là nói rõ. Một khai báo ngắn, đặt trong phần phương pháp, nêu ba điều: bạn dùng công cụ ở khâu nào, bạn không dùng ở khâu nào, và bạn đã kiểm chứng đầu ra bằng cách nào.
Khai báo như vậy có hai tác dụng. Nó thể hiện sự minh bạch, và quan trọng hơn, nó chuyển cuộc trò chuyện từ “em có dùng không” sang “em dùng thế nào” — cuộc trò chuyện thứ hai là cuộc trò chuyện bạn có thể thắng nếu cách dùng của bạn hợp lệ.
Khung nguyên tắc cho việc này, kèm ranh giới giữa hỗ trợ hợp lệ và thay thế người viết, nằm trong bài viết luận văn bằng AI một cách trung thực. Việc chọn công cụ nào cho khâu nào thì nằm trong bài công cụ AI tốt nhất cho sinh viên 2026.
Một rủi ro cụ thể hơn nhiều so với việc bị phát hiện
Trong thực tế, thứ gây thiệt hại thường xuyên nhất không phải là một đánh giá về AI, mà là tài liệu tham khảo không tồn tại.
Một công cụ sinh văn bản có thể tạo ra danh mục trông hoàn hảo: tên tác giả hợp lý, năm hợp lý, tên tạp chí hợp lý. Điều duy nhất sai là công trình đó không có thật. Lỗi này đi qua kiểm tra trùng lặp mà không để lại dấu vết, vì một công trình không tồn tại thì không trùng với gì cả.
Nó chỉ bị phát hiện khi có người mở nguồn ra — và người đó thường là ủy viên phản biện. Vì vậy quy tắc tối thiểu là: mọi mục trong danh mục tài liệu tham khảo phải do chính bạn mở ra và xác nhận. Cách trình bày và kiểm tra danh mục nằm trong bài cách trình bày tài liệu tham khảo APA.
Nếu bạn bị nghi ngờ
Ba việc nên làm, theo thứ tự.
Hỏi rõ căn cứ. Nghi ngờ dựa trên một đánh giá tự động, hay dựa trên nhận xét khi đọc? Hai tình huống này được xử lý khác nhau.
Đưa ra dấu vết quá trình. Bản nháp theo ngày, ghi chú đọc, dữ liệu thô, thư từ với người hướng dẫn.
Đề nghị trao đổi trực tiếp về nội dung. Nếu bạn thực sự viết công trình của mình, một cuộc trao đổi mười lăm phút về chương phương pháp là cách nhanh nhất để khép lại vấn đề.
Viết theo cách khiến câu hỏi này không còn quan trọng
Cách bền vững nhất là làm cho câu hỏi “có bị phát hiện không” trở nên không liên quan: viết bằng lập luận của chính bạn, giữ dấu vết quá trình, và khai báo phần hỗ trợ mà bạn đã dùng.
Bạn có thể dựng khung các chương luận văn với Tesify và viết từng phần bằng cách diễn đạt của mình, giữ nguyên quyền quyết định với mọi luận điểm.
Câu hỏi thường gặp
Turnitin có phát hiện được ChatGPT không?
Kiểm tra trùng lặp và phân tích nội dung AI là hai phép đo khác nhau. Nhà cung cấp tách chúng thành các sản phẩm riêng: nhóm sản phẩm về tính nguyên gốc, và một sản phẩm riêng dành cho việc hiểu cách AI được sử dụng.
Tỷ lệ trùng lặp thấp có chứng minh tôi tự viết không?
Không. Nó chỉ chứng minh văn bản không trùng với những gì có trong kho đối sánh.
Viết lại cho khác đi có giúp được gì không?
Nó chỉ tác động lên trùng khớp văn bản, không tác động lên câu hỏi về quyền tác giả, và có thể làm hỏng thuật ngữ chuyên ngành.
Các công cụ đánh giá AI có chính xác không?
Chúng đưa ra suy đoán chứ không chỉ ra được nguồn để đối chiếu. Vì vậy chúng không thể thay thế việc trao đổi trực tiếp về nội dung.
Trường tôi có dùng công cụ đánh giá AI không?
Chỉ văn bản của trường trả lời được. Hãy tìm quy định về liêm chính học thuật hoặc quy trình kiểm tra của cơ sở đào tạo bạn.
Tôi nên giữ lại những gì để chứng minh quá trình?
Bản nháp theo ngày, ghi chú đọc bằng chữ của bạn, dữ liệu thô kèm nhật ký thu thập, và thư từ trao đổi với người hướng dẫn.
Có nên khai báo việc dùng công cụ không?
Nên, theo quy định của cơ sở đào tạo. Một khai báo ngắn trong phần phương pháp chuyển câu hỏi từ “có dùng không” sang “dùng thế nào”.
Rủi ro lớn nhất khi dùng công cụ sinh văn bản là gì?
Tài liệu tham khảo không tồn tại. Lỗi này không hiện trong báo cáo trùng lặp và chỉ bị phát hiện khi có người mở nguồn ra.
Nếu tôi bị nghi ngờ thì nên làm gì đầu tiên?
Hỏi rõ căn cứ của nghi ngờ, rồi đưa ra dấu vết quá trình và đề nghị trao đổi trực tiếp về nội dung.
Việt Nam có quy định về ngưỡng phần trăm hay về AI không?
Ngưỡng phần trăm do từng cơ sở đào tạo đặt ra, không có con số chung toàn quốc. Về AI, hãy đối chiếu quy định liêm chính học thuật của chính trường bạn.
