Cách làm văn bản ChatGPT không thể bị phát hiện
ChatGPT viết trôi chảy, nhưng chính sự trôi chảy đó tố cáo nó trước các máy phát hiện như GPTZero và Turnitin. Bài hướng dẫn này đi qua một quy trình lặp lại được để biến đầu ra AI bóng bẩy nhưng máy móc thành bài viết đọc lên thực sự như của con người.
Vì sao đầu ra ChatGPT dễ bị phát hiện
ChatGPT được huấn luyện để tạo ra từ tiếp theo khả dĩ nhất, nên bài viết của nó mượt, an toàn và đều đặn đến kinh ngạc. Máy phát hiện khai thác điều này bằng cách đo văn bản dễ đoán và đồng đều đến đâu, và đầu ra AI thô đạt điểm cao ở cả hai. Đây không phải phép màu; đó là thống kê áp lên một cây bút cực kỳ nhất quán.
Hai dấu hiệu tố giác là perplexity thấp, nghĩa là cách chọn từ quá dễ đoán, và burstiness thấp, nghĩa là mọi câu rơi vào cùng một độ dài và nhịp điệu. Hãy yêu cầu ChatGPT viết 500 từ về bất kỳ chủ đề nào rồi đếm câu: hầu hết sẽ nằm giữa 15 và 25 từ, mỗi đoạn sẽ chạy ba đến bốn câu, và cả bài giữ một nhịp độ ổn định. Bài viết của con người chao đảo. Nó tăng tốc, chậm lại, lan man, và thi thoảng làm bạn bất ngờ với một câu năm từ. ChatGPT hiếm khi tự làm được điều nào trong số đó, và một máy phát hiện đọc hàng trăm vi tín hiệu này cùng lúc không cần chắc chắn về bất kỳ tín hiệu đơn lẻ nào.
Những cụm từ khuôn mẫu tố cáo ChatGPT
Ngoài thống kê, ChatGPT có những thói quen ngôn từ bạn có thể học cách nhận ra bằng mắt. Hãy giữ một danh sách đen trong đầu: đào sâu vào, hơn nữa, bên cạnh đó, đáng lưu ý là, trong thế giới hối hả ngày nay, đóng vai trò then chốt, điều hướng những phức tạp, một bức tranh đa sắc, mở khóa tiềm năng, và cụm không thể thiếu tóm lại. Không cụm nào tự thân là bằng chứng, nhưng bản nháp AI chồng chúng hết đoạn này sang đoạn khác, và các máy phát hiện huấn luyện trên hàng triệu mẫu đã học được mẫu hình đó. Nó cũng mê các danh sách gọn đúng ba mục, các cấu trúc đối xứng hoặc-này-hoặc-kia, và một đoạn kết nhắc lại mọi thứ bạn vừa đọc.
Nó giữ một văn phong trung tính, đều đặn từ câu đầu đến câu cuối, không bao giờ tự nghi ngờ hay phá vỡ khuôn mẫu. Người viết thật tự mâu thuẫn, chen một lời tâm sự, hay dùng một câu cụt để tạo hiệu ứng. Gỡ bỏ lớp bóng máy móc đó là phần lớn công việc để tạo ra văn bản AI không thể bị phát hiện, và tiện thay, cũng là phần lớn công việc để bài viết hay hơn.
Một phép tự kiểm nhanh: lướt bản nháp và tô sáng mọi cụm trong danh sách đen bên trên, mọi danh sách ba mục, và mọi đoạn mở đầu bằng từ chuyển ý. Nếu trang giấy sáng đèn, máy phát hiện cũng sẽ sáng đèn.
Chỉ prompt thôi có làm ChatGPT không thể bị phát hiện không?
Một phần, và đáng làm, nhưng đừng mong prompt hoàn tất công việc. Các chỉ dẫn như "viết như người", "thay đổi độ dài câu", "dùng lối nói co gọn và giọng thân mật", hay "viết theo phong cách một nghiên cứu sinh mệt mỏi" thực sự thay đổi bề mặt đầu ra. Prompt nhân vật và nhiệt độ cao hơn qua API cũng thêm chút đa dạng. Một bản nháp được prompt tốt thường có điểm thấp hơn bản mặc định.
Giới hạn nằm ở cấu trúc. Dù bạn prompt thế nào, mô hình vẫn lấy mẫu từ cùng một phân phối xác suất, nên các quy luật sâu hơn sống sót: độ dài đoạn đều đặn, cách chọn từ an toàn, sự vắng bóng của những khúc rẽ thực sự bất ngờ. Các bài thử liên tục cho thấy né tránh chỉ bằng prompt thiếu nhất quán, qua được máy phát hiện này nhưng trượt máy khác, và nó suy yếu dần khi máy phát hiện huấn luyện lại. Yêu cầu ChatGPT "viết lại để máy phát hiện AI không bắt được" là phiên bản yếu nhất của mẹo này, vì mô hình viết lại chính văn bản của nó với cùng những thói quen đã khiến nó bị gắn cờ. Hãy coi prompt là bước số không, thứ cung cấp nguyên liệu thô tốt hơn cho công cụ human hóa, chứ không phải toàn bộ chiến lược.
Quy trình thực tế để human hóa văn bản ChatGPT
Hãy bắt đầu bằng việc coi bản nháp ChatGPT là bản nháp đầu, không phải bản cuối. Đọc một lượt để xác nhận ý tưởng và dữ kiện đúng, vì không lượng biên tập văn phong nào sửa được một khẳng định sai. Rồi lên kế hoạch viết lại bề mặt để giọng văn trở thành của bạn.
Dán bản nháp vào công cụ human hóa văn bản AI miễn phí, hoặc tải tệp lên nếu nó đã là một tài liệu; công cụ xử lý 40 ngôn ngữ, nên cách này cũng hiệu quả với bản nháp không phải tiếng Anh. Chọn cường độ tương ứng với lượng câu chữ gốc bạn muốn giữ: lượt nhẹ chủ yếu phá nhịp, lượt mạnh viết lại cách diễn đạt một cách quyết liệt. Công cụ hiển thị điểm AI trực tiếp trước và sau từ hai máy phát hiện độc lập, nên bạn có bằng chứng, không phải cảm giác: một bản nháp mở màn ở 95% AI và quay về ở 8% là thay đổi đo đếm được, hiện trên màn hình trước khi bạn tự tay chạm vào một câu nào.
Sau đó vẫn hãy làm một lượt biên tập thủ công. Sự kết hợp giữa tái tạo tự động và biên tập của con người thắng từng cách riêng lẻ, vì công cụ sửa phần thống kê còn bạn sửa phần hồn. Hãy tính thời gian một cách trung thực: sinh bản nháp mất ba mươi giây, human hóa thêm ba mươi giây nữa, và lượt biên tập mất năm hay mười phút. Vẫn chỉ là một phần nhỏ so với viết từ đầu, và đó là khác biệt giữa văn bản chỉ vượt qua một lần quét với văn bản bạn dám ký tên mình lên.
Lượt biên tập: danh sách kiểm cho việc chuyển văn bản AI thành văn bản người
Khi chuyển văn bản AI thành văn bản như người viết, hãy nhắm tới sự không đều có kiểm soát. Tách các câu dài, cân đối: cắt một câu làm đôi, nhập hai câu khác, và để một câu ba từ đứng riêng nhấn mạnh. Xóa thẳng các chuyển ý độn và lời rào đón; nếu một câu bắt đầu bằng hơn nữa hay đáng lưu ý là, câu đó gần như luôn hay hơn khi bỏ chúng đi.
Thay danh từ và động từ chung chung bằng từ cụ thể, và thêm ít nhất một chi tiết sát thực mỗi phần mà mô hình sẽ không bịa ra: một con số, một cái tên, một chuyện đã thực sự xảy ra với bạn. Khai tử đoạn kết luận tóm tắt nhắc lại cả bài và kết thúc bằng một luận điểm. Kiểm tra cả hình dạng đoạn văn; nếu đoạn nào cũng ba câu, hãy nhập hai đoạn và tách một đoạn khác.
Đọc to toàn bộ, và viết lại bất kỳ câu nào nghe như thông cáo báo chí. Đọc to bắt được những gì mắt bạn bỏ qua: nhịp điệu y hệt nhau, cụm từ bạn sẽ không bao giờ thực sự nói, câu văn tồn tại chỉ để nghe cho trọn vẹn. Năm phút tập trung làm việc này trên một bản nháp đã human hóa hiệu quả hơn một giờ đổi chữ ngẫu nhiên trên bản thô.
Dùng điểm AI trước và sau làm bằng chứng
Đoán xem văn bản có bị phát hiện không là việc thiếu tin cậy, nên hãy đo nó. Điểm AI trước và sau biến việc biên tập thành một vòng phản hồi: sửa một đoạn, chấm lại, và giữ những gì hạ con số. Vì công cụ human hóa kiểm tra văn bản của bạn với hai máy phát hiện cùng lúc, bạn cũng tránh được cái bẫy kinh điển là tối ưu cho các thói tật của một công cụ duy nhất.
Quy trình đơn giản. Ghi lại điểm xuất phát, áp dụng bản viết lại, và so sánh. Nếu một phần vẫn điểm cao, thường có nghĩa nhịp điệu quá đồng đều hoặc cách diễn đạt quá chung chung, nên hãy nhắm cụ thể vào những câu đó thay vì viết lại tất cả một cách ngẫu nhiên. Chạy lại riêng đoạn cứng đầu ở cường độ mạnh hơn thay vì xử lý lại toàn bộ, vì xử lý quá tay các phần vốn sạch có thể làm chúng gượng gạo. Khi cả hai máy phát hiện đồng ý văn bản đọc như người viết và lượt đọc to của chính bạn cũng đồng ý, bạn xong việc. Săn đuổi 0% trên mọi công cụ trên internet là phí một buổi chiều lẽ ra dành cho việc làm bài viết thực sự hay hơn.
Ghi chú theo từng máy phát hiện: GPTZero, Turnitin, Copyleaks
GPTZero là công cụ bạn có thể tự kiểm tra trực tiếp. Nó dựa nặng vào perplexity và burstiness, tô sáng các câu khả nghi, và thường tỏ ra hợp lý với tài liệu trộn người-AI, nên nó là bài kiểm tra đầu tiên tốt. Turnitin hướng về phía giảng viên, nên bạn không tự thăm dò được; nó chỉ chấm tài liệu trên 300 từ, đánh dấu điểm dưới 20% là kém tin cậy, và chuyên tìm văn bản AI được diễn đạt lại nhẹ. Phân tích đầy đủ nằm trong hướng dẫn của chúng tôi về cách vượt qua phát hiện AI của Turnitin.
Copyleaks là công cụ quyết liệt. Nó quảng cáo độ chính xác rất cao, quét ở cấp câu, và trong các thử nghiệm độc lập nó gắn cờ văn bản mấp mé dễ hơn các công cụ khác, đồng nghĩa cũng nhiều dương tính giả hơn trên văn xuôi trang trọng của con người. Nếu văn bản của bạn cần vượt qua nó, xem hướng dẫn riêng để vượt qua Copyleaks. Cả ba dựa vào cùng các tín hiệu nền tảng, nên bài viết thực sự biến hóa, cụ thể giúp ích ở mọi nơi, nhưng một bản nháp vẫn có thể qua một công cụ và bị công cụ khác gắn cờ vì mỗi bên cân trọng số tín hiệu và đặt ngưỡng khác nhau. Hãy coi bất kỳ điểm đơn lẻ nào là gợi ý, không phải bằng chứng, và đặt niềm tin vào sự đồng thuận giữa các máy phát hiện thay vì vào một con số.
Những điều không nên làm
Bỏ qua các mẹo lan truyền trên diễn đàn, vì chúng trải từ vô dụng đến gây hại thực sự. Ký tự Unicode vô hình và đánh tráo ký tự, như thay chữ cái bằng chữ Kirin trông giống, bị máy phát hiện hiện đại chuẩn hóa loại bỏ, và khi bị phát giác chúng trông như cố tình lừa dối, biến một câu hỏi văn phong thành một vụ liêm chính. Vòng dịch xuôi ngược qua hai ba ngôn ngữ băm nát ý nghĩa trong khi để nhịp máy móc gần như nguyên vẹn. Các công cụ xoay từ đồng nghĩa rẻ tiền nâng perplexity sai cách, tạo văn bản đọc như bị từ điển đồng nghĩa rơi trúng; máy phát hiện ngày càng bắt được, còn người đọc thì luôn luôn.
Cũng hãy cưỡng lại vòng lặp nạp văn bản trở lại ChatGPT mười lần yêu cầu "nghe cho giống người". Mỗi lượt lấy mẫu từ cùng một phân phối, nên lợi ích phẳng dần rất nhanh trong khi nội dung trôi dạt từ từ. Và đừng bao giờ nộp thứ bạn chưa đọc. Kết cục tệ nhất không phải một lá cờ từ máy phát hiện; đó là tự tin nộp một đoạn văn sai, chung chung, hay lệch đề một cách tinh vi vì chưa có con người nào từng nhìn vào nó.
Giữ giọng văn của chính bạn trong vòng lặp
Mục tiêu cuối không phải văn bản đánh lừa được máy quét; đó là văn bản nghe giống bạn, thứ tình cờ cũng chính là thứ máy phát hiện đọc là của con người. Cách nhanh nhất để tới đó là giữ quyền sở hữu ở hai mép: tự viết đoạn mở và đoạn kết, vì chúng mang nhiều giọng văn nhất trên mỗi từ, và để công cụ giúp phần giữa.
Hãy bất đồng với chính bản nháp của mình ở đâu đó. Tìm một khẳng định ChatGPT đưa ra mà bạn muốn dè dặt hơn, và dè dặt nó ngay trong văn bản; các lập trường cụ thể, có chừng mực là thứ rất con người. Gấp trải nghiệm thực của bạn vào, dù chỉ một câu. Nếu bạn viết thường xuyên, hãy giữ một tệp nhỏ các bài viết cũ của mình và so nhịp: độ dài câu tự nhiên của bạn, các cấu trúc bạn ưa dùng, những từ bạn sẽ không bao giờ dùng. Theo thời gian điều này cũng giúp bạn nhanh hơn, vì bạn ngừng chấp nhận cách diễn đạt AI không hợp với mình. Những cây bút không bao giờ bị gắn cờ không phải người có mẹo hay nhất; họ là người mà dấu vân tay in khắp văn bản cuối cùng.
Các giới hạn trung thực bạn nên biết
Không công cụ nào làm văn bản không thể bị phát hiện vĩnh viễn. Máy phát hiện huấn luyện lại thường xuyên, và bài viết trông sạch hôm nay có thể được chấm khác sau lần cập nhật kế tiếp, nên ai hứa một kết quả vượt qua phát hiện AI được bảo đảm, vĩnh viễn là đang nói quá. Dương tính giả cũng cắt theo chiều ngược lại: văn viết trang trọng, giản dị của con người đôi khi bị gắn cờ, chính là lý do một điểm số đơn lẻ không bao giờ nên được coi là bằng chứng theo bất kỳ hướng nào.
Mục tiêu bền vững không phải đánh lừa một cỗ máy mà là viết hay: rõ ràng, cụ thể, và bằng giọng của chính bạn. Chuẩn mực đó không hết hạn khi một máy phát hiện huấn luyện lại, và đó là điều khiến mười phút bỏ thêm trở nên xứng đáng. Hãy dùng các kỹ thuật này để cải thiện những bản nháp thực sự của con người và giảm các lá cờ oan, và luôn tuân theo quy định của trường học hay công ty bạn về việc dùng AI. Chính sách khác nhau rất nhiều, và cùng một quy trình có thể được khuyến khích ở bối cảnh này và bị cấm ở bối cảnh khác. Công khai sự hỗ trợ của AI khi được yêu cầu, giữ hồ sơ quá trình soạn thảo, và giữ phần tư duy là của bạn.
Câu hỏi thường gặp
ChatGPT có tự làm văn bản của nó không thể bị phát hiện nếu tôi chỉ cần yêu cầu không?
Không ổn định. Các prompt như "viết như người" thay đổi bề mặt và sẽ hạ điểm phần nào, nhưng mô hình vẫn lấy mẫu từ cùng một phân phối xác suất, nên sự đồng đều sâu hơn sống sót. Hãy prompt tốt để có nguyên liệu thô tốt hơn, rồi dùng một công cụ human hóa và lượt biên tập của chính bạn để hoàn tất công việc.
Tôi nên kiểm tra văn bản của mình với máy phát hiện AI nào?
Hãy kiểm tra với nhiều hơn một, vì các máy phát hiện cân tín hiệu khác nhau và một bản nháp có thể qua công cụ này trong khi trượt công cụ khác. Công cụ human hóa trên trang này chấm văn bản của bạn bằng hai máy phát hiện độc lập cùng lúc và hiển thị cả hai con số trước và sau, một bức tranh trung thực hơn bất kỳ công cụ đơn lẻ nào mang lại.
Mô hình GPT nào viết bản nháp gốc có quan trọng không?
Ít hơn người ta hy vọng. Các mô hình mới hơn viết tự nhiên hơn, và bản mặc định của chúng điểm thấp hơn chút ít, nhưng mọi mô hình chính thống đều đã học những thói quen thống kê mà máy phát hiện cũng học. Bất kể thứ gì sinh ra bản nháp, quy trình vẫn vậy: human hóa, đo điểm trước và sau, rồi tự tay biên tập.
Làm văn bản ChatGPT không thể bị phát hiện có bị coi là gian lận không?
Hoàn toàn tùy vào quy định bạn đang chịu. Biên tập một bản nháp AI thành lời văn của chính bạn là chính đáng ở nhiều nơi làm việc và khóa học, và bị cấm ở những nơi khác. Hãy kiểm tra chính sách, công khai sự hỗ trợ của AI khi được yêu cầu, và đừng bao giờ nộp văn bản bạn không thể giải thích hay bảo vệ trực tiếp.
Sau khi dùng công cụ human hóa tôi vẫn cần tự tay biên tập chứ?
Có, và đó là năm phút giá trị nhất trong toàn bộ quy trình. Công cụ human hóa sửa nhịp điệu và cách diễn đạt trên diện rộng, nhưng chỉ bạn mới thêm được chi tiết thật, cắt một khẳng định sai, và làm văn bản nghe giống bạn. Tái tạo tự động cộng một lượt ngắn của con người luôn thắng từng cách riêng lẻ.
Dùng thử AI humanizer miễn phí
Dán văn bản của bạn và xem điểm AI trước/sau chỉ trong vài giây. Không cần đăng nhập, hoạt động với mọi ngôn ngữ.
Nhân hóa văn bản