Đây là một trong những câu hỏi được tìm kiếm nhiều nhất trong toàn bộ lĩnh vực này, và hầu hết các câu trả lời đều được viết bởi những người đang bán một thứ gì đó. Vậy nên: có, bạn thường có thể hạ thấp điểm số của trình phát hiện. Không, điều đó không đồng nghĩa với việc làm cho văn bản không thể bị phát hiện. Và khoảng trống giữa hai câu đó là nơi chứa đựng hầu hết rắc rối.
Dưới đây là những gì thực sự diễn ra về mặt cơ học, chi phí mà bài viết phải trả, và khi nào đó là một điều hợp lý để làm.
Câu trả lời một dòng
Các công cụ nhân hóa chủ yếu hoạt động bằng cách làm cho văn bản ít có thể dự đoán hơn. Điều đó có làm giảm hầu hết điểm số. Nó cũng làm cho bài viết tệ hơn theo một cách cụ thể, có thể đo lường được — và nó không làm gì đối với việc văn bản có nói điều gì đáng đọc hay không.
Những gì trình phát hiện đo lường, trong một đoạn văn
Gần như tất cả chúng đều quy về hai điều: perplexity, đại khái là mức độ gây kinh ngạc của mỗi từ tiếp theo, và burstiness, độ dài và độ phức tạp của câu biến thiên bao nhiêu. Văn viết của con người thì trập trùng — một câu dài rắc rối, rồi đến một câu ngắn, rồi đến một ý phụ. Văn viết do AI tạo ra có xu hướng mượt mà và nhịp điệu đều đặn. Mọi thứ khác đều là sự tinh chỉnh dựa trên hai ý tưởng đó.
Vậy một trình nhân hóa thực sự làm gì?
Một khi bạn biết những gì đang được đo lường, các biện pháp đối phó là rõ ràng, và chúng chính là những gì các công cụ này làm:
- Phá vỡ nhịp điệu. Tách một số câu, ghép những câu khác lại với nhau, để độ dài biến thiên nhiều hơn.
- Đổi các từ phổ biến lấy các từ ít khả năng xuất hiện hơn. Tăng perplexity ngay lập tức.
- Thêm các điểm bất ngờ nhỏ. Các từ viết tắt, một mảnh câu dở dang, một ý đi chệch nhẹ — kết cấu của ai đó đang gõ phím chứ không phải đang tạo văn bản.
- Nới lỏng cấu trúc. Ít gạch đầu dòng song song hoàn hảo hơn, ít kết luận tóm tắt chỉn chu hơn.
Không có điều nào trong số này là bí ẩn. Nó đang tối ưu hóa trực tiếp chống lại điểm số, và nó hoạt động vì điểm số là một chỉ số đại diện. Đó cũng là điểm yếu của nó.
Chi phí bạn phải trả
Đây là phần mà các trang tiếp thị bỏ qua, và nó đủ nhất quán để đáng được phát biểu một cách rõ ràng.
Ý nghĩa bị sai lệch
Việc đổi từ để tạo sự không thể dự đoán không tôn trọng sự chính xác. Các thuật ngữ kỹ thuật bị thay thế bằng các từ gần nghĩa mà thực chất không phải là từ đồng nghĩa. Trong một bài báo học thuật hoặc kỹ thuật, đây là cách bạn kết thúc bằng việc khẳng định một điều bạn không có ý nói — và người chấm bài sẽ nhận ra sự sai lệch đó từ lâu trước khi bất kỳ trình phát hiện nào nhận ra.
Đọc nghe hơi lạ
Văn bản được tối ưu hóa cho sự bất thường về mặt thống kê có một kết cấu mà mọi người nhận ra mà không thể đặt tên: từ vựng được chọn một cách kỳ lạ, các câu biến thiên về độ dài mà không biến thiên về nhịp điệu, các chuyển ý không thực sự chạm tới đích. Người đọc mô tả nó là “kỳ lạ” thường xuyên hơn là “giống con người”.
Đó là một mục tiêu luôn di chuyển
Các trình phát hiện được huấn luyện lại trên đầu ra đã được nhân hóa. Đó là một vòng lặp phản hồi đơn giản: sự lẩn tránh của hôm nay trở thành dữ liệu huấn luyện của ngày mai. Bất kỳ điều gì bạn dán vào một công cụ hứa hẹn sự không thể phát hiện vĩnh viễn đều đang được hứa hẹn một điều mà không ai có thể cung cấp.
Ai thực sự đang hỏi câu hỏi này
Theo kinh nghiệm của chúng tôi, có ba nhóm người khá khác nhau đằng sau cuộc tìm kiếm này, và họ cần những câu trả lời khác nhau.
Sinh viên cố gắng không bị phát hiện
Đánh giá rủi ro trung thực: các công cụ nhân hóa làm giảm điểm số nhưng không đưa điểm số về 0, nhiều tổ chức hiện coi việc sử dụng công cụ nhân hóa là một vi phạm riêng biệt tách khỏi việc sử dụng AI, và bằng chứng quy trình — không có bản thảo, không có lịch sử phiên bản, không có khả năng thảo luận về lập luận của chính bạn — là điều thực sự làm sụp đổ các trường hợp này. Bạn sẽ chịu một rủi ro thực sự để tránh một công việc thường nhỏ hơn vẻ ngoài của nó.
Người bị gắn cờ sai
Nếu bạn tự viết và trình phát hiện nói ngược lại, chạy nó qua công cụ nhân hóa là bước đi tồi tệ nhất hiện có. Bạn sẽ làm cho công trình thật sự trở nên kỳ lạ về mặt thống kê để làm hài lòng một công cụ vốn đã sai, và bạn sẽ phá hủy điều duy nhất giúp bạn: lịch sử bản thảo sạch sẽ, nhất quán. Hãy hiển thị các bản thảo. Hỏi xem đoạn văn nào bị gắn cờ. Thảo luận qua về lập luận của bạn.
Người viết chuyên nghiệp dùng AI làm công cụ phác thảo
Đây là trường hợp phổ biến nhất và ít rắc rối nhất. Nếu bạn đang phác thảo với một mô hình và chỉnh sửa đúng cách, bạn không cần công cụ nhân hóa — việc chỉnh sửa vì ý nghĩa đã tạo ra sự biến thiên mà các công cụ này làm giả. Nếu bản thảo đã chỉnh sửa của bạn vẫn đạt điểm cao, điều đó thường cho bạn biết một sự thật: bài viết vẫn còn chung chung. Hãy khắc phục điều đó.
Câu hỏi đằng sau câu hỏi
Gần như tất cả những ai hỏi cách đánh bại trình phát hiện thực sự đang hỏi cách nộp một thứ gì đó mà không cần làm công việc nền tảng. Đáng để thẳng thắn: điểm số không phải là thứ đang được đánh giá. Một người hướng dẫn, một biên tập viên hoặc một nhà tuyển dụng đang cố gắng tìm hiểu xem bạn có hiểu điều gì đó không. Một bài luận được nhân hóa hoàn hảo mà không nói lên điều gì thì vẫn không nói lên điều gì.
Con đường đáng tin cậy nhất đến văn bản không đọc như do AI tạo ra là văn bản chỉ có thể được viết bởi bạn — một ví dụ cụ thể, một con số từ công việc của chính bạn, một lập luận bạn sẽ bảo vệ. Đó không phải là một cách lách luật. Đó chỉ là điều mà bài viết vốn phải chứa đựng.
Quan điểm của chúng tôi
Chúng tôi xây dựng các trình phát hiện và chúng tôi cũng xây dựng một công cụ viết lại, vì vậy chúng tôi có lợi ích rõ ràng ở đây và bạn nên đọc điều này với lưu ý đó. Quan điểm trung thực của chúng tôi: viết lại là hợp pháp để cải thiện sự rõ ràng và lưu khoát trong công việc của chính bạn, và việc sử dụng nó để ngụy trang quyền tác giả nơi đã được hỏi về nó không phải là điều chúng tôi khuyên bất kỳ ai.
Và về câu hỏi ban đầu — nếu một công cụ nói với bạn rằng đầu ra của nó không thể bị phát hiện vĩnh viễn, tuyên bố đó không phải là tuyên bố mà ai cũng có thể hỗ trợ. Phát hiện và lẩn tránh là cùng một cuộc chạy đua vũ trang nhìn từ hai đầu đối lập, và không bên nào có quyền tuyên bố nó đã kết thúc.
