Quay lại Blog
Phát hiện AI

Cách nhận biết bài đăng trên mạng xã hội có phải do AI viết hay không

PĐội ngÅ© Plagly.ai||8 phút đọc

Bạn đã từng cảm nhận được điều đó. Bạn đang lướt mạng xã hội và một dòng chú thích khiến bạn dừng lại — không phải vì nó hay, mà vì nó quá chỉn chu. Ba mệnh đề ngăn nắp. Một câu hỏi tu từ. Một câu kết nghe như xuất ra từ một bức áp phích truyền cảm hứng. Có điều gì đó không đúng, và bạn không thể chỉ ra chính xác là gì.

Tôi đã dành nhiều thời gian đọc các chú thích do AI viết đặt cạnh các chú thích do con người viết, và bản tóm tắt trung thực nhất là: các dấu hiệu nhận biết là có thật, nhưng hầu hết những dấu hiệu mà mọi người lặp lại trên mạng đều sai. Số lượng emoji không nói lên điều gì. Ngữ pháp hoàn hảo không nói lên điều gì. Điều thực sự tố giác nó chính là nhịp điệu.

Tóm tắt ngắn gọn

Các chú thích do AI viết có nhịp điệu đều đặn một cách bất thường. Chú thích do con người viết thì trập trùng — một câu dài lan man, rồi đến ba từ, rồi một ý phụ không ai hỏi. Nếu mỗi câu đều có độ dài xấp xỉ nhau và mỗi đoạn văn đều kết thúc theo cùng một kiểu, đó chính là tín hiệu nhận biết của bạn.

Những dấu hiệu nhận biết thực sự hiệu quả

Đây là những mẫu tôi liên tục nhìn thấy trên Instagram, LinkedIn và X. Không có dấu hiệu nào trong số này là bằng chứng tuyệt đối khi đứng một mình. Tuy nhiên, khi hai hoặc ba dấu hiệu xuất hiện cùng nhau, bạn thường đang nhìn vào một mô hình ngôn ngữ.

1. Cấu trúc “Không phải X. Mà là Y.”

Cấu trúc này có ở khắp mọi nơi. “Đó không phải là về điểm đến. Đó là về hành trình.” “Đây không phải là một bước lùi. Đó là một sự chuẩn bị.” Các mô hình rất thích kiểu câu này vì nó nghe có vẻ sâu sắc mà không tốn chi phí tư duy. Con người cũng sử dụng nó — nhưng khoảng một lần một năm, chứ không phải hai lần trong một chú thích.

2. Mọi thứ đều đi theo bộ ba

Ba tính từ. Ba dòng gạch đầu dòng. Câu kết gồm ba phần. Quy tắc bộ ba (rule of three) thực sự là một lời khuyên viết lách tốt, đó chính là lý do tại sao các mô hình lạm dụng nó. Khi bạn nhận ra một chú thích mà mọi danh sách đều tình cờ có ba mục, sự đều đặn đó đang thể hiện sự gượng ép nhiều hơn ý định của người viết.

3. Các câu cân bằng một cách đáng nghi vấn

Hãy đọc to chú thích lên. Văn viết của con người có sự vấp váp — một mệnh đề kéo quá dài, một ý nghĩ bị bỏ dở giữa chừng, ai đó quên đóng dấu ngoặc đơn. Văn viết của AI đọc gần như thơ: mỗi câu khoảng 15 đến 20 từ, mỗi câu đều hoàn chỉnh về ngữ pháp, mỗi câu đều kết thúc đúng nhịp. Sự đồng đều đó là tín hiệu đáng tin cậy nhất mà chúng tôi đo lường.

4. Thẻ hashtag không khớp với bài đăng

Một người viết về men làm bánh mì của họ sẽ gắn thẻ #sourdough #baking #kitchenfail. Một mô hình tạo bài đăng về men làm bánh mì sẽ gắn thẻ #sourdough #baking #foodie #inspiration #community #journey — rộng rinh, chung chung và vươn tới việc kéo tương tác hơn là mô tả bất kỳ điều gì cụ thể. Sự lệch pha về mức độ trừu tượng giữa chú thích và các thẻ là một dấu hiệu nhận biết khá tốt trên Instagram và TikTok.

5. Mở đầu kiểu LinkedIn

LinkedIn đáng có một mục riêng vì thể loại này đã sụp đổ thành một công thức: một câu móc gây chú ý dài một dòng, ngắt dòng, một câu ngắn kịch tính, một ngắt dòng khác, rồi một câu chuyện dẫn đến bài học kinh doanh. “Tôi đã bị từ chối 47 lần.” Ngắt dòng. “Đây là những gì điều đó đã dạy tôi.” Các mô hình học cấu trúc này từ hàng triệu bài đăng thật, nên chúng tái tạo nó một cách hoàn hảo — điều mà thật mỉa mai, lại chính là điều khiến nó dễ bị phát hiện. Người thật đôi khi tự phá vỡ công thức của mình. Các mô hình thì không.

Những dấu hiệu KHÔNG hiệu quả (xin vui lòng ngừng lặp lại)

Phần này quan trọng hơn phần trước, vì hành động dựa trên một dấu hiệu sai đồng nghĩa với việc cáo buộc người thật về những điều họ không làm.

“Nó dùng gạch ngang dài (em dash), nên đó là AI”

Không. Dấu gạch ngang dài trở thành một meme nhận biết vào năm 2025 và nó chưa bao giờ đáng tin cậy. Rất nhiều người viết giỏi sử dụng chúng thường xuyên — và các mô hình hiện tại đã được tinh chỉnh né tránh chúng chính vì mọi người bắt đầu chú ý. Nếu có gì thay đổi, việc sử dụng nhiều gạch ngang dài hiện tương quan nhẹ với văn viết của con người.

“Ngữ pháp hoàn hảo”

Ngữ pháp của bất kỳ ai soạn chú thích trong ứng dụng ghi chú và đọc lại hai lần cũng hoàn hảo. Ngữ pháp hoàn hảo đại diện cho sự cẩn thận, chứ không phải cho quyền tác giả. Dấu hiệu này phạt những người viết cẩn thận, những người không phải bản ngữ hay chỉnh sửa quá mức, và bất kỳ ai có điện thoại tự động sửa lỗi một cách tích cực.

“Nó dùng các từ hoa mỹ như 'delve' hoặc 'tapestry'”

Có một phần sự thật ở đây — một số mô hình nhất định đã dùng quá đà một vài từ — nhưng nó lỗi thời rất nhanh. Các dấu hiệu ở cấp độ từ ngữ có thời hạn sử dụng chỉ khoảng một phiên bản mô hình. Cấu trúc tồn tại lâu hơn nhiều, đó là lý do tại sao các công cụ phát hiện coi trọng nhịp điệu và khả năng dự đoán hơn là từ vựng.

Nó trông khác nhau trên mỗi nền tảng

Cùng một mô hình tạo ra đầu ra trông rất khác nhau tùy thuộc vào nơi nó đăng bài, vì prompt thường bao gồm tên nền tảng.

Instagram

Các chú thích có xu hướng dài và mang hình dáng câu chuyện. Dấu hiệu nhận biết thường là sự lệch pha: một đoạn văn được trau chuốt, cấu trúc kỹ lưỡng đi kèm với một bức ảnh trông ngẫu hứng. Những người viết ngẫu nhiên không đột nhiên tạo ra một cung ngụ ngôn năm câu về một tách cà phê.

X (Twitter)

Các bài đăng ngắn thực sự rất khắt khe để đánh giá — đơn giản là không có đủ văn bản. Nơi AI thể hiện rõ ràng là trong các chuỗi bài (thread). Hãy chú ý các bài đăng được đánh số mà mỗi bài đều có cùng độ dài và kết thúc bằng một câu móc dẫn sang bài tiếp theo. Con người hụt hơi quanh bài đăng thứ tư. Các mô hình thì không.

TikTok

Chú thích thường chỉ là ý nghĩ bổ sung, nên nó thưa thớt ở cả hai trường hợp. Tín hiệu hữu ích hơn là văn bản trên màn hình hoặc kịch bản, nếu bạn có được nó — kịch bản là nơi cấu trúc do AI tạo ra thể hiện rõ nhất.

LinkedIn

Mật độ nội dung do AI viết cao nhất trong số các nền tảng lớn, và cũng là nơi khó khẳng định nhất, vì các bài đăng của con người bắt chước cùng một công thức. Hãy cân nhắc các chi tiết cụ thể: các bài đăng thật nêu tên các công ty thật, con số thật, người thật. Các bài đăng do AI tạo ra thường duy trì sự trừu tượng.

Tại sao ai đó thực sự cần kiểm tra điều này

Hầu như không phải vì tò mò. Những người hỏi chúng tôi thường có một lý do cụ thể:

  • Tuyển dụng. Nhà tuyển dụng đọc LinkedIn của ứng viên muốn biết họ đang đọc giọng nói của ai.
  • Hợp tác thương hiệu. Các agency thẩm định một người sáng tạo nội dung trước khi trả tiền cho họ viết muốn biết liệu “giọng nói” mà họ mua có phải là một prompt hay không.
  • Báo chí và nghiên cứu. Bất kỳ ai trích dẫn một bài đăng đều cần biết liệu một người thật có thực sự nói điều đó hay không.
  • Kiểm duyệt. Việc tạo tương tác hàng loạt phối hợp được tạo ra với số lượng lớn, và nó đọc lên đúng như vậy.

Hãy chú ý điều gì còn thiếu trong danh sách đó: bắt bẻ một người bạn. Nếu bạn sắp đối chất với ai đó về một chú thích, lời khuyên trung thực là đừng làm vậy. Các công cụ — bao gồm cả công cụ của chúng tôi — đưa cho bạn một xác suất, chứ không phải một lời thú tội.

Kiểm tra một bài đăng mà không cần đoán mò

Nếu bạn không muốn đoán bằng mắt thường, bạn có thể dán liên kết bài đăng công khai vào trình phát hiện AI trên mạng xã hội của chúng tôi và nó sẽ lấy phần chú thích rồi chấm điểm, hiển thị các câu cụ thể đã đẩy con số lên. Nó hoạt động với Instagram, X, TikTok, Threads, Reddit, LinkedIn, Facebook và YouTube.

Hai điều đáng biết trước khi bạn sử dụng nó, hoặc bất kỳ công cụ nào tương tự. Đầu tiên, nó phân tích văn bản. Nó hiển thị hình ảnh bài đăng để bạn biết nó đã đọc đúng bài đăng, nhưng nó không chấm điểm hình ảnh — giám định hình ảnh là một bài toán khác và chúng tôi thà nói rành rọt như vậy còn hơn đưa cho bạn một con số do chúng tôi tự bịa ra. Thứ hai, nó từ chối chấm điểm các chú thích dưới khoảng 20 từ. Dưới mức đó không có đủ tín hiệu, và bất kỳ tỷ lệ phần trăm nào cũng sẽ gần như tung đồng xu hơn là một phép đo.

Phần mà hầu hết các bài báo bỏ qua

Phát hiện AI mang tính xác suất. Luôn luôn như vậy. Điểm số cao có nghĩa là bài viết mang các mẫu gắn liền mạnh mẽ với các mô hình ngôn ngữ — nó không có nghĩa là ai đó đã nói dối bạn. Một số người tự nhiên viết theo phong cách rõ ràng, đồng đều, cấu trúc tốt. Văn bản tiếp thị nghe đã hơi giống máy móc từ lâu trước khi máy móc có thể tạo ra nó. Và bất kỳ ai cũng có thể chạy một chú thích do con người viết qua một công cụ viết lại và đảo ngược điểm số.

Vì vậy, hãy sử dụng điểm số theo cách bạn sử dụng chuông báo khói: như một lý do để đến xem xét, chứ không phải như một bản án. Các câu bị gắn cờ quan trọng hơn tỷ lệ phần trăm. Nếu phần lý giải không thuyết phục được bạn, hãy tin vào cảm nhận của chính bạn — bạn hiểu giọng nói của người đó hơn bất kỳ mô hình nào.

Câu trả lời ngắn gọn

Hãy ngừng đếm emoji và dấu gạch ngang dài. Thay vào đó hãy đọc theo nhịp điệu. Văn viết của con người trập trùng, cụ thể và đôi khi hỗn loạn; văn viết do AI tạo ra thì mượt mà, cân bằng và kỳ lạ là không muốn đặt tên cho bất kỳ điều gì cụ thể. Một khi bạn đã nhận ra điều đó, bạn sẽ thấy nó ở khắp mọi nơi — đó là một kỹ năng hữu ích hoặc một lời nguyền, tùy thuộc vào việc bạn dành bao nhiêu thời gian trên mạng.

Check text for a specific AI model

Run your text through a detector tuned for the model you suspect.

Chia sẻ bài viết này

Try Plagly.ai Free

Detect AI-generated content and check for plagiarism with industry-leading accuracy. No credit card required.

Get Started Free