חזרה לבלוג
זיהוי AI

האם באמת אפשר להפוך טקסט AI לבלתי ניתן לזיהוי?

Pצוות Plagly.ai||9 דקות קריאה

זוהי אחת השאלות הנחקרות ביותר בתחום כולו, ורוב התשובות נכתבות על ידי אנשים שמוכרים משהו. אז ככה: כן, אתם בדרך כלל יכולים להוריד ציון גלאי. לא, זה לא אותו דבר כמו להפוך טקסט לבלתי ניתן לזיהוי. והפער בין שני המשפטים הללו הוא המקום שבו שוכנות רוב הצרות.

הנה מה שקורה בפועל ברמה המכנית, מה זה עולה לכתיבה שלכם, ומתי זה צעד הגיוני לעשות.

התשובה בשורה אחת

כלי האנשה (Humanizers) עובדים בעיקר על ידי הפיכת הטקסט לפחות צפוי. זה אכן מוריד את רוב הציונים. זה גם הופך את הכתיבה לגרועה יותר בדרך ספציפית ומדידה — וזה אינו עושה דבר לגבי השאלה האם לטקסט יש ערך ששווה קריאה.

מה גלאים מודדים, בפסקה אחת

כמעט כולם מסתכמים בשני דברים: פרפלקסיות (perplexity), בקירוב עד כמה כל מילה הבאה היא מפתיעה, ו-burstiness, עד כמה אורך המשפטים והמורכבות משתנים. כתיבה אנושית היא גבשושית — משפט ארוך ומסובך, ואז משפט קצר, ואז הערת אגב. כתיבה מחוללת נוטה להיות חלקלקה ובקצב אחיד. כל השאר הוא שכלול מעל שני הרעיונות הללו.

אז מה מאנש (Humanizer) בעצם עושה?

ברגע שאתם יודעים מה נמדד, אמצעי הנגד הופכים לברורים, והם בדיוק מה שהכלים הללו עושים:

  • פירוק המקצב. פיצול משפטים מסוימים, חיבור אחרים יחד, כך שאורכי המשפטים ישתנו יותר.
  • החלפת מילים נפוצות במילים פחות צפויות. העלאה מיידית של הפרפלקסיות.
  • הוספת אי-סדירויות קטנות. קיצורי מילים, חלקי משפטים, הסתעפות קלה — המרקם של אדם שמקליד ולא של מכונה שמחוללת.
  • ריכוך המבנה. פחות נקודות בולטים מקבילות בצורה מושלמת, פחות סיכומים מסודרים בסוף.

שום דבר מזה אינו מסתורי. זוהי אופטימיזציה ישירה מול הציון, וזה עובד מכיוון שהציון הוא מדד ייצוגי (proxy). זוהי גם החולשה שלו.

מה זה עולה לכם

זה החלק שדפי השיווק השמיטו, והוא עקבי מספיק כדי שיהיה שווה לציין אותו בגלוי.

המשמעות משתנה

החלפת מילים למען חוסר ניבוי אינה מכבדת דיוק. מונחים טכניים מוחלפים במילים כמעט-נרדפות שאינן נרדפות באמת. בחיבור אקדמי או טכני כך אתם מגיעים למצב של טענת משהו שלא התכוונתם אליו — והאדם שבודק זאת יבחין באי-הנכונות הרבה לפני שכל גלאי יבחין בכך.

זה נשמע מעט מוזר

לטקסט שעבר אופטימיזציה למען אי-סדירות סטטיסטית יש מרקם שאנשים מזהים מבלי להצליח לשים עליו את האצבע: אוצר מילים שנבחר בצורה מוזרה, משפטים המשתנים באורכם מבלי להשתנות במקצב, ומעברים שאינם נוחתים כראוי. קוראים מתארים זאת כ“מוזר” לעתים קרובות יותר מאשר כ“אנושי”.

זו מציאות משתנה

גלאים עוברים אימון מחדש על פלטים שעברו האנשה. בלולאת משוב פשוטה: העקיפה של היום הופכת לנתוני האימון של מחר. כל דבר שאתם מדביקים לתוך כלי שמבטיח אי-גילוי לצמיתות מבטיח לכם משהו שאף אחד לא יכול לקיים.

מי בעצם שואל את השאלה הזו

מניסיוננו ישנם שלושה סוגי אנשים שונים לחלוטין מאחורי החיפוש הזה, והם זקוקים לתשובות שונות.

הסטודנט שמנסה לא להיתפס

הערכת הסיכונים הכנה: מאנשים מורידים ציונים אך אינם מורידים אותם לאפס, מוסדות רבים מתייחסים כיום לשימוש במאנש כאל עבירה בפני עצמה בנפרד משימוש ב-AI, וראיות התהליך — העדר טיוטות, העדר היסטוריית גרסאות, אי-יכולת לדון בטיעון שלכם — הן מה שבאמת מפיל את המקרים הללו. אתם לוקחים סיכון אמיתי כדי להימנע מעבודה שבדרך כלל קטנה ממה שזה נראה.

האדם שסומן בטעות (False Positive)

אם כתבתם זאת בעצמכם וגלאי טוען אחרת, הרצת הטקסט דרך מאנש היא הצעד הגרוע ביותר האפשרי. אתם תהפכו עבודה אותנטית למוזרה מבחינה סטטיסטית רק כדי לרצות כלי שטעה מלכתחילה, ותהרסו את הדבר היחיד שעוזר לכם: היסטוריית טיוטות נקייה ועקבית. הציגו את הטיוטות. שאלו אילו מקטעים סומנו. דברו על הטיעון שלכם.

הכותב המקצועי שמשתמש ב-AI ככלי טיוטה

זהו המקרה הנפוץ ביותר והפחות טעון. אם אתם מנסחים עם מודל ועורכים כראוי, אינכם זקוקים למאנש — עריכה למען משמעות כבר מייצרת את השונות שהכלים הללו מזייפים. אם הטיוטה הערוכה שלכם עדיין מקבלת ציון גבוה, זה לרוב מספר לכם משהו אמיתי: הכתיבה נותרה גנרית. תקנו את זה במקום.

השאלה שמאחורי השאלה

כמעט כל מי ששואל איך לנצח גלאי בעצם שואל איך להגיש משהו בלי לעשות את העבודה שבבסיסו. שווה להיות ישירים: הציון אינו הדבר שנבדק. מרצה, עורך או מנהל מגייס מנסים לברר האם אתם מבינים משהו. חיבור מואנש בצורה מושלמת שאינו אומר דבר עדיין אינו אומר דבר.

הדרך האמינה ביותר לטקסט שלא נקרא כמחולל היא טקסט שרק אתם יכולתם לכתוב — דוגמה ספציפית, מספר מהעבודה שלכם, טיעון שתגנו עליו. זו אינה מעקף. זה פשוט הדבר שהכתיבה הייתה אמורה להכיל מלכתחילה.

העמדה שלנו

אנו בונים גלאים וגם כלי שכתוב, כך שיש לנו עניין ברור כאן ועליכם לקרוא זאת בעיניים ביקורתיות. העמדה הכנה שלנו: שכתוב הוא מוצדק לשיפור הבהירות והזרימה בעבודה שלכם, אך שימוש בו כדי להסוות מחברות במקום שבו נשאלתם על כך אינו משהו שנמליץ עליו למישהו.

ולשאלה המקורית — אם כלי מספר לכם שהפלט שלו הוא בלתי ניתן לזיהוי לצמיתות, הטענה הזו אינה משהו שאף אחד יכול לתמוך בו. זיהוי ועקיפה הם אותו מרוץ חימוש הנצפה משני קצוות שונים, ואף צד לא מורשה להכריז עליו כמסתיים.

Check text for a specific AI model

Run your text through a detector tuned for the model you suspect.

שיתוף המאמר

Try Plagly.ai Free

Detect AI-generated content and check for plagiarism with industry-leading accuracy. No credit card required.

Get Started Free