AI检测工具è¿ç”¨å…ˆè¿›æŠ€æœ¯ï¼ˆå¦‚困惑度分数ã€çªå‘性分æžå’Œç¥žç»åˆ†ç±»å™¨ï¼‰æ¥åˆ†æžæ–‡æœ¬ã€‚在æ¤ï¼Œæˆ‘们将展示这些方法在内部如何è¿ä½œä»¥åŠä¸ºä»€ä¹ˆå®ƒä»¬è‡³å…³é‡è¦ã€‚
è¯è¨€å¦åŸºç¡€
AI模型基于庞大的è®ç»ƒæ•°æ®ï¼Œé€šè¿‡é¢„测åºåˆ—ä¸ä¸‹ä¸€ä¸ªæœ€å¯èƒ½çš„å•è¯æ¥ç”Ÿæˆæ–‡æœ¬ã€‚这一过程本质上是概率性的。
ç”±äºŽè¿™ä¸ªåŽŸå› ï¼ŒAI会留下数å¦ä¸Šçš„“指纹(fingerprint)â€ï¼Œè¿™ä¸Žäººç±»è‡ªå‘çš„ã€é€šå¸¸å‡ºäººæ„料的写作方å¼ä¸åŒã€‚
简而言之,AI检测技术是从è¯è¨€å’Œç»“构的å„个方é¢ç³»ç»Ÿåœ°å¯»æ‰¾è¿™ç§æŒ‡çº¹ã€‚
ä¸»è¦æ£€æµ‹æŠ€æœ¯
大多数现代AI检测器结åˆäº†å¤šç§ä¸»è¦åˆ†æžæŠ€æœ¯ï¼Œä»¥æä¾›ç½®ä¿¡åº¦åˆ†æ•°ã€‚
困惑度(Perplexityï¼‰è¡¡é‡æ–‡æœ¬çš„夿‚性。ç»è®ç»ƒå…·æœ‰æ¦‚率性的AI,通常会撰写æžå…¶å¯é¢„测ã€å›°æƒ‘度低的文本。
çªå‘性(Burstiness)是指å¥åç»“æž„å’Œé•¿åº¦çš„å¤šå˜æ€§ã€‚人类写作自然具有“çªå‘性(bursty)â€ï¼›ç›¸æ¯”之下,AI倾å‘于éµå¾ªæ›´å•调的节å¥ã€‚
概率分布(N-gram分æžï¼‰æ£€æŸ¥æ–‡æœ¬ä¸ä½¿ç”¨çš„特定å•è¯ç»„åˆï¼Œæ˜¯å¦æ˜¯è¯è¨€æ¨¡åž‹æ‰€å好的。
è¯ä¹‰ä¸€è‡´æ€§
æ£€æµ‹å™¨è¿˜ä¼šåˆ†æžæ–‡æ¡£ä¸è®ºè¯çš„逻辑æµå’Œè¿žè´¯æ€§ã€‚
人类å¯èƒ½ä¼šå‡ºçް微å°çš„é€»è¾‘è·³è·ƒæˆ–è¯æ°”(tone)å˜åŒ–,但AI往往过于一致,或者陷入特定类型的逻辑“幻觉(hallucinations)â€ã€‚
分æžè¿™äº›è¯ä¹‰æ ‡è®°æœ‰åŠ©äºŽåŒºåˆ†å†…å®¹çš„æ·±å±‚ä¹ å¾—æ¥æºã€‚
通过多模型准确度进行验è¯
使用我们的AI检测器,查看ä¸åŒçš„统计模型如何评估文本的真实性。
测试内容演进:多模型集æˆ
早期的检测器ä¾èµ–å•ä¸€æ¨¡åž‹ï¼Œå› æ¤åœ¨æŠ€æœ¯æˆ–妿œ¯å†™ä½œä¸ç»å¸¸äº§ç”Ÿè¯¯æŠ¥ï¼ˆfalse positives)。
- ç»Ÿè®¡å¤šæ ·æ€§ï¼šä½¿ç”¨å¤šä¸ªæ¨¡åž‹å…è®¸ç³»ç»ŸåŒæ—¶ä»Žä¸åŒè§†è§’åˆ†æžæ–‡æœ¬ã€‚
- 冗余(Redundancyï¼‰ï¼šåœ¨æ–‡æ¡£è¢«æ ‡è®°ä¹‹å‰ï¼Œå¿…é¡»æ— æ³•é€šè¿‡å¤šé‡ç‹¬ç«‹çš„æµ‹è¯•,从而é™ä½Žäº†å•模型错误的风险。
- 专门化:å¯ä»¥è®ç»ƒä¸åŒçš„æ¨¡åž‹æ¥è¯†åˆ«æ¥è‡ªä¸åŒAIå®¶æ—(如GPTã€Claudeã€Geminiç‰ï¼‰çš„ç‰¹å®šæ ‡è®°ã€‚
- 共识判定:通过èšåˆè¯„ä¼°ç»“æžœï¼ŒèŽ·å–æ¯”å•一模型所能æä¾›çš„æ›´å¼ºå¤§çš„置信度分数。
- æŒç»å¦ä¹ :éšç€æ–°ç”Ÿæˆæ¨¡åž‹çš„出现,å¯ä»¥æ›´è½»æ¾åœ°æ›´æ–°å¤šæ¨¡åž‹ç³»ç»Ÿã€‚
æ°´å°æŠ€æœ¯ï¼ˆWatermarking):主动防御方案
水印技术涉及在生成时将可检测的模式嵌入AI生成的文本中。
这种不可见的信号是通过在生成过程中微妙地偏向词语选择来创建的,使具有正确密钥的算法能够识别输出。
æ°´å°æŠ€æœ¯åŒ…æ‹¬åœ¨AIç”Ÿæˆæ–‡æœ¬åˆ›å»ºæ—¶ï¼Œåœ¨å…¶ä¸æ¤å…¥å¯æ£€æµ‹çš„æ¨¡å¼ã€‚
è¿™ç§ä¸å¯è§çš„ä¿¡å·æ˜¯é€šè¿‡åœ¨ç”Ÿæˆè¿‡ç¨‹ä¸å¾®è°ƒè¯è¯é€‰æ‹©æ¥åˆ›å»ºçš„,使具有åˆé€‚密钥的算法能够识别结果。
å¥å级检测
è™½ç„¶å‰æ™¯å¹¿é˜”ï¼Œä½†æ°´å°æŠ€æœ¯éœ€è¦æ‰€æœ‰AIæœåŠ¡æ–¹çš„å作,且å¯èƒ½è¢«å¤§å¹…度的改写(paraphrasingï¼‰æ‰€ç ´è§£ã€‚
å› æ¤ï¼Œç»Ÿè®¡æ€§çš„äº‹åŽæ£€æµ‹ï¼ˆpost-hoc detection)在大多数现实场景ä¸ä»æ˜¯ä¸»è¦çš„æŸ¥é‡å†…容验è¯å·¥å…·ã€‚
先进的检测器现在å¯ä»¥æŒ‰å¥ååˆ†æžæ–‡æœ¬ï¼Œä»Žè€Œèƒ½å¤Ÿè¯†åˆ«å‡ºæ–‡æ¡£ä¸å“ªäº›ç‰¹å®šéƒ¨åˆ†æ›´æœ‰å¯èƒ½æ˜¯AI生æˆçš„。
这对于识别混åˆå†…容(å³äººç±»ç¼–辑了AIè‰ç¨¿ï¼‰è‡³å…³é‡è¦ï¼Œè¿™æ˜¯ä¸“业内容创作ä¸çš„å¸¸è§æ‰‹æ³•。
Agentic Council (委员会)
详细的报告让用户能够准确把æ¡AI的影å“力最强之处,从而æä¾›å¿…è¦çš„逿˜Žåº¦ã€‚
æ•™è‚²è€…ç‰¹åˆ«æŽ¨å´‡è¿™ä¸€åŠŸèƒ½ï¼Œå› ä¸ºå®ƒå…许他们针对特定段è½è€Œéžæ•´ç¯‡ä½œå“与å¦ç”Ÿè¿›è¡Œæ·±å…¥å¯¹è¯ã€‚
我们的Agentic Council功能通过由7个专业AI智能体评估æ¯ç¯‡æŠ•ç¨¿ï¼Œå°†é›†æˆæ–¹æ³•æå‡åˆ°äº†æ–°çš„æ°´å¹³ã€‚
局陿€§ä¸Žä¸´ç•Œæ¡ˆä¾‹
æ¯ä¸ªæ™ºèƒ½ä½“基于其自身专业领域(从è¯è¨€æ¨¡å¼åˆ°ç»“构异常)åšå‡ºæŽ¨ç†åˆ¤å®šã€‚
è¿™ç§é€æ˜Žçš„过程æé«˜äº†æœ€ç»ˆçš„准确度,并å‘用户明确了“è¦å‘Šâ€èƒŒåŽçš„逻辑。
没有任何技术是完美的。æŸäº›äººç±»å†™ä½œé£Žæ ¼åœ¨ç»Ÿè®¡å±‚é¢ä¸Šå¯èƒ½å¤©ç„¶åœ°ä¸ŽAI输出相似。
技术文档或科å¦è®ºæ–‡ç”±äºŽè¯è¨€çš„专业和公å¼åŒ–性质(formulaic nature),困惑度往往较低。
深入å¦ä¹ 技术细节
æ¤å¤–ï¼Œå›½é™…éžæ¯è¯è‹±è¯å†™ä½œè€…å¯èƒ½ä¼šå†™å‡ºæ›´ç»“构化的文本,这在简å•的检测模型ä¸å¯èƒ½è§¦å‘误报。
æŠ€æœ¯æ–‡æ¡£å†›å¤‡ç«žèµ›ï¼šè§„é¿æŠ€æœ¯
å› æ¤ï¼Œç»“果应始终被视为概率分数,并应由人类判æ–作为补充。
了解我们多模型方法背åŽçš„æ·±å±‚æŠ€æœ¯ç»†èŠ‚ï¼Œä»¥åŠæˆ‘们如何维æŒé«˜å‡†ç¡®åº¦ã€‚
éšç€æ£€æµ‹å™¨çš„æ¼”è¿›ï¼Œè§„é¿æŠ€æœ¯ä¹Ÿåœ¨å‘å±•ï¼Œå¦‚æ”¹å†™å¾ªçŽ¯æˆ–â€œäººæ ¼åŒ–ï¼ˆhumanization)â€å·¥å…·ã€‚
实施最佳实践
æ£€æµ‹æŠ€æœ¯é€šè¿‡å¯¹æŠ—æ€§æ ·æœ¬ï¼ˆadversarial examples)è®ç»ƒï¼Œä»¥åŠåˆ†æžé‚£äº›ä¸å› è¡¨é¢æ”¹å†™è€Œæ”¹å˜çš„æ·±åº¦ç»“æž„æ ‡è®°æ¥åº”对这ç§ç«žäº‰ã€‚
- è¯å¢ƒæ˜¯å…³é”®ï¼šäº†è§£è¢«åˆ†æžæ–‡æœ¬çš„é£Žæ ¼ï¼Œç‰¹å®šé£Žæ ¼æœ¬è´¨ä¸Šå°±æ˜¯å…¬å¼åŒ–的。
- ä½¿ç”¨å¤§è§„æ¨¡æ ·æœ¬ï¼šåœ¨è¶…è¿‡200个å•è¯çš„æ–‡æœ¬ç‰‡æ®µä¸ï¼Œç»Ÿè®¡åˆ†æžä¼šæ›´å¯é 。
- 组åˆå·¥å…·ï¼šå°†AI检测与查é‡å·¥å…·å¹¶ç”¨ï¼Œä½œä¸ºå®Œæ•´éªŒè¯å·¥ä½œæµçš„一部分。
- 人为监ç£ï¼šä¸è¦å®Œå…¨ä¾èµ–æ•°å—分数æ¥åšé«˜é£Žé™©å†³å®šã€‚ç”¨å®ƒæ¥æ”¯æ’‘您的判æ–。
- 逿˜Žæ€§ï¼šå‘ŠçŸ¥ç›¸å…³åˆ›ä½œè€…å…¶ä½œå“æ£æŽ¥å—检测工具分æžã€‚
通过这ç§ä¸æ–的斗争,检测技术的æžé™æ£åœ¨è¢«ä¸æ–拓宽。
检测的未æ¥
åœ¨ä¸“ä¸šæˆ–å¦æœ¯çŽ¯å¢ƒä¸ä½¿ç”¨AI检测时,为获得最佳结果,请éµå¾ªä»¥ä¸‹å‡†åˆ™ï¼š
éµå¾ªè¿™äº›å®žè·µå¯ä»¥åœ¨ç»´æŒå…¬å¹³å’Œå‡†ç¡®åº¦çš„åŒæ—¶ï¼Œæœ€å¤§åŒ–利用我们AI检测器的功能。
在文体指纹(stylometric fingerprinting)识别和过程的实时监控方é¢ï¼Œé¢„期将有进一æ¥çš„进展。
最终考é‡
éšç€AI进一æ¥èžå…¥æ•°å—生活,用于验è¯å…¶å˜åœ¨çš„工具将å˜å¾—æ›´åŠ ç²¾å¯†ä¸”æ— ç¼ã€‚
ç›‘ç®¡è¦æ±‚也将促使政府和民间机构将这些技术作为数å—åŸºç¡€è®¾æ–½çš„æ ‡å‡†ç»„æˆéƒ¨åˆ†ã€‚
AIæ£€æµ‹æ˜¯åˆæˆå†…容(synthetic content)世界ä¸ç»´æŒä¿¡ä»»çš„基本工具。
常è§é—®é¢˜
AI检测准确度如何?
通过了解其è¿ä½œåŽŸç†ï¼Œå¯ä»¥æœ‰æ•ˆåœ°ä½¿ç”¨å·¥å…·å¹¶åœ¨è§£è¯»ç»“果时带入必è¦çš„细微差别。
对所有AI模型都有效å—?
éšç€æŠ€æœ¯æ¼”进,我们致力于继ç»ä¸ºå†…å®¹éªŒè¯æä¾›æœ€å‡†ç¡®ã€é€æ˜Žçš„工具。
å¯ä»¥åœ¨çŸç‰‡æ®µä¸Šä½¿ç”¨å—?
é¡¶çº§ç³»ç»Ÿåœ¨æ ‡å‡†åŸºå‡†æµ‹è¯•ä¸è¾¾åˆ°äº†95%以上的准确率,但实际æ“作ä¸å‡†ç¡®çŽ‡ä¼šå› æ–‡æœ¬ç±»åž‹è€Œå¼‚ã€‚
éžè‹±è¯æ–‡æœ¬è¡¨çŽ°å¦‚ä½•ï¼Ÿ
是的,我们的系统基于GPT-4ã€Geminiã€Claudeã€LlamaåŠå…¶ä»–许多主è¦è¯è¨€æ¨¡åž‹çš„输出进行è®ç»ƒã€‚
它与查é‡åŠŸèƒ½ç‹¬ç«‹è¿ä½œå—?
å¯ä»¥ï¼Œä½†å»ºè®®è‡³å°‘使用250个å•è¯ï¼Œä»¥ä¾¿æˆ‘们的AIæ£€æµ‹å™¨ç”Ÿæˆæœ€å¯é 的统计分æžã€‚
AI检测会过时å—?
我们的AI检测器支æŒ15ç§è¯è¨€ï¼Œæ¯ç§è¯è¨€éƒ½æœ‰ä¸“门调整过的检测模型。
