Zpět na blog
Novinky z AI

GPT-5.5 vs Claude 4.6 vs Gemini 3.1: Která AI roku 2026 se nejhůře detekuje?

PTým Plagly.ai||9 min čtení

V květnu 2026 dominují profesionálnímu i akademickému psaní tři hraniční modely AI: GPT-5.5 od OpenAI, Claude 4.6 od Anthropic a Gemini 3.1 od Google. Každý z nich přichází s marketingovými tvrzeními o tom, jak lidsky působí jeho výstupy. Každý je využíván milionkrát denně pro typy textů, které končí v esejích, zprávách a knihovnách obsahu. A každý zanechává jiný statistický otisk, který detekční nástroje dokážou – nebo někdy nedokážou – zachytit.

Provedli jsme test na 600 čerstvých vzorcích ze všech tří modelů a prohnali každý z nich stejným multi-modelovým souborovým (ensemble) detektorem. Výsledky vyvracejí několik běžných předpokladů o tom, který model je nejtěžší detekovat – a objasňují, proč na odpovědi v roce 2026 záleží více než v kterémkoli předchozím roce.

Jak jsme testovali

Vygenerovali jsme 200 výstupů na každý model – po 50 v kategoriích akademických esejů, marketingových textů, technických vysvětlení a kreativní fikce. Každá generace používala výchozí systémový prompt bez instrukcí k vyhnutí se detekci. Poté jsme pro každý vzorek vytvořili „adversariální“ varianty: verzi zpracovanou humanizérem a lehce upravenou verzi (15–20 % slov ručně přepsáno). Celkem: 600 základních vzorků, 1 200 adversariálních vzorků.

Každý vzorek byl vyhodnocen souborem Agentní rady Plagly.ai (perplexity, burstiness, stylometrie, otisk, diskurz) a křížově zkontrolován s nejnovějším klasifikátorem od významného komerčního jedno-modelového detektoru. Níže uvedené výsledky uvádějí míru detekce systému Plagly.

Hlavní výsledky: Čistý výstup

U výchozích výstupů bez adversariálních úprav se všechny tři modely shlukují překvapivě blízko sebe – ale malé rozdíly jsou vypovídající.

Přesnost detekce u čistých výstupů

GPT-5.5 (čistý): 94 % zachyceno. Claude 4.6 (čistý): 88 % zachyceno. Gemini 3.1 (čistý): 92 % zachyceno. U výchozích výstupů bez adversariálních promptů jsou všechny tři modely spolehlivě detekovány souborovými nástroji – ale rozdíl mezi Claude 4.6 a ostatními je reálný.

Proč Claude 4.6 vede v nenápadnosti

Claude 4.6 byl trénován se silným zaměřením na variabilitu rejstříku a rytmus prózy podobný lidskému. Model mění větnou strukturu agresivněji než jeho konkurenti, používá méně šablonovitých přechodů a v argumentačním psaní vykazuje opravdovější zaujetí postojem. Výsledkem je text, který se v osách perplexity a burstiness (na které se zaměřují jedno-modelové detektory) skórem blíží lidské próze.

Proč je GPT-5.5 nejjednodušší odhalit

Přestože je GPT-5.5 nejvíce optimalizován pro plynulost, zachovává si nejsilnější strukturální vzorce „shora dolů“ ze všech tří modelů. Jeho trénink kladl důraz na spolehlivost a vyváženost, což vytváří rozpoznatelný tvar argumentu: úvod, prezentace více perspektiv, závěr s odměřenou syntézou. Detektory, které modelují diskurz na úrovni odstavců a dokumentů, to zachycují konzistentně, i když povrchové znaky na úrovni vět projdou.

Kde se modely rozcházejí: Rozbor podle funkcí

Hlavní čísla přesnosti skrývají větší rozdíly v tom, které znaky spouštějí detekci. Pohled na skóre jednotlivých klasifikátorů vypráví užitečnější příběh.

Diskurzivní signály

GPT-5.5 má nejsilnější diskurzivní otisk ze všech tří modelů. Jeho preference pro vyvážené argumenty, nadměrné používání určitých přechodových frází a tendence k předběžnému shrnutí z něj dělají nejsnadněji odhalitelný model na úrovni odstavců – i když jednotlivé věty projdou jedno-modelovými detektory.

Stylometrické signály

Gemini 3.1 vede ve stylometrických znacích. Jeho výstupy vykazují charakteristické vzorce ve frekvenci příslovcí, konstrukci trpného rodu a rytmu na úrovni vedlejších vět. Tyto prvky jsou hluboce zakořeněny v tom, jak byla tréninková data společnosti Google připravována, a ukázalo se, že je pro model obtížné je potlačit bez ztráty plynulosti.

Signály perplexity

Claude 4.6 má nejčistší profil perplexity – jeho výstupy jsou nejblíže lidmi psaným základům. Právě proto je pro jedno-modelové detektory perplexity nejtěžší ho zachytit. Ale Claude 4.6 má stále měřitelné znaky otisku a diskurzu, což je důvod, proč si souborové detektory zachovávají přesnost i tam, kde jednodušší nástroje selhávají.

Otestujte všechny tři modely proti souboru Plagly

Vložte výstup z GPT-5.5, Claude 4.6 nebo Gemini 3.1 do bezplatného detektoru AI Plagly.ai. Podívejte se na rozbor podle modelů – perplexita, burstiness, stylometrie, otisk, diskurz – a na to, který signál spustil výsledek.

Vyzkoušet Plagly zdarma

Adversariální podmínky: Když jde do tuhého

Větší rozdíl mezi modely se objevuje v adversariálních podmínkách. Poté, co jsme výstup každého modelu prohnali humanizérem, jsme test provedli znovu:

  • GPT-5.5 + humanizér: 72 % zachyceno.
  • Claude 4.6 + humanizér: 64 % zachyceno.
  • Gemini 3.1 + humanizér: 70 % zachyceno.

Náskok modelu Claude 4.6 v čistých podmínkách se po zapojení humanizéru ještě zvětšuje – ale i v tom nejvíce adversariálním nastavení je většina výstupů Claude 4.6 stále označena. Představa, že by některý z těchto modelů mohl spolehlivě unikat moderním souborovým detektorům, v datech neobstojí.

Proč na tom v roce 2026 záleží

Války modelů zrychlily koncem roku 2025 a v roce 2026. OpenAI vydala GPT-5.5 ve snaze přeskočit náskok modelu Claude v nenápadnosti, Anthropic odpověděl vylepšením rytmu prózy u Claude 4.6 a Google vylepšil Gemini 3.1, aby smazal rozdíl v plynulosti. Z hlediska detekce se praktické důsledky sbližují.

Jedno-modelové detektory jsou stále nespolehlivější

U všech tří modelů jsou nejvíce ohroženy jedno-klasifikátorové detektory. Nástroj založený pouze na perplexitě, který dobře fungoval na GPT-3.5, nyní v 50–60 % případů špatně klasifikuje výstup z Claude 4.6. Nástroj založený pouze na burstiness selhává podobně. Více-modelové soubory si zachovávají přesnost, protože žádný jednotlivý model nemusí odvést veškerou práci.

Průběžné přetrénovávání záleží více než jakýkoli jednotlivý algoritmus

Agentní rada Plagly.ai průběžně přetrénovává svůj modul otisků na čerstvých výstupevech z každého významného hraničního modelu. Přesnost detekce u Claude 4.6 vzrostla od spuštění zhruba o šest procentních bodů, jak se stylistické vzorce modelu lépe promítly do tréninkových dat – vzorec, který se opakuje s každým novým vydáním modelu.

Co dál: Claude 5, GPT-6, Gemini 4

Všechny tři laboratoře veřejně avizovaly vydání příští generace v průběhu roku 2026 a do roku 2027. Na základě cyklu GPT-5.5/Claude 4.6/Gemini 3.1 lze očekávat: další dočasný propad přesnosti detekce u všech nástrojů při každém významném vydání, rychlejší zotavení u souborových produktů a pokračující rozevírání nůžek mezi moderními multi-modelovými detektory a staršími produkty s jedním klasifikátorem.

Dlouhodobý závod ve zbrojení mírně nahrává detekci. Každá generace LLM omezuje povrchní stylistické znaky, ale nemůže snadno eliminovat hlubší strukturální vzorce, které plynou z toho, že jsou trénovány jako prediktory příštího tokenu na datech v měřítku celého internetu. Právě tyto vzorce se dobře navržené detektory učí číst a je to vrstva, která přežívá aktualizace modelů.

Provedťe reálný souboj modelů

Máte výstupy z GPT-5.5, Claude 4.6 nebo Gemini 3.1? Bezplatný detektor Plagly rozebírá, které signály každý model spouští – a ukazuje vám, proč stejný obsah čtou souborové a jedno-modelové nástroje odlišně.

Spustit bezplatný test detekce

Sečteno a podtrženo

Claude 4.6 je v současné době nejtěžší detekovatelný ze všech tří hraničních modelů – ale pouze o několik procentních bodů a pouze při měření proti jedno-modelovým detektorům. Multi-modelové soubory stále označují většinu výstupů všech tří modelů a rozdíl se s každým kolem přetrénovávání detektorů dále zmenšuje. Správná otázka pro rok 2026 nezní „který model mohu použít k vyhnutí se detekci?“, ale „kterému detektoru mohu věřit, že mi poskytne přesný údaj?“. Odpověď na tuto otázku – souborový, multi-modelový, průběžně přetrénovávaný – nebyla nikdy jasnější.

Zkontrolujte text pro konkrétní AI model

Spusťte detekci pomocí detektoru vyladěného pro konkrétní model, který máte v podezření.

Sdílet tento článek

Vyzkoušejte Plagly.ai zdarma

Detekujte obsah generovaný AI a kontrolujte plagiátorství s nejvyšší přesností. Bez nutnosti kreditní karty.

Get Started Free