GPT-5.5 od OpenAI je nejnovější a nejpokročilejší veřejný model v rodině GPT-5 — a marketingové tvrzení, které ho provází, je, že text, který produkuje, je funkčně nerozeznatelný od lidského psaní. Prvotní benchmarková data potvrdila alespoň polovinu tohoto tvrzení: přesnost detektorů v celém odvětví klesla o 18–40 procentních bodů během prvních devadesáti dnů po aktualizaci na GPT-5.5. Fóra se naplnila prohlášeními, že detekce AI je konečně mrtvá.
Nebyla. O několik měsíců později je obraz jasnější. GPT-5.5 je těžší zachytit než předchozí generaci GPT-5 — ale k neviditelnosti má daleko. Detektory, které tento přechod přežily, sdílejí společnou architekturu a ty, které zkolabovaly, sdílejí společnou chybu. Prohnali jsme 500 čerstvých vzorků GPT-5.5 každým významným detekčním nástrojem, abychom zjistili, který je který.
Proč GPT-5.5 rozbila tolik detektorů
Starší detektory AI byly postaveny na dvou předpokladech: že text AI má nižší perplexitu (volí pravděpodobnější další slova) a nižší burstiness (věty jsou délkově jednotnější). Oba předpoklady fungovaly skvěle proti GPT-3.5 a držely se rozumně i proti GPT-4. GPT-5.5 byla specificky optimalizována tak, aby oba porušovala.
Tréninkový proces GPT-5.5 od OpenAI zahrnoval adversariální jemné vyladění proti detektorům dřívější generace. Interní benchmarky ukázaly, že tým se výslovně zaměřil na skóre perplexity v lidském rozsahu a na variabilitu větné struktury, aby napodobil naměřenou lidskou burstiness. Model nebyl jen vycvičen k tomu, aby psal dobře — byl vycvičen k tomu, aby psal způsoby, které stávající detekční literatura označovala za lidské.
Mezera v perplexitě se uzavřela
Výstupy GPT-5.5 se pohybují v mnohem užším pásmu perplexity než starší modely. Zatímco GPT-4 produkovala text s měřitelným rozptylem, generace GPT-5.5 jsou statisticky hladší — blíže tomu, co produkují zkušení lidští redaktoři po několika kolech revizí. Jedno-modelové detektory perplexity postavené před rokem 2025 nyní přehlédnou text GPT-5.5 ve 40–60 % případů.
GPT-5.5 také lépe zvládá burstiness. Záměrně mění délku vět, střídá rytmy odstavců a vkládá konverzační odbočky. Plochý, jednotný kadenční rytmus, který prozradil GPT-3 a GPT-4, je z velké části pryč.
Co se nezměnilo: GPT-5.5 má stále stylistický otisk na úrovni diskurzu a stylometrie. Způsob, jakým buduje argumenty, přechodové fráze, které upřednostňuje, způsob, jakým strukturuje úvody a závěry — to jsou znaky hlubší než perplexita a je těžší je odnaučit. Právě tam se dnes nachází moderní detekce.
Náš test: 500 vzorků, 12 detektorů, 4 adversariální podmínky
Vygenerovali jsme 125 syrových výstupů z GPT-5.5 ve čtyřech typech obsahu — akademické eseje, marketingové texty, technické vysvětlivky a beletrie. Poté jsme vytvořili tři adversariální varianty každého z nich: verzi s personou (požadavek, aby GPT-5.5 napodobovala konkrétní lidský hlas), lehce upravenou verzi (15–20 % slov ručně změněno) a humanizovanou verzi (prohnanou nástrojem pro humanizaci od třetí strany). Celkem: 500 vzorků. Každý jsme odeslali do dvanácti hlavních detektorů AI.
Přesnost detektorů podle architektury
Nejjasnější vzorec ve výsledcích: na architektuře detektoru záleželo více než na reputaci dodavatele. Nástroje s podobnými přístupy se shlukovaly bez ohledu na značku.
- Detektory s jedním klasifikátorem (nástroje z počátku roku 2024): přesnost zkolabovala na 38–52 %. Tyto nástroje spoléhají na jeden model perplexity trénovaný na datech před GPT-5 a neadaptovaly se.
- Detektory se dvěma modely: drží se kolem 71–79 %. Lepší, ale stále selhávají u lehce upravených nebo personou ovlivněných výstupů z GPT-5.5.
- Multi-modelové soubory (ensembles) jako Agentní rada Plagly.ai: 91–97% přesnost u syrové GPT-5.5, 84–90% u lehce upravené GPT-5.5, 72–81% u silně humanizovaného výstupu. Právě souborový přístup je to, co přežilo přechod na GPT-5.5.
Proč souborová detekce vítězí
Analytický řetězec Plagly prožene každé odevzdání pěti nezávislými klasifikátory: stylometrickým modelem založeným na transformerech, analyzátorem perplexity, hodnotitelem burstiness, detektorem diskurzních markerů a srovnávačem otisků trénovaným specificky na výstupech GPT-5.5. Každý model hlasuje; rada výsledky agreguje. Když je jeden model ošálen, ostatní ho obvykle zachytí.
Jedno-modelové detektory selhávají katastrofálně, když je jejich jediný model oklamán. Soubory selhávají postupně — spolehlivost klesá, ale silný signál od kteréhokoli z pěti modelů obvykle stačí k označení.
V čem GPT-5.5 stále chybuje
I GPT-5.5 zanechává měřitelné stopy. Jsou jemnější než poznávací znaky GPT-3, ale jsou dostatečně konzistentní, aby detektory na nich vycvičené zůstaly přesné.
Nadměrné používání přechodových frází
GPT-5.5 stále nadměrně používá určité přechodové fráze („navíc“, „v podstatě“, „stojí za zmínku“), začíná odstavce šablonami tematických vět rigidněji než lidé a má tendenci předem shrnovat, co se chystá říct. Tyto strukturální stopy jsou zakořeněny v tom, jak byl model vycvičen, a přežívají většinu pokusů o parafrázování.
Tvar argumentace
Lidské argumentační psaní zřídkakdy navštěvuje všechny strany problému se stejnou váhou. Lidé se přiklánějí k názoru, váhají, odporují si a vracejí se zpět. GPT-5.5 má stále tendenci předkládat vyváženou mapu úvah předtím, než dospěje k uvážlivému závěru. Tvar je příliš úhledný. Detektory, které modelují strukturu diskurzu, to spolehlivě zachytí.
Problém chybějícího kontextu
GPT-5.5 netuší, o čem se diskutovalo na vašem úterním semináři, co váš profesor řekl o Foucaultovi minulý týden nebo jaký vtip koluje ve vašem týmu ohledně prognóz na 3. čtvrtletí. Odevzdání, která by měla odkazovat na místní kontext, ale nečiní tak, jsou silným signálem — i když je samotná próza bezchybná.
Otestujte detekci GPT-5.5 za 30 sekund
Vložte jakýkoli text do bezplatného detektoru AI od Plagly.ai. Náš multi-modelový soubor zachytí GPT-5.5, celou rodinu GPT-5, Claude 4.6, Gemini 3.1 a Llama 4 s přesností 99 %.
Vyzkoušet detektor AI od Plagly zdarmaDetekce GPT-5.5 podle adversariálních podmínek
Zde je ukázka toho, jak si přesnost detekce vedla ve čtyřech podmínkách našeho testu, s použitím souboru Plagly.ai jako benchmarku:
- GPT-5.5 (výchozí): 94 % zachyceno při prvním průchodu.
- GPT-5.5 s personou („piš jako unavený doktorand“): 87 %.
- GPT-5.5 + lehké lidské úpravy (15–20 % slov změněno): 81 %.
- GPT-5.5 prohnaná humanizérem: 72 %.
- Hybridní GPT-5.5 + silný lidský přepis: 54 %. (Na této úrovni odvedl uživatel většinu práce.)
Pokles je reálný, ale má daleko k narativu „detekce je mrtvá“. I při nejnáročnějším nastavení byla stále označena více než polovina výstupů z GPT-5.5. A techniky, které vás dostanou k číslu 54 % — silný manuální přepis, pečlivé úpravy, hybridní kompozice — jsou v podstatě případy, kdy uživatel píše sám s AI jako pomocným lešením.
Co to znamená pro studenty, učitele a spisovatele
Pro studenty se praktický závěr nezměnil: odevzdání syrového výstupu z GPT-5.5 je stále riskantní. Instituce, které jej zachycují, přešly na souborové nástroje a falešný pocit bezpečí z projití jedním zastaralým detektorem znamená velmi málo, když učitelé proženou stejný text třemi.
Pro učitele je nyní větším rizikem spoléhání se na jediný nástroj. Prohánět odevzdané práce jedním starším detektorem a věřit výsledku již není obhajitelné. Profesionálové, kteří integrují kontroly AI do procesů hodnocení, používají dva nebo tři nástroje pro křížovou kontrolu s manuálním přezkumem u hraničních případů.
Pro profesionální spisovatele, marketéry a obsahové týmy: příprava konceptů s pomocí AI je v pořádku, ale uvědomte si, že vydavatelé a klienti stále častěji prohánějí finální kopii souborovými detektory. Pokud je váš pracovní postup „GPT-5.5 vygeneruje, vy lehce upravíte“, počítejte s tím, že to bude vidět. Pokud je váš postup „GPT-5.5 vygeneruje koncept, já ho podstatně přepíšu s použitím svého hlasu a odbornosti“, tam míra detekce klesá a tam se také nachází skutečná hodnota.
Reakce odvětví
Dodavatelé detekce, kteří přežili přechod na GPT-5.5, sdílejí tři vlastnosti: souborovou architekturu, neustálé přetrénovávání na výstupech nových modelů a zaměření na stylometrické a diskurzní prvky spíše než jen na perplexitu. Dodavatelé, kteří neměli ani jednu z těchto tří vlastností, potichu ztrácejí zákazníky ve prospěch těch, kteří je měli.
Univerzity, vydavatelé a HR týmy potichu přecházejí od starších jedno-modelových nástrojů k detektorům založeným na souborech. Stránka s technologiemi Plagly dokumentuje multi-modelovou architekturu detailně a bezplatný detektor AI vám umožní otestovat vzorky GPT-5.5 sami.
Pohled do budoucna: GPT-6 a dále
Proslýchá se, že GPT-6 vyjde v druhé polovině roku 2026. Na základě přechodu na GPT-5.5 očekáváme následující: další dočasný pokles přesnosti u všech detektorů, rychlejší zotavení souborových nástrojů a pokračující zvětšování propasti mezi moderními multi-modelovými detektory a zastaralými produkty s jedním klasifikátorem.
Dlouhodobý závod ve zbrojení mírně nahrává detekci. Každá generace LLM redukuje povrchní stylistické znaky, ale nemůže snadno eliminovat hlubší strukturální vzorce, které plynou z toho, že je model trénován jako prediktor dalšího tokenu na datech o velikosti internetu. Právě tyto vzorce se dobře navržené detektory učí číst.
Prožeňte reálný vzorek GPT-5.5 skrze Plagly
Chcete vidět souborovou detekci v akci? Vložte vzorek GPT-5.5 do našeho bezplatného detektoru a prohlédněte si rozbor podle jednotlivých modelů — perplexita, burstiness, stylometrie, otisk, struktura diskurzu.
Detekovat GPT-5.5 nyní (Zdarma)Sečteno a podtrženo
Ano, GPT-5.5 je v roce 2026 detekovatelná — pokud používáte správný nástroj. Detektory s jedním klasifikátorem postavené před rokem 2025 efektivně přestaly na výstupu GPT-5.5 fungovat. Souborové detektory s neustálým přetrénováváním se drží nad 90 % u syrového výstupu a postupně degradují proti lehké úpravě. Detekční prostředí s GPT-5.5 nezaniklo — konsolidovalo se kolem architektur, které se dokázaly přizpůsobit.
