Slovo „delve“ se mezi roky 2020 a 2024 vyskytlo v lékařských publikacích o 654 % častěji. A důvod není v tom, že by se vědci náhle začali zajímat o pečlivější rozbory. Důvod sedí v Nairobi a Lagosu. Tak proč vlastně umělá inteligence píše tak, jak píše? Odpověď je překvapivější, než byste čekali.
Slovo, které prozradí AI text
Jestli vás někdy napadlo, že některý e-mail nebo článek „nějak divně voní“ po ChatGPT, pravděpodobně jste si všimli několika opakujících se znaků: pomlčky em-dash (—), slov jako delve, crucial, meticulous, underscore nebo boast. A nejste sami.
Studie publikovaná v roce 2024 analyzovala přes 14 milionů abstraktů z databáze PubMed a zjistila, že některá slova explodovala v používání právě po nástupu ChatGPT v listopadu 2022. Slovo „delve“ (česky „zabřednout do tématu“, „pronikat hlouběji“) se objevilo 349× v roce 2020 — a v roce 2023 už 2 847×. Podle analýzy je dnes asi 1 ze 7 biomedicínských abstraktů psán s pomocí AI, a v informatice jde dokonce o 22,5 % všech publikací.
Ale proč zrovna „delve“? Proč ne třeba „explore“ nebo „examine“?
Stopa z Nairobi a Lagosu
Tady se příběh stává opravdu zajímavým. Modely jako ChatGPT se trénují ve dvou fázích. Nejprve „čtou“ miliardy textů z internetu (pre-training). Pak se jejich výstupy lidsky hodnotí — tomu se říká RLHF (Reinforcement Learning from Human Feedback). Lidé porovnávají odpovědi modelu a označují, která je „lepší“.
A právě tato fáze formuje styl modelu. Když OpenAI hledalo levnou pracovní sílu pro RLHF anotace, obrátilo se podle reportáže Time Magazine na společnost Sama s pobočkami v Keni a Ugandě. Tamní pracovníci hodnotili statisíce odpovědí a přirozeně preferovali ty, které zněly podle jejich jazykové normy.
A v nigerijské a keňské obchodní angličtině je slovo „delve“ mnohem běžnější než v britské nebo americké. Neurovědec Tony Zador to vystihl: „Skončili jsme s AI systémem, který píše tak trochu jako Afričan.“
Em-pomlčka: druhý otisk prstu
Druhý charakteristický znak AI textů je nadužívání pomlčky em-dash (—). Analýza ukázala, že GPT-4.1 používá em-pomlčky 3,28× častěji než lidský pisatel. Důvod je tentokrát jiný: v knihách a esejích, na kterých se modely trénují, jsou em-pomlčky velmi časté — daleko častější než v běžné konverzaci nebo na sociálních sítích.
Model si tedy zafixoval, že „elegantní text“ obsahuje hodně em-pomlček. A protože RLHF anotátoři často odměňovali přehledné a strukturované odpovědi, učinilo to z em-pomlčky téměř povinný prvek.
V listopadu 2025 Sam Altman oznámil, že OpenAI konečně přidalo možnost vypnout em-pomlčky pomocí Custom Instructions. Sám to nazval „malou, ale šťastnou výhrou“. Trvalo to skoro tři roky.
Nečekaná oběť: rodilí Nigerijci
Ironie celého příběhu je dramatická. Lidé, jejichž rodný jazyk obsahuje slova jako „delve“ zcela přirozeně, jsou dnes nespravedlivě obviňováni z používání AI. Detektory AI textů (Turnitin, GPTZero a podobné nástroje) je flagují, učitelé jejich práce odmítají, redaktoři jim odmítají články.
Nigerijská a keňská angličtina, která má vlastní bohatou tradici, byla — paradoxně skrze nedostatečně placené anotátory — z části zakódována do globálního AI systému. A teď je obrácena proti svým rodilým mluvčím.
Co to znamená pro vás?
Tři praktické důsledky pro firmy a tvůrce obsahu:
- Slepé AI detektory nefungují. Pokud vaše HR oddělení nebo škola používá detektory na základě „typických AI slov“, riskuje falešná obvinění — zejména u nerodilých mluvčích angličtiny.
- Originalita stylu je teď konkurenční výhoda. Pokud váš firemní blog zní jako každý druhý LinkedIn post psaný AI, čtenáři to vycítí. Vlastní hlas a konkrétní příklady jsou cennější než kdy dřív.
- Custom Instructions fungují. Naučte AI svůj firemní styl a explicitně jí zakažte „delve“, „crucial“, em-pomlčky a další klišé. ChatGPT na to (konečně) reaguje.
Pokud chcete promyšleně používat AI ve vaší firmě tak, aby vaše komunikace nezněla jako každá druhá — projdeme to s vámi krok za krokem. Nezávislé AI poradenství v Praxiu začíná úvodní konzultací zdarma a férovým doporučením, co nasadit a co ne. Pokud teprve mapujete, kde by AI ve firmě dávala smysl, podívejte se i na AI Kompas.
Často kladené otázky
Je „delve“ opravdu nejjistější známka AI textu?
Není. Je to indikátor, ne důkaz. Mnoho lidí — zejména rodilí mluvčí afrických variet angličtiny nebo akademici — používá „delve“ zcela přirozeně. Studie z roku 2024 ukazují, že detekce AI textu funguje s 70–80% přesností, což znamená 20–30 % falešných obvinění.
Píše ChatGPT jinak v češtině než v angličtině?
Ano. V češtině nemá ChatGPT tak silně vyježděné „signaturní“ slovo. Místo toho má tendenci k formálním obratům, nadužívá spojky „nicméně“, „dále“, „je důležité zmínit“ a má rád dlouhá souvětí. Také často používá oboustranné uvozovky („“) namísto klasických typografických.
Jak donutit ChatGPT psát jiným stylem?
V nastavení ChatGPT najdete Custom Instructions. Napište tam konkrétně: „Nepoužívej slova jako ‚delve‘, ‚crucial‘, ‚meticulous‘. Nepoužívej em-pomlčky (—). Piš krátké věty. Vyhni se formálním frázím.“ Od listopadu 2025 model tyto instrukce skutečně respektuje.
Zdroje:
Kobak et al., Delving into LLM-assisted writing through excess vocabulary (PubMed, 2024) · Simon Willison: How cheap, outsourced labour in Africa is shaping AI English · Tony Zador on RLHF and Nigerian English · Science.org: One-fifth of computer science papers may include AI content · PCWorld: OpenAI fixes ChatGPT em-dash obsession (2025)