Slovo „delve“ se mezi roky 2020 a 2024 vyskytlo v lékařských publikacích o 654 % častěji. A důvod není v tom, že by se vědci náhle začali zajímat o pečlivější rozbory. Důvod sedí v Nairobi a Lagosu. Tak proč vlastně umělá inteligence píše tak, jak píše? Odpověď je překvapivější, než byste čekali.

Slovo, které prozradí AI text

Jestli vás někdy napadlo, že některý e-mail nebo článek „nějak divně voní“ po ChatGPT, pravděpodobně jste si všimli několika opakujících se znaků: pomlčky em-dash (—), slov jako delve, crucial, meticulous, underscore nebo boast. A nejste sami.

Studie publikovaná v roce 2024 analyzovala přes 14 milionů abstraktů z databáze PubMed a zjistila, že některá slova explodovala v používání právě po nástupu ChatGPT v listopadu 2022. Slovo „delve“ (česky „zabřednout do tématu“, „pronikat hlouběji“) se objevilo 349× v roce 2020 — a v roce 2023 už 2 847×. Podle analýzy je dnes asi 1 ze 7 biomedicínských abstraktů psán s pomocí AI, a v informatice jde dokonce o 22,5 % všech publikací.

Ale proč zrovna „delve“? Proč ne třeba „explore“ nebo „examine“?

Stopa z Nairobi a Lagosu

Tady se příběh stává opravdu zajímavým. Modely jako ChatGPT se trénují ve dvou fázích. Nejprve „čtou“ miliardy textů z internetu (pre-training). Pak se jejich výstupy lidsky hodnotí — tomu se říká RLHF (Reinforcement Learning from Human Feedback). Lidé porovnávají odpovědi modelu a označují, která je „lepší“.

A právě tato fáze formuje styl modelu. Když OpenAI hledalo levnou pracovní sílu pro RLHF anotace, obrátilo se podle reportáže Time Magazine na společnost Sama s pobočkami v Keni a Ugandě. Tamní pracovníci hodnotili statisíce odpovědí a přirozeně preferovali ty, které zněly podle jejich jazykové normy.

A v nigerijské a keňské obchodní angličtině je slovo „delve“ mnohem běžnější než v britské nebo americké. Neurovědec Tony Zador to vystihl: „Skončili jsme s AI systémem, který píše tak trochu jako Afričan.“

Em-pomlčka: druhý otisk prstu

Druhý charakteristický znak AI textů je nadužívání pomlčky em-dash (—). Analýza ukázala, že GPT-4.1 používá em-pomlčky 3,28× častěji než lidský pisatel. Důvod je tentokrát jiný: v knihách a esejích, na kterých se modely trénují, jsou em-pomlčky velmi časté — daleko častější než v běžné konverzaci nebo na sociálních sítích.

Model si tedy zafixoval, že „elegantní text“ obsahuje hodně em-pomlček. A protože RLHF anotátoři často odměňovali přehledné a strukturované odpovědi, učinilo to z em-pomlčky téměř povinný prvek.

V listopadu 2025 Sam Altman oznámil, že OpenAI konečně přidalo možnost vypnout em-pomlčky pomocí Custom Instructions. Sám to nazval „malou, ale šťastnou výhrou“. Trvalo to skoro tři roky.

Nečekaná oběť: rodilí Nigerijci

Ironie celého příběhu je dramatická. Lidé, jejichž rodný jazyk obsahuje slova jako „delve“ zcela přirozeně, jsou dnes nespravedlivě obviňováni z používání AI. Detektory AI textů (Turnitin, GPTZero a podobné nástroje) je flagují, učitelé jejich práce odmítají, redaktoři jim odmítají články.

Nigerijská a keňská angličtina, která má vlastní bohatou tradici, byla — paradoxně skrze nedostatečně placené anotátory — z části zakódována do globálního AI systému. A teď je obrácena proti svým rodilým mluvčím.

Co to znamená pro vás?

Tři praktické důsledky pro firmy a tvůrce obsahu:

  1. Slepé AI detektory nefungují. Pokud vaše HR oddělení nebo škola používá detektory na základě „typických AI slov“, riskuje falešná obvinění — zejména u nerodilých mluvčích angličtiny.
  2. Originalita stylu je teď konkurenční výhoda. Pokud váš firemní blog zní jako každý druhý LinkedIn post psaný AI, čtenáři to vycítí. Vlastní hlas a konkrétní příklady jsou cennější než kdy dřív.
  3. Custom Instructions fungují. Naučte AI svůj firemní styl a explicitně jí zakažte „delve“, „crucial“, em-pomlčky a další klišé. ChatGPT na to (konečně) reaguje.

Pokud chcete promyšleně používat AI ve vaší firmě tak, aby vaše komunikace nezněla jako každá druhá — projdeme to s vámi krok za krokem. Nezávislé AI poradenství v Praxiu začíná úvodní konzultací zdarma a férovým doporučením, co nasadit a co ne. Pokud teprve mapujete, kde by AI ve firmě dávala smysl, podívejte se i na AI Kompas.

Často kladené otázky

Je „delve“ opravdu nejjistější známka AI textu?

Není. Je to indikátor, ne důkaz. Mnoho lidí — zejména rodilí mluvčí afrických variet angličtiny nebo akademici — používá „delve“ zcela přirozeně. Studie z roku 2024 ukazují, že detekce AI textu funguje s 70–80% přesností, což znamená 20–30 % falešných obvinění.

Píše ChatGPT jinak v češtině než v angličtině?

Ano. V češtině nemá ChatGPT tak silně vyježděné „signaturní“ slovo. Místo toho má tendenci k formálním obratům, nadužívá spojky „nicméně“, „dále“, „je důležité zmínit“ a má rád dlouhá souvětí. Také často používá oboustranné uvozovky („“) namísto klasických typografických.

Jak donutit ChatGPT psát jiným stylem?

V nastavení ChatGPT najdete Custom Instructions. Napište tam konkrétně: „Nepoužívej slova jako ‚delve‘, ‚crucial‘, ‚meticulous‘. Nepoužívej em-pomlčky (—). Piš krátké věty. Vyhni se formálním frázím.“ Od listopadu 2025 model tyto instrukce skutečně respektuje.

Zdroje:
Kobak et al., Delving into LLM-assisted writing through excess vocabulary (PubMed, 2024) · Simon Willison: How cheap, outsourced labour in Africa is shaping AI English · Tony Zador on RLHF and Nigerian English · Science.org: One-fifth of computer science papers may include AI content · PCWorld: OpenAI fixes ChatGPT em-dash obsession (2025)