ChatGPT dokáže napsat diplomovou práci, naprogramovat aplikaci i složit píseň. Ale když se ho zeptáte, kolik písmen „r“ je ve slově strawberry, často odpoví špatně. A nejde o starý model — testy z prosince 2025 ukázaly, že i nově vydaný GPT-5.2 stále tvrdí, že jsou tam dvě „r“. Ve skutečnosti jsou tři: s-t-r-a-w-b-e-rr-y. Úkol, který zvládne sedmileté dítě, dělá nejdražší technologii světa potíže. Proč?

Stručná odpověď: AI nevidí písmena

Velké jazykové modely jako ChatGPT nečtou text po písmenech tak jako vy. Než se text dostane do modelu, rozdělí se na takzvané tokeny — kousky o velikosti slabik, částí slov nebo celých krátkých slov. Model pak nepracuje s jednotlivými znaky, ale s těmito bloky. A právě tady vzniká problém.

Slovo strawberry rozdělí tokenizér OpenAI na tři části: „st“ + „raw“ + „berry“. Když má model spočítat „r“, dívá se na tokeny, ne na písmena. Token „st“ žádné „r“ neobsahuje, token „raw“ jedno a token „berry“ jsou sice dvě „r“, jenže model ho vnímá jako jeden nedělitelný celek. Výsledek? Napočítá dvě. Stejná věc se děje u slova raspberry — i tam ChatGPT hlásí dvě „r“, přestože tam je víc.

Představte si to jako čtení přes mřížku

Dobrá analogie: token je jako slovo nalepené na kartičce. Vy vidíte každé písmeno zvlášť, ale model vidí jen hotové kartičky a ví, „jak obvykle vypadají“ a „co po nich většinou následuje“. Když má spočítat písmena uvnitř kartičky, hádá podle naučených vzorů — nerozkládá ji zpět na znaky. Je to, jako byste měli číst text přes mřížku, která vám některá slova ukáže jen jako jednu rozmazanou skvrnu.

To zároveň vysvětluje, proč je AI skvělá v matematice a logických úlohách, ale selhává na triviálním počítání znaků v krátkém řetězci. Není to otázka „inteligence“ — je to otázka toho, jak má model postavené smysly. ChatGPT je v jádru predikční stroj: na základě miliard textů odhaduje, co nejspíš přijde dál. Přesné počítání jednotlivých písmen prostě není operace, kterou by uvnitř doopravdy prováděl.

Konkurence to umí. Proč zrovna ChatGPT ne?

Zajímavé je, že stejnou otázku jiné modely zvládnou. V prosincových testech 2025 odpověděly správně „tři“ tyto nástroje:

  • Claude (Anthropic) — 3
  • Gemini (Google) — 3
  • Grok (xAI) — 3
  • Perplexity — 3
  • Copilot (Microsoft) — 3
  • Qwen (Alibaba) — 3

Rozdíl není v tom, že by byly „chytřejší“. Používají jiné tokenizační systémy nebo si slovo před počítáním interně krok po kroku rozepíšou na jednotlivá písmena. A v tom je klíč: jakmile model donutíte slovo „vyhláskovat“, problém zmizí. ChatGPT například bez chyby napíše, kolikrát se která hláska objeví ve slově Mississippi, a dokáže pozpátku přečíst lollipop jako popillol. Schopnost tam je — jen se ji vyplatí správně vyvolat promptem.

Proč by to mělo zajímat firmu, ne jen geeky

Tahle „hloupá chyba“ je ve skutečnosti užitečné varování. Ukazuje, že AI se nedá slepě věřit u úloh, které vypadají jednoduše, ale stojí na přesné práci se znaky:

  • Kontrola formátu — počítání znaků v IČO, SPZ, kódech produktů nebo bankovních číslech
  • Validace dat — „má tento řetězec přesně 8 znaků?“ je přesně typ otázky, kde model může s jistotou odpovědět špatně
  • Práce s identifikátory — slučování, deduplikace nebo kontrola SKU podle počtu znaků

Poučení nezní „AI je nespolehlivá“, ale „používejte ji na to, v čem je dobrá, a na zbytek nasaďte správný nástroj“. Počítání znaků zvládne jednořádkový skript spolehlivěji než jakýkoli model za miliardy dolarů. Dobré nasazení AI ve firmě je hlavně o tom vědět, kde model nechat pracovat a kde mu raději dát „kalkulačku“. Reálné příklady takových rozhodnutí najdete v rubrice AI v praxi.

Přesně s tím pomáháme v Praxiu. Neslibujeme, že AI vyřeší všechno — naopak vám nezávisle řekneme i to, co možná nechcete slyšet: kde se nasazení vyplatí, a kde vás jen připraví o čas a peníze. Projdeme to s vámi krok za krokem a úvodní konzultace je zdarma.

Často kladené otázky

Kolik „r“ je vlastně ve slově strawberry?

Tři. Slovo se píše s-t-r-a-w-b-e-rr-y: jedno „r“ po „t“ a dvě po sobě v části „berry“. ChatGPT s modelem GPT-5.2 ovšem v testech z prosince 2025 stále odpovídal „dvě“.

Proč AI dělá chybu, kterou zvládne i dítě?

Protože nečte text po písmenech. Rozkládá ho na tokeny (kousky slov) a počítá na úrovni těchto bloků, ne jednotlivých znaků. Token „berry“ obsahuje dvě „r“, ale model ho bere jako jeden celek, takže je nezapočítá správně.

Znamená to, že se AI nedá věřit?

Ne — znamená to, že ji je třeba nasazovat cíleně. Na psaní, shrnování, analýzu nebo kód je AI mimořádně silná. Na úlohy vyžadující přesné počítání znaků raději použijte deterministický nástroj (skript, regulární výraz) nebo modelu nařiďte, ať si slovo nejdřív vyhláskuje.

Zdroje: Dataconomy — GPT-5.2 still counts two r’s in strawberry (12/2025), 16x Prompt — Why ChatGPT Can’t Count R’s in Strawberry, OpenAI Tokenizer.