Představte si, že váš telefon jednou přeloží cvakání delfína do češtiny. Ještě nedávno čistá science fiction — dnes na tom ale pracuje Google. V dubnu 2025 firma představila model DolphinGemma, který se učí strukturu delfíní „řeči“ úplně stejně, jako se velké jazykové modely naučily tu naši. A není v tom sama: tým z MIT mezitím u vorvaňů popsal cosi, co nápadně připomíná abecedu.
Zní to jako kuriozita, ale jde o jeden z nejfascinujících směrů dnešní umělé inteligence. Poprvé v historii máme nástroje, které dokážou v tisících hodin nahrávek zvířecích zvuků najít skrytou strukturu — vzory, kterých si člověk za sto let poslechu nevšiml.
Velryby mají něco jako abecedu
V květnu 2024 zveřejnil Project CETI společně s laboratoří MIT CSAIL studii v časopise Nature Communications, která vůbec poprvé navrhla „fonetickou abecedu“ vorvaňů. Vědci analyzovali přes 9 000 tzv. kód (angl. codas) — krátkých sekvencí cvakání, kterými spolu vorvani komunikují — nasbíraných u rodin v Karibiku.
Výsledek překvapil i samotné biology. Ukázalo se, že cvakání má kombinatorickou strukturu: jednotlivé prvky se dají skládat dohromady podobně jako písmena do slov. Repertoár známých typů kód přitom vyskočil z 21 na více než 156. Vědci ho popsali pomocí hudebních pojmů — rytmus, tempo, rubato a ornamentace — protože vorvani mění „melodii“ cvakání podle kontextu.
Neznamená to, že rozumíme tomu, co si velryby říkají. Znamená to ale, že jejich komunikace má mnohem bohatší stavbu, než jsme si mysleli — a že tu stavbu odhalila právě AI.
Google učí telefon „mluvit“ s delfíny
Ještě dál jde Google. Model DolphinGemma, vyvinutý s Georgia Tech a organizací Wild Dolphin Project, funguje jako „audio dovnitř, audio ven“. Z 40 let nahrávek atlantických delfínů skvrnitých (sbíraných od roku 1985) se naučil předpovídat, jaký zvuk v sekvenci nejspíš přijde jako další — přesně tak, jako jazykový model hádá další slovo ve větě.
Nejde přitom o žádný superpočítač. Model má zhruba 400 milionů parametrů a je dost malý na to, aby běžel přímo na telefonu Pixel, který výzkumníci berou s sebou pod vodu. Zvuky rozkládá na „tokeny“ pomocí technologie SoundStream — stejný princip, jakým AI zpracovává lidskou řeč. Google model v roce 2025 uvolnil jako open source, aby na něm mohli stavět i další.
Jak vlastně AI „rozumí“ zvířatům?
Tady je potřeba nadšení trochu zchladit. AI zatím nepřekládá — hledá vzory. Stejné metody zpracování přirozeného jazyka (NLP), které pohánějí ChatGPT nebo hlasové asistenty, se dnes nasazují na cizí „jazyk“, u kterého neznáme jediné slovo. Model najde, co se opakuje, co na sebe navazuje a co je naopak výjimečné.
Do hry vstupují i další hráči. Earth Species Project vyvíjí model NatureLM-audio, jakýsi univerzální „základový model“ pro zvuky zvířat napříč druhy. A soutěž Coller-Dolittle Challenge ocenila v roce 2025 tým, který v pískání divokých delfínů u Floridy odhalil komunikační systém s rysy jazyka. Obousměrná konverzace — kdy se zvířete opravdu na něco „zeptáme“ a dostaneme smysluplnou odpověď — je pořád před námi. Ale poprvé to nevypadá jako nemožné.
Proč by vás to mělo zajímat, i když nechováte velryby
Protože princip za tím vším je překvapivě univerzální: vezmete hromadu nesrozumitelných dat a necháte AI najít v nich strukturu. Přesně to, co pomáhá rozluštit delfíní pískání, dnes firmám pomáhá pochopit vlastní data — záznamy z výroby, tisíce zákaznických zpráv nebo logy ze senzorů, v nichž se skrývají vzory, které nikdo ručně nevyčte.
Pokud tušíte, že ve vašich firemních datech leží podobná „nerozluštěná řeč“, nemusíte na to jít sami. V Praxiu to s vámi projdeme krok za krokem a nezávisle poradíme, kde má AI ve vaší firmě reálný smysl — a kde je zbytečná. Úvodní konzultace je nezávazná; víc o našem přístupu najdete na stránce AI poradenství.
Časté otázky
Dokáže už AI přeložit, co říká zvíře?
Ne. Zatím dokáže v nahrávkách najít vzory a strukturu — třeba opakující se sekvence nebo „abecedu“ vorvaňů —, ale nepřiřazuje jim význam jako slovník. K plnohodnotné obousměrné konverzaci se zvířaty máme stále daleko.
Které projekty se o rozluštění řeči zvířat pokoušejí?
Mezi nejznámější patří Project CETI (vorvani), Google DolphinGemma (delfíni) a Earth Species Project s modelem NatureLM-audio, který cílí na zvuky mnoha druhů najednou.
Používá se stejná technologie jako u ChatGPT?
V jádru ano. Modely pro zvířecí zvuky stojí na stejném principu jako jazykové modely — rozloží zvuk na „tokeny“ a učí se předpovídat, co přijde dál. Rozdíl je, že u zvířat neznáme význam, takže AI zatím funguje spíš jako detektiv hledající vzory.
A otázka na závěr: kdybyste mohli položit svému psovi nebo kočce jednu jedinou otázku a dostat srozumitelnou odpověď — co byste se zeptali?
Zdroje: Google — DolphinGemma, MIT News — abeceda vorvaňů, Project CETI, National Geographic, CNN (2026).