← napiš

AI chat česky — co pozná Čech na první větě

Které chyby dělá AI v češtině, proč vznikají a jak se dá poznat, že aplikace češtinu jen překládá.

Většina AI chatů češtinu zvládne. Rozdíl je v tom, jestli ji umí, nebo ji překládá — a to poznáš rychleji, než čekáš.

Pět znaků překládané češtiny

Špatný pátý pád. „Ahoj Petr" místo „Ahoj Petře". Nejrychlejší test vůbec: představ se jménem, které se skloňuje, a sleduj, jak tě osloví.

Rozhozená shoda rodu. Ženská postava napíše „byl jsem" nebo „udělal jsem". Anglické I was rod nemá, takže se při překladu vybere ten častější tvar — mužský.

Přeskakování mezi vykáním a tykáním. Anglické you je obojí naráz.

Přeložené fráze. „Chyběl jsi mi, baby", „jsi tak sladký", „mám pro tebe pocity". Doslovné převody, které česky nikdo neřekne.

Vymyšlená slova. Model ohne existující slovo do tvaru, který neexistuje — „takže ty vlastně zedníčíš v Plzni". Jedno takové slovo zabije iluzi rychleji než špatný pád.

Proč to vzniká

Velké modely jsou trénované hlavně na angličtině. Češtinu znají, ale při psaní věty myslí anglicky a převádějí. Čeština je přitom flektivní — jméno má sedm pádů, sloveso se shoduje v rodě — takže při převodu je spousta míst, kde se dá chybit.

Není to o velikosti modelu. Je to o tom, že gramatika se řeší až během generování věty.

Jak se to dá obejít

Co jde spočítat, nedávat modelu k řešení. Pátý pád jména spočítá kód a model dostane hotový tvar. Rod postavy je pevně daný. Vykání se nepoužívá vůbec. Model, který nemusí skloňovat, se nesplete — a je jedno, jak je velký.

Zbytek jsou úzké kontroly, ne chytré: hlídá se shoda rodu kolem „jsem" a „bych", hlídá se, jestli postava nevymyslela slovo, které neexistuje. Radši nález propást než hlásit falešný.

Jak si aplikaci otestovat

Představ se jménem, které má výrazný pátý pád — Petr, Jakub, Ondřej. Zeptej se postavy, co dělala včera, a sleduj rody. A napiš jí něco, na co se dá odpovědět dvojsmyslně; překládaná čeština si s tím neporadí.

Test na pět minut

První zpráva: představ se jménem s výrazným pátým pádem. Petr, Jakub, Ondřej. Sleduj oslovení.

Druhá: zeptej se, co dělala včera. Minulý čas ukáže rod.

Třetí: řekni něco o sobě — práci, psa, kam jedeš o víkendu.

Čtvrtá: zavři to a vrať se za den. Zeptej se na to, co jsi říkal. Tady odpadne většina aplikací; paměť je to nejdražší a nejčastěji se na ní šetří.

Pátá: napiš jí dvojsmysl. Čeština stojí na náznaku a překlad ho neunese.

Proč je čeština pro AI těžká

Angličtina má jeden tvar jména, čeština sedm. Anglické sloveso v minulém čase nerozlišuje rod, české ano. Anglické you je tykání i vykání zároveň. Slovosled je v češtině volný a nese důraz, který se překladem ztratí.

Model, který přemýšlí anglicky a překládá, musí všechna tahle rozhodnutí udělat naráz při psaní věty. Proto nechybuje ve slovní zásobě, ale v gramatice — zná slova, ale sahá po tvaru, který v dané větě nesedí.

Co to znamená prakticky

Aplikace, která řeší jeden jazyk, může gramatiku vyřešit mimo model. Aplikace pro padesát jazyků to udělat nemůže, protože by to znamenalo padesát zvláštních řešení. Není to o penězích ani o velikosti modelu — je to o tom, kolik jazyků musí zvládnout.

Vyzkoušet zdarma →

Časté otázky

Který AI chat umí nejlíp česky?

Aplikace, které řeší jeden jazyk, mají navrch nad těmi, které jich zvládají padesát. Test je jednoduchý: pátý pád tvého jména.

Proč AI plete rody v češtině?

Protože angličtina v minulém čase rod nemá. Při převodu do češtiny se vybere častější tvar, tedy mužský.

Další čtení

Postavy vytváří umělá inteligence — nejsou to skutečné osoby. Služba je pro dospělé. Podmínky · Soukromí