Co jsou lexikální jednotky a proč na nich záleží
Lexikální jednotky představují základní stavební prvek slovní zásoby jazyka. Zahrnují izolovaná slova (lexémy), víceslovná pojmenování (frazémy, kolokace) a terminologické jednotky. Lexikologie je zkoumá z hlediska formy, významu, fungování v textu a vztahů v lexikální síti; lexikografie tyto poznatky převádí do slovníků a digitálních lexikálních zdrojů. Klíčové je rozlišovat mezi lexémem (abstraktní slovníkový tvar), lemmou (heslový tvar ve slovníku) a tvarem slova (konkrétní ohýbaná podoba v textu).
Typy lexikálních jednotek: od slova k víceslovným výrazům
- Jednoslovné lexémy: např. dům, běžet, zelený.
- Víceslovné lexikální jednotky (MWE): foukat do karet, železná opona, umělá inteligence. Mohou být idiomatické (nekompoziční význam) nebo kolokační (pevná spoluvýskytová vazba s částečnou předvídatelností, např. přijmout rozhodnutí).
- Termíny a odborné názvy: přesně definované jednotky v odborných doménách (morféma, hyponymie, korpus).
- Vlastní jména a onymy: Bratislava, Tatry, Dunaj, s odlišnou onomastickou dynamikou.
Formální a významová struktura lexém: denotace, konotace, valence
Lexém spojuje formu (zvukový či grafický obraz) a význam (koncept). Denotace odkazuje na třídu referentů (pes → všichni psi), konotace přináší expresivní a hodnotící zabarvení (chlapík vs. muž). Valence a rekce popisují vázání doplňků (např. spoléhat se na něco), což je důležité pro syntagmatické vztahy a lexikografické zachycení vazeb.
Paradigmatické vztahy: síť významových opozic a příbuzností
Paradigmatická rovina zachycuje kontrast a zaměnitelnost jednotek v mentálním lexikonu. Základní typy:
- Synonymie: blízké nebo stejné významy (dům ~ příbytek). Obvykle je částečná, omezena stylem, valencí nebo kolokačními omezeními.
- Antonymie: významové opozice. Binární (živý × mrtvý), stupňovatelná (studený × teplý), konverzní (kupovat × prodávat).
- Hyponymie/Hyperonymie: třídění od obecného ke specifickému (strom → smrk, dub, javor). Vytváří hierarchické taxonomie.
- Meronymie/Holonymie: vztah části a celku (kolo – auto, rukojeť – dveře).
- Polysemie a homonymie: polysemie = více souvisejících významů jedné lexémy (hlava člověka, hlava tabulky); homonymie = formální shoda při nesouvisejících významech (zámek „zámek“ × zámek „klíč“).
- Ko-hyponymie a paradigmata: pojmy na stejné úrovni kategorie (kočka, pes, zajíc jako ko-hyponyma k zvíře).
Syntagmatické vztahy: kolokace, frazémy a konstrukce
Syntagmatická osa mapuje lineární kombinace v textu, tj. co se s čím spojuje.
- Kolokace: preferenční spoluvýskyty (tvrdě pracovat, křišťálově čistý). Mají statistickou i sémantickou povahu a jsou klíčové pro přirozenost projevu.
- Idiomy/frazémy: nekompoziční jednotky s ustáleným významem (hodit flintu do žita). Často mají pevný slovosled a morfosyntaktická omezení.
- Konstrukce a vzorce: produktivní modely typu „čím X, tím Y“, hodnotící šablony (není právě…), nebo kauzální „X vede k Y“.
- Výběrová omezení (selectional restrictions): sémantická kompatibilita (pít vodu je přirozené, pít kámen porušuje selekci).
Lexikálně-sémantická pole, rámce a ontologie
Lexikální jednotky tvoří sémantická pole (např. pole pohybu) a rámce (situační šablony typu koupě: kupující, prodávající, zboží, cena). Ontologie a síťové lexikony modelují tyto vazby jako graf (uzly = lexémy/smyšlenky, hrany = relace). Takové struktury usnadňují inferenci významu, synonymní náhradu i vyhledávání.
Derivační a slovotvorné rodiny: formálně-sémantická motivace
Slovotvorba buduje rodiny lexém s předvídatelnými významovými posuny: učit → učitel, učebnice, vyučovat, doučování, učební. Derivační morfémy (-ář, -ství, -nost, -ka) nesou sémantické funkce (agent, abstraktum, vlastnost, zdrobnělina). Konverze mění slovní druh bez afixace (zelený → zelené [subst.]), kompozice spojuje základy (dálkovodič).
Sémantická změna a dynamika lexikonu
- Metafora a metonymie: přenášení významu na základě podobnosti (noha stolu) či příbuznosti (číst Kukučína = dílo).
- Rozšíření a zúžení významu: chléb kdysi „pokrm“ obecně vs. dnes „pekárenský výrobek“.
- Pejorace/ameliorace: hodnotový posun (politikarčit jako pejorativum).
- Neologismy a výpůjčky: streamovat, aplikace, cloud; adaptace formy i významu; kalky (životní prostředí < environment).
- Lexikalizace: ustálení původně volných spojení (černá skříňka).
Ambiguita, polysémie a disambiguace v textu
Ambiguita může být lexikální (více významů: myš „zvíře“ × „zařízení“) nebo syntaktická (vazba doplňků). Řeší se kontextem, kolokacemi, valenčními rámci a statistickými či neuronovými modely (WSD – word sense disambiguation).
Lexikografie: typy slovníků, makrostruktura a mikrostruktura
- Typy slovníků: výkladové, překladové (bilingvní/multilingvní), synonymické, frekvenční, frazeologické, etymologické, terminologické, onomaziologické (ideografické) a učební.
- Makrostruktura: uspořádání hesel (abecední vs. pojmová pole), křížové odkazy (→ viz).
- Mikrostruktura hesla: lema, výslovnost, slovní druh, ohybné paradigmy, valenční informace, definice, ilustrační příklady, kolokace, frazeologie, stylistické a diatopické značky (např. expr., hovor., nářeč.), etymologie, překlady/ekvivalenty.
- Typy definic: genus–differentia („dub je strom s tvrdým dřevem…“), operační (postupy), extenzionální (výčet podtříd), ostenzivní (ukázání příkladu).
Korpusová a digitální lexikografie
Moderní slovníky jsou korpusově podložené. Využívají frekvenční statistiky, konkordance (KWIC), extrakci kolokací a sémantické profilování. Digitální modely implementují standardy TEI Lex-0 a LMF pro interoperabilitu, umožňují propojení na ontologie a síťové zdroje (např. wordnetová propojení), vizualizují vztahy (grafy synonymie/hyponymie) a poskytují API pro NLP aplikace.
Bilingvní lexikografie a ekvivalence
Překladové slovníky řeší typy ekvivalence: plná (stabilní korespondence), částečná (odlišná valence nebo styl), nulová (reálie bez přímého protikladu). Vyžadují asymetrii (co platí z A->B, nemusí platit z B->A), falešné přátele (eventually ≠ eventuálně) a poznámky k použití.
Lexikální databáze a výpočetní lexikologie
- Wordnetové sítě: uzly = synsety (sémanticky ekvivalentní lexémy), hrany = relace (hyperonymie, meronymie…).
- Valenční a subkategorizační lexikony: struktury popisující argumenty sloves (dát [něco] [někomu]).
- FrameNet a sémantické role: anotované rámce a role (Agent, Téma, Cíl).
- Distribuční sémantika a vektorové reprezentace: podobnost významu prostřednictvím podobnosti kontextů (embeddingy). Umožňuje automatickou synonymii, detekci analogií a rozšiřování slovníků.
Register, diatopie a diafázie: variační dimenze lexikálních jednotek
Lexikální jednotky jsou stylisticky a regionálně podmíněné. Rozlišují se registry (hovorový, neutrální, knižní, odborný), diatopická variace (nářečí) a diastratická variace (sociolekty). Lexikografické značky upozorňují na použití: expr., vulg., histor., zastar.
Kolokační profily a výuka slovní zásoby
Ovládání kolokací (přijmout opatření vs. *udělat opatření) je rozhodující pro přirozenost projevu. Didaktické slovníky uvádějí kolokační vzorce, typické spoluvýskyty a kolokační chyby, čímž propojují lexikografii s pedagogikou.
Interakce lexikonu a gramatiky
Rozhraní lexikonu a gramatiky se projevuje tím, že mnohé „gramatické“ vlastnosti jsou lexikálně specifikovány (např. rekce předložek, nepravidelné paradigmata, idiomatické vazby). Konstrukční gramatika považuje část gramatiky za inventář párů forma–význam, tedy za rozšířený lexikón.
Terminografie a odborné sítě pojmů
Terminografie vytváří pojmové mapy domén (např. medicína, právo), definuje vztahy nadřazený–podřazený pojem, část–celek, proces–nástroj–výsledek a dbá na jednoznačnost a konzistenci. Výstupem jsou terminologické databáze a normy s přesnými definicemi a ekvivalenty.
Metodologie: od manuální analýzy po automatickou extrakci
- Manuální lexikografická analýza: čtení korpusů, výběr citací, formulace definic, určení smyslů a vztahů.
- Statistická extrakce kolokací: asociační míry (MI, t-test, log-likelihood) k identifikaci významných spoluvýskytů.
- Automatická detekce MWE: n-gramy s filtry frekvence, smluvní pravděpodobnosti, sekvenční modely.
- Sense inventory a WSD: návrh inventáře významů a algoritmická disambiguace v kontextu.
Praktické aplikace: překlad, vyhledávání, hlasové technologie
Vztahy mezi lexikálními jednotkami podporují strojový přek



























