scieee AI-readable full text Open interactive document viewer

Monokolokabilita ve dvou typologicky odlišných jazycích: srovnání češtiny a italštiny

Obstová, Zora

Abstract

225

Full text

ČASOPIS PRO MODERNÍ FILOLOGII 99, 2017, Č. 2, S. 225–244 Monokolokabilita ve dvou typologicky odlišných jazycích: srovnání češtiny aitalštiny* zora Obstová (Praha) MONOCOLLOCABILITY IN TWO TYPOLOGICALLY DIFFERENT LANGUAGES: ACOMPARISON OF CZECH AND ITALIAN The present study deals with the phenomenon of extremely restricted collocability (monocollocability) in Czech and Italian. On the basis of alist of words with the highest degree of monocollocability extracted from corpora with the aid of the so called Herfindahl-Hirschman Index (HHI), we try to analyse this little-explored phenomenon in both languages. Monocollocable words (MW, often referred to as cranberry words) and the fixed combinations in which they occur are investigated in terms of syntactic and collocation structures, frequency and diacronic development. In the light of corpus evidence, the phenomenon of extremely restricted collocability appears more complex than originally believed. The paper shows that MW in both languages form avery heterogeneous category and that many differences between Czech and Italian monocollocable structures can be explained by typological (e.g. the degree of nominal inflection) or historical factors. KEYWORDS monocollocable words, cranberry words, language typology, Czech, Italian, corpora KLÍČOVÁ SLOVA monokolokabilní slova, jazyková typologie, čeština, italštiny, korpusy 1. KOLOKABILITA AMONOKOLOKABILITA Kolokabilitu bychom mohli obecně definovat jako schopnost slova (či dalších jednotek) spojovat se vtextu sjednotkami jinými (srov.Čermák— Holub, 2005, s.12). To, skterými jednotkami se slovo pojí ajakým způsobem vtextu funguje, oněm zároveň mnohé vypovídá aumožňuje mezi jiným ivymezit jeho lexikální význam. Odůležitosti kontextu se zmiňuje už Saussure („téměř všechny jednotky jazyka závisejí buď na tom, co je vmluvním řetězu obklopuje, nebo na po sobě jdoucích částech, jimiž jsou samy skládány“), který „souhru“ po sobě jdoucích jednotek přirovnává k„fungování stroje, jehož součástky na sebe působí navzájem, třebaže jsou rozmístěny jen vjediné dimenzi“ (Saussure, 1996, s.156–157). Vztah kontextu, vněmž se určitá jednotka vyskytuje, alingvistickými vlastnostmi této jednotky je tudíž vzájemný. Kom- * Tato studie vznikla za podpory projektu Univerzity Karlovy Progres č.4, Jazyk vproměnách času, místa, kultury. Chtěla bych poděkovat oběma anonymním recenzentům za cenné podněty a připomínky k textu článku. OPEN ACCESS 226 ČASOPIS PRO MODERNÍ FILOLOGII 99, 2017, Č. 2 binovatelnost je základní vlastností apřirozenou funkcí všech lexémů: jak podotýká Čermák (2010, s.279), snad svýjimkou některých interjekcí nezůstávají mimo tuto kombinatoriku žádné systémové jednotky jazyka. Kolokabilita má vjazyce povahu kombinatorické škály. Některá slova mají kolokabilitu velmi vysokou, na první pohled téměř neomezenou (např.české adjektivum velký); na opačné straně této pomyslné kombinatorické stupnice potom stojí slova sextrémně restringovaným, uzavřeným kolokačním paradigmatem, která označujeme za monokolokabilní (např.české [na] úkor [někoho, něčeho]). Často se vtéto souvislosti hovoří okontrastu tzv.principu volného výběru (open-choice principle) aprincipu předurčeného výběru (idiom principle)1, je však zřejmé, že zcela volná, neomezená kombinovatelnost lexikálních jednotek ve skutečnosti neexistuje (ikolokabilita zmíněného adjektiva „velký“ je podmíněna sémantickou kompatibilitou aněkterá spojení— jako například *velký spánek nebo *velký vzduch— běžně použít nemůžeme). Vtéto stati se budeme zabývat slovy sanomálně omezeným kombinatorickým potenciálem, atedy slovy monokolokabilními. Taková slova pravděpodobně existují ve všech přirozených jazycích. Zdá se však, že tyto velmi zajímavé aspecifické útvary mají vrůzných jazycích jen málo společného, neboť— jak podotýká Čermák— „their combinatorial uniqueness is due to aspecific development of each word in these languages“.2 Náš výzkum se pokusí tuto hypotézu ověřit azaměří se na monokolokabilní slova ve dvou typologicky odlišných jazycích: včeštině aitalštině. Po stručném souhrnu dosavadních přístupů kproblematice představíme metody, jimiž lze tato slova identifikovat; zmíníme především výhody, ale iproblémy, které ssebou nese systematické vyhledávání těchto slov vjazykových korpusech. Vnásledujících kapitolách budeme na vzorku českých aitalských monokolokabilních slov, identifikovaných vkorpusu, analyzovat syntaktické asémantické vlastnosti těchto jednotek icelých spojení, vnichž se vyskytují, jejich kolokační struktury afrekvenci vobou jazycích. Krátce se budeme věnovat ijejich diachronnímu vývoji. Článek si klade dva hlavní cíle: 1. Představit monokolokabilní slova včeštině aitalštině znejrůznějších úhlů aupozornit na nové pohledy, které korpusový výzkum vnáší do tradičního pojímání monokolokability; 2. zjistit, zda lze voblasti monokolokability včeštině aitaštině vysledovat nějaké společné tendence anakolik se do této problematiky promítají typologické odlišnosti mezi oběma jazyky či specifika historického vývoje. 2. RŮZNÉ PŘÍSTUPY KPROBLEMATICE Termín monokolokabilní slova (MS), zavedený do české lingvistiky F. Čermákem (1982), víceméně odpovídá pojmům, které se pro slova svýrazně omezenou kolokabilitou užívají vjiných jazykových kontextech: vangličtině jsou označována jako cranberry words (např.Aronoff, 1976)3, bound words nebo unique words, vněmčině 1 Srov.Sinclair, 1991, s.109–115. 2 Čermák et al., 2016, s.7. 3 Aronoff chápe cranberry words analogicky ke cranberry morphs, tj.morfémům, které se podobně jako morfém cranvyskytují pouze vjediné kombinaci: „They are words which, like OPEN ACCESS zORA OBSTOvá 227 jako unikale Komponenten (Fleischer, 1989) či Unikalia (Dobrovoľskij— Piirainen, 1994), vitalštině jako componenti/vocaboli acollocazione unica (Veland, 2004, 2006). MS byla dosud zkoumána především vrámci frazeologie: jako na nevydělitelnou součást frazému na ně pohlížejí např.Filipec— Čermák (1985, s.173); Dobrovoľskij— Piirainen (1994, s.449) je považují za phraseologisch gebundene Formative. Vnejnovějších pracích se ovšem poukazuje na to, že MS se vyskytují nejen ve frazémech, ale také vběžných kolokacích (srov.např.Konecny, 2010, s.305) apředevším ve víceslovných pojmenováních terminologické povahy (srov.Čermák, 2014, s.13; Čermák,F.— Čermák, J.— Obstová— Vachková, 2016, s.7 a13). Čermák (2014, 2016 aj.) definuje MS jako slova, která vykazují kombinatoricky anomální chování, astojí tudíž na kombinatorické periferii lexikonu. Poukazuje na to, že „jejich jazykový, resp. textový život je striktně omezen na jedinou, popř. na několik málo kombinací sjinými slovy, abez nich toto slovo neexistuje“ (Čermák 2016, s.11). Ve většině případů se MS nekombinují pouze sjediným lexémem: taková slova jsou velmi vzácná. Obvykle mívají 1 až +/− 7 kolokátů (srov.např.Čermák 2016, s.12), které téměř vždy tvoří uzavřené kolokační paradigma. Čermák na rozdíl od jiných badatelů vyzdvihuje fakt, že častěji než lexémy lze považovat za monokolokabilní konkrétní slovní tvary. To pochopitelně souvisí se specifickou povahou MS, znichž mnohá jsou natolik defektní, že se— přinejmenším ze synchronního pohledu— vyskytují pouze vjediném tvaru ([nechat na] holičkách, [pozdě] bycha [honiti], [jít k] duhu apod.). Taková slova zcela postrádají sémantickou isyntaktickou autonomii, mnohdy unich nelze jednoznačně určit ani slovní druh, jejich lemma je pouze hypotetické (např.analogií předpokládané substantivum duh vsoučasném jazyce de facto neexistuje), aFilipec sČermákem je označují za verboidy (1985, s.174). Je zřejmé, že určitá defektnost je pro mnohá MS skutečně příznačná ačiní znich— spolu sabsencí vlastního významu anevydělitelností zpříslušné kombinace— velmi zvláštní anesporně zajímavé útvary, které lze jen velmi obtížně klasifikovat, anesnáze působí ijejich lexikografické zpracování. Čermák (2014, s.10–12) kritizuje běžnou lexikografickou praxi, kdy české slovníky (např.SSČ, SSJČ) místy poskytují zavádějící informace ovýznamu iužití MS, anavíc uměle (re)konstruují jejich lemmata (dutat, duh, bych apod.). Není bez zajímavosti, že připravovaný Akademický slovník současné češtiny (ASSČ) na tyto výtky do jisté míry reaguje apředpokládané reprezentativní tvary těchto slov nerekonstruuje, neuvádí jejich slovnědruhovou charakteristiku ani nevykládá jejich význam (srov.Kochová— Opavská, 2016, s.171, 174). Ukazuje se však, že situace je mnohem komplexnější, neboť celá řada MS si navzdory extrémně omezené kolokabilitě zachovává vlastní význam anevykazuje žádné anomálie ani zhlediska slovnědruhové kategorizace (srov.stroužek [česneku]; přimhouřit [oči]). Jindy narážíme na rozdíly vkolokabilitě tvarů téhož lemmatu (např.kolokačně výrazněji neomezený lexém soulad versus monokolokabilní tvar souladu, objevující se téměř výhradně vrámci víceslovné předložky vsouladu sněcranberry morphs, concatenate only with specific words and not with syntactic classes. For example, the noun headway occurs only as the direct object of the verb make, just as cran occurs only in cranberry“ (Aronoff, 1976, s.15). Omorfému cranse ovšem zmiňuje už Bloomfield (1933, s.160), který takové komponenty nazývá unique elements. OPEN ACCESS 228 ČASOPIS PRO MODERNÍ FILOLOGII 99, 2017, Č. 2 čím). Je ovšem nasnadě, že rozdíly vkolokabilitě lemmatu ajednotlivých slovních tvarů jsou patrné především vjazycích srozvinutou nominální flexí,4 jako je právě čeština. Ujazyků, které nominální flexi nemají vůbec nebo jen vredukované míře, se tyto rozdíly pochopitelně neprojevují nebo se omezují např.na odlišnou kolokabilitu singuláru aplurálu, popř. neexistenci či neužívanost singulárového či plurálového tvaru ([under/through/outside the] auspices [of sth]; [campo di] concentramento; [agli] antipodi, srov.níže kap.5). 3. IDENTIFIKACE MS Aby bylo možné monokolokabilní slova zkoumat či lexikograficky zpracovávat, je nutné je nejprve vjazyce identifikovat. Dosud se ktomuto účelu využívalo především textových analýz, dotazníkových šetření mezi rodilými mluvčími, introspekce anezřídka se lingvisté jako ke zdroji uchylovali právě ke slovníkům, kde se na omezenou kombinovatelnost slova obvykle poukazuje poznámkami „pouze ve spojení“, „nejčastěji ve spojení“ atp. Vzhledem ktomu, že se kolokabilita slov výrazně mění včase atéměř všechna MS prošla delším či kratším monokolokabilizačním procesem, vjehož průběhu lexém postupně ztrácel schopnost volně se kombinovat sdalšími slovy, je zřejmé, že se vjazyce neustále objevují „nová“ MS, která tradiční slovníky nedokážou zachytit. Jedinečnou možnost, jak taková MS vsoučasném jazyce identifikovat, nabízejí jazykové korpusy, vnichž lze slova sextrémně omezenou kolokabilitou vyhledávat systematicky. První prací, která se snaží osystematické zmapování MS vjazykových korpusech, ato hned ve čtyřech typologicky odlišných jazycích, je publikace Language Periphery, Monocollocable words in English, Italian, German and Czech (Čermák et al., 2016). Autoři se zde pokusili identifikovat MS ve čtyřech srovnatelných korpusech (BNC, CORIS, SYN 2010 aad hoc sestavený německý korpus textů zWikipedie) ovelikosti cca 100 milionů slov pomocí analýzy na základě Herfindahl-Hirschmanova indexu (HHI). Tento index, který se používá vekonomii kměření koncentrace (zejména při zkoumání monopolního postavení podniků na trhu), může sloužit ike kvantifikaci diverzity kontextu (podrobněji kindexu ajeho použití vlingvistice viz Cvrček, 2013, s.119), atedy kidentifikaci jednotek sanomálně omezenou kolokabilitou. Výsledky, které byly tímto způsobem získány, musely být podrobeny důkladné manuální selekci, aby se např.odstranila slova, unichž je omezená kolokabilita způsobena spíše faktory lexikálně gramatickými (zvratná slovesa, složené slovesné časy apod.).5 Autoři se také museli vyrovnávat sobtížně řešitelným (nejen na úrovni automatické analýzy) problémem homonymie apoly4 Většinu MS včeštině apatrně ivdalších jazycích lze přiřadit ke kategorii substantiv či adjektiv. Monokolokabilní verba se zdají být obecně velmi vzácná (viz níže, kap.6). 5 Monokolokabilitu lze ovšem pojímat išířeji: Cvrček (2013, s.119–128) ataké Šíková-Hrejsemnová, která zjeho názorů vychází ve své diplomové práci (2013, s.16), považují za monokolokabilní ireflexiva tantum či slova charakterizovaná konkrétní valencí, spjatou sužitím určité předložky (pomýšlet na). OPEN ACCESS zORA OBSTOvá 229 sémie.6 Navzdory všem těmto nesnázím iurčitým omezením, která ssebou analýza pomocí statistické míry nese (vzhledem ktomu, že HHI musí být aplikován na určité kvantum dat, aby byly výsledky průkazné, byla do výzkumu zahrnuta pouze slova sabsolutní frekvencí převyšující 200 výskytů vkorpusu, ana méně frekventovaná MS nebyl brán zřetel), vznikl čtyřjazyčný seznam nejfrekventovanějších současných MS, který je užitečným východiskem pro další bádání vtéto oblasti. 4. ANALÝZA VZORKU MS SNEJVYŠŠÍM HHI VČEŠTINĚ AITALŠTINĚ 4.1 IDENTIFIkACE PODLE LEMMAT ASLOvNÍCh TvARŮ Korpusovou analýzou dle HHI byla získána ičeská aitalská MS, jimž se věnujeme vtéto stati. Kolokabilita slov má, jak už bylo zmíněno, povahu škály, anejinak je tomu iujednotek, které lze (vsouladu svýše uvedenou Čermákovou definicí) označit za monokolokabilní. Hodnoty Herfindahl-Hirschmanova indexu, na jehož základě byla analýza korpusů provedena, by nám měly poskytnout informaci ovelikosti kolokačního paradigmatu výchozích slov. HHI může nabývat hodnot od 0 do 1: naprostá většina lemmat islovních tvarů včeštině iitalštině dosahuje hodnot velmi nízkých (průměrná hodnota HHI uvšech slovních tvarů vitalském korpusu je 0,16), hodnoty vyšší než 0,3 jsou výjimečné (z23 395 italských slovních tvarů, které byly podrobeny analýze, tuto hodnotu překračuje pouze 2650 slov avčeštině je situace obdobná). Při identifikaci monokolokabilních jednotek nás samozřejmě zajímají hodnoty nejvyšší, je však velmi obtížné určit hranici, od níž lze slova již považovat za monokolokabilní. MS světším počtem podobně frekventovaných kolokátů mohou mít ihodnoty relativně nižší (kolem 0,5), na následujících stránkách se však— především zpraktických důvodů7— zaměříme pouze na slova snejvyššími hodnotami HHI, tedy na ta, unichž se (nejvyšší) hodnota indexu pohybuje vrozmezí 1 až 0,7. Tuto podmínku vitalštině splňuje 95 MS, včeštině 108 MS.8 Čeština je zhlediska Skaličkovy strukturní typologie flektivnější než italština, především voblasti jmenné flexe; italština má navzdory bohaté morfologii slovesných časů azpůsobů (znichž mnohé jsou ovšem tvořeny opisy) ičetné rysy izolační, především využívání předložek kvyjadřování pádových vztahů, relativně pevný slovosled apod.9 Rozdíly vrozvinutosti jmenné flexe lze zohlednit už při korpusové 6 Kproblémům manuální selekce monokolokabilních kandidátů vjednotlivých jazycích srov.příslušné kapitoly in Čermák et al., 2016. 7 Spodní hranici jsme zvolili především zpraktických důvodů, abychom soubor zkoumaných slov omezili, ale také proto, že pod touto hranicí výrazně přibývá MS světším počtem kolokátů, případně slov sjedním dominantním kolokátem, jejichž zařazení mezi MS může být diskutabilní. 8 Všechna analyzovaná MS jsou uvedena v Příloze 1 na s. 241–243. 9 Zmiňujeme zde jen ty typologické odlišnosti, které se nám zdají být podstatné pro korpusové vyhledávání MS. Některé další rozdíly, na něž při studiu MS narážíme, budou zmíněny vdalších kapitolách (např.odlišná pozice adjektiva včeské aitalské nominální skupině, srov.kap.8.3) OPEN ACCESS 230 ČASOPIS PRO MODERNÍ FILOLOGII 99, 2017, Č. 2 analýze: HHI je totiž možno aplikovat jak na lemmata, tak na slovní tvary (druhého postupu bylo využito in Čermák et al., 2016). Je zřejmé, že oba postupy přinesou poněkud odlišné výsledky.10 Vpřípadě italštiny jsou rozdíly minimální, vyhledávání podle slovních tvarů nicméně umožňuje odhalit islova, která jeví monokolokabilní tendenci pouze vněkterém ztvarů, např.[occhi] sbarrati, popř. apokopované tvary jako [in] particolar [modo]). Může se ovšem stát, že— vzhledem ktomu, že zde pracujeme jen se slovy svyšší frekvencí— se do výběru nedostanou tvary některých méně četných sloves, která by jako lemmata stanovenou hranici překonala (totéž by teoreticky mohlo platit oněkterých, zejména dvojvýchodných adjektivech). Protože se však slovesa mezi MS (vobou jazycích) vyskytují minimálně, považujeme toto riziko za zanedbatelné. Učeštiny je tomu naopak: přehlednější výsledky zde přináší analýza podle lemmat. Při vyhledávání podle slovních tvarů totiž narazíme na týž problém, který vitalštině pozorujeme usloves, také usubstantiv aadjektiv: protože se zohledňují pouze jednotlivé alolexy, anikoli celé deklinační paradigma, mají kandidátské tvary (zejména utěch MS, kde lze za monokolokabilní považovat celý lexém) mnohem nižší frekvenci ačasto nepřekonají stanovenou hranici 200 výskytů. Při analýze podle slovních tvarů se tak do výběru například vůbec nedostanou adjektiva svelmi vysokým HHI jako bobkový nebo hákový, která vsoupisu lemmat zaujímají přední místa. Vzhledem ktomu, že právě substantiva aadjektiva tvoří mezi MS zdaleka nejpočetnější skupinu, jeví se tedy pro češtinu jako výhodnější analýza podle lemmat; tímto způsobem samozřejmě odhalíme ivětšinu frekventovaných defektních MS (verboidů), jen je vseznamu najdeme pod jejich (často uměle rekonstruovaným) reprezentativním tvarem (holička, vínek, vybraná). Chceme-li ovšem identifikovat ioněch několik MS, která jsou kolokačně omezena jen vněkterém ze svých tvarů, popř. ta, kde hraje výraznou roli homonymie nebo polysémie (např.[se] zatajeným [dechem] versus zatajený [plán, informace atd.]), je vhodné přihlédnout ikanalýze podle slovních tvarů.11 Při identifikaci MS snejvyšším HHI jsme tedy pro italštinu použili seznam sestavený na základě analýzy slovních tvarů, kdežto učeštiny jsme pracovali jak se seznamem lemmat (primárně), tak se seznamem jednotlivých word-forms.12 To je hlavní důvod, proč se mezi níže analyzovanými MS, zejména těmi českými, objevuje řada slov, která soupisy monokolokabilních slov in Čermák et al. (2016) neobsahují, aněkterá znich nenajdeme ani vČermákově Periferii jazyka.13 10 Aby byly výsledky ještě přesnější, bylo by výhodné zohledňovat rozdíl mezi lemmatem aslovním tvarem iujednotlivých kolokátů MS. 11 Výsledky získané pro češtinu analýzou slovních tvarů ssebou navíc přinášejí idalší praktické obtíže při manuální selekci, neboť kromě výše zmíněných případů (srov.kap.3 apozn. č.3) je nutno odfiltrovat ivšechny tvary, jejichž omezená kolokabilita je způsobena častým souvýskytem sněkterou zpředložek, které se včeštině obvykle pojí surčitým pádem ([v] předprodeji). 12 Za vytvoření korpusových výstupů pro účely této studie děkuji P. Vondřičkovi zÚČNK FFUK. 13 Dalším důvodem případných drobných odlišností mohou být irozdílné přístupy při manuální selekci dat, zvlášť vpřípadě MS svyšším počtem kolokátů aujiž zmíněné homonymie azejména polysémie. OPEN ACCESS zORA OBSTOvá 231 4.2 MONOkOLOkABILITA LEXÉMU/SLOvNÍhO TvARU Jak už bylo řečeno výše, vněkterých případech lze za monokolokabilní požadovat celý lexém, jindy však omezenou kolokabilitu pozorujeme jen uněkterého/některých zalolexů. Rozdíly mezi monokolokabilitou lexému aslovního tvaru jsou samozřejmě patrné jen uohebných slovních druhů, především usubstantiv averb;14 uadjektiv nemá takovéto rozlišování valného smyslu, protože se shodují vrodě, čísle ipádě se substantivem, snímž tvoří monokolokabilní kombinaci. Některá adjektiva se tudíž vobou jazycích vyskytují převážně či výhradně vjednom zrodů (polohrubá [mouka], odpadkový [koš], bobkový [list]; [filo] spinato, [capro] espiatorio, [anidride] carbonica), avčeštině ve výjimečných případech dokonce jen vjediném pádě ([v] neposlední [řadě]). Vitalštině jsou vzhledem kvýrazně chudší jmenné flexi rozdíly mezi monokolokabilními lexémy aslovními tvary, zejména vkategorii substantiv, méně patrné, neboť zde můžeme rozlišovat nanejvýš mezi singulárem aplurálem.15 Česká iitalská flektivní MS, tedy zejména substantiva averba, můžeme ztohoto pohledu rozdělit do tří skupin: a) Monokolokabilní je lexém, tj.celé konjugační nebo deklinační paradigma (vitalštině omezené na tvary singuláru aplurálu substantiv), např.přimhouřit [oči], zalapat [po dechu], [kruhový] objezd, [státní] zastupitelství, stroužek [česneku]; rendersi [conto di qc.], datore [di lavoro]. b) Monokolokabilní je pouze jeden tvar lexému (výjimečně tvarů několik), ostatní alolexy výraznější omezení kolokability nevykazují, např.[v] rámci [něčeho], [v] souladu [sněčím] apod. Včeštině jsou taková slova často komponenty víceslovných prepozic. Vitalštině bývá kolokačně omezen buď pouze singulár, nebo plurál substantiv: [andare su tutte le] furie, [fare la] spola. c) MS existuje jen vjediném tvaru (výjimečně ve dvou) avětšinou nemá lemma, resp. musí být uměle (re)konstruováno, např.[na] rozloučenou, [na] úkor [někoho, něčeho], [na] oplátku, [brát/vzít něco v] potaz, [od] nepaměti. Vitalštině lze do této kategorie zařadit defektní MS, která nemají singulár nebo plurál (častěji), popř. se vjednom zčísel vsoučasném jazyce (již) vůbec neužívají, např.[cantare/gridare a] squarciagola, [battere/correre all’] impazzata, [mettere qc. a] repentaglio. Hranice těchto kategorií ovšem nejsou ostré avmnoha případech, zejména vitalštině, je obtížné rozhodnout, zda MS již považovat za defektní (c), nebo zda je ještě 14 Přiřazení MS slovním druhům je pouze orientační ařídí se především formálními kritérii; kobtížnosti či dokonce nemožnosti určit synchronně slovní druh zejména utzv.verboidů viz níže, kap.6. 15 Nabízí se tedy otázka, zda má vitalštině takovéto rozlišování vůbec smysl. Zmiňujeme je nejen kvůli možnosti symetrického porovnání sčeštinou, ale iprotože se domníváme, že mezi jednotlivými skupinami lze vysledovat určité rozdíly, které souvisejí mj. ismírou lexikalizace příslušných monokolokabilních spojení. OPEN ACCESS 232 ČASOPIS PRO MODERNÍ FILOLOGII 99, 2017, Č. 2 přiřadit ke skupině (b): např.plurál substantiva vigore (vigori) se vkorpusu vyskytuje pouze dvakrát (zcelkem 8278 výskytů), plurál substantiva concentramento (concentramenti) šestkrát (z525 výskytů slova). Situaci mnohdy ještě komplikuje polysémie MS, anavíc se zdá, že zejména kategorie (b) a(c) mohou zdiachronní perspektivy představovat— přinejmenším uněkterých MS— dvě stadia vývoje, při němž dochází kpostupnému omezování kolokačního paradigmatu uněkterého tvaru slova (b) ajehož výsledkem může být situace, kdy se slovo dochová pouze vjediném tvaru, právě vrámci příslušného monokolokabilního spojení (c).16 Monokolokabilitu celého lexému (a) lze vobou jazycích pozorovat zejména usloves adále vpřípadech, kdy MS se svým kolokátem (kolokáty) tvoří víceslovné pojmenování terminologické povahy. Defektní MS (c), kterých je vnašem vzorku— vobou jazycích— relativně vysoký počet (přes 25%), se naopak objevují výhradně ve frazémech.17 4.3 ČESká AITALSká MS zhLEDISkA SLOvNÍCh DRUhŮ Ačkoli výše zmiňujeme, že uněkterých MS (verboidů) je přiřazení ke slovnímu druhu obtížné, ba dokonce nemožné (bycha, pré, bacha atd.), vnašem vzorku se takových slov vyskytuje jen velmi málo aurčení slovního druhu— přinejmenším formálně— možné je. Výjimku představuje např.české MS krážem či italské výrazy frattempo, squarciagola amalincuore, unichž většina slovníků slovní druh neuvádí aodkazuje pouze na spojení, vněmž se vyskytují (nel frattempo, asquarciagola, amalincuore); jiné slovníky, např.GRADIT, považují první dvě MS za substantiva atřetí za adverbium. Vnásledující tabulce uvádíme slovní druh pouze učeských aitalských slov. Přejímky vyčleňujeme zvlášť, neboť tato MS byla většinou přejata vrámci víceslovných jednotek aurčení slovních druhů ujednotlivých komponentů by bylo místy značně problematické (srov.české de facto). čeština italština substantiva 42,6 % 49,5 % adjektiva 41,7 % 16,8 % adverbia 11,1 % 5,3 % verba 3,7 % 4,2 % přejatá (avč. nesklonná) slova 0,9 % 24,2 % tabulka 1.Slovní druhy MS Vobou jazycích převažují substantiva, následovaná— zejména včeštině— překvapivě četnými adjektivy. Nejméně zastoupena jsou verba.18 16 Kdiacharonnímu vývoji MS viz níže, kap.10. 17 Kfrazémům atermínům srov.níže kap.8. 18 Toto zjištění odpovídá tomu, co Fleischer (1989, s.121n) předpokládá pro němčinu. Stejná tendence byla ostatně potvrzena také na větším vzorku pro italská aněmecká MS (srov.Obstová— Vachková, vtisku). OPEN ACCESS zORA OBSTOvá 233 Zajímavý rozdíl mezi češtinou aitalštinou je vpočtu přejatých MS: zatímco včeštině se do našeho vzorku dostalo pouze jediné takové slovo ([de] facto), vitalštině tvoří přejímky významnou skupinu. 4.4 MONOkOLOkABILNÍ kOMBINACE (Mk) Ustálená slovní spojení obsahující MS můžeme nazývat monokolokabilními kombinacemi (MK).19 Tyto kombinace lze vzásadě rozdělit do dvou skupin podle toho, zda mají charakter frazému, nebo víceslovného pojmenování terminologické povahy. 4.4.1 FRAzÉMY vERSUS TERMÍNY Čermák (2014, s.13; Čermák et al. 2016, s.7) konstatuje, že naprostá většina MS tvoří vkombinaci se svými kolokáty široce pojímaný frazém nebo— rovněž široce pojímaný— termín.20 Tuto tendenci potvrzují imonokolokabilní kombinace vnašem vzorku.21 Vobou jazycích lehce převažují frazémy, které včeštině tvoří více než 50 % avitalštině více než 60 % všech zkoumaných MK (např.chodit křížem krážem; prendere il sopravvento). Za víceslovné termíny lze včeštině považovat kolem 40 % avitalštině pak kolem 30 % všech kombinací (např.tržná rána; cordone ombelicale). Přesná procenta zde neuvádíme, neboť jsme si vědomi neostré hranice mezi široce pojímanými frazémy či termíny aběžnými kolokacemi azároveň iterminologické neustálenosti pojmu kolokace. Do skupiny frazémů tak řadíme např.igramatické (kvazi)frazémy, jako jsou frazémy prepoziční (vsouladu sněčím či in prossimità di qc.), do skupiny termínů potom spojení jako památkově chráněný, která by jiní badatelé mohli označit za běžné kolokace (srov.např.Konecny, 2010, s.310). Výše uvedená— byť jen přibližná— čísla jsou zcela vsouladu sČermákovým tvrzením, že výskyt MS se neomezuje na členství ve frazémech aže extrémně omezená kolokabilita je příznačná ipro komponenty mnoha víceslovných termínů. To platí ipro přejaté výrazy: včeštině lze jediné cizí spojení (de facto) ve vzorku přiřadit kfrazémům, vitalštině je přejatých frazémů sedm (vnaprosté většině jde olatinismy, např.apriori), termínů potom šestnáct (především anglicismy, např.mailing list).22 19 Srov.např.termín Cranberry Expressions (Trawiński et al., 2008). 20 Frazém zde vymezujeme ve shodě sČemákem jako jedinečnou austálenou kombinaci minimálně dvou prvků, znichž některý/žádný nefunguje stejným způsobem vjiných kombinacích, popř. se vyskytuje pouze vkombinaci jediné (či několika málo). Termín potom jako jednoznačný, ustálený, deskriptivní, systematický název užívaný pro denotáty vurčitém vědním oboru, ale iřemeslu či speciálním povolání (srov.např.Čermák, 2010, s.225 as.132). 21 Počty MS aMK si přesně neodpovídají, neboť jedno MS může být komponentem několika MK (např.in precedenza vs. avere/dare la precedenza). Výjimečně může být MS součástí frazému itermínu zároveň: takový případ se sice mezi zkoumanými slovy, kde převládají MS sjediným kolokátem, nevyskytl, mezi MS snižším HHI jich však několik najdeme (např.termín midollo osseo/spinale/allungato afrazém fino al midollo, srov.Obstová, 2016b, s.38). 22 Včeštině (resp. vkorpusu SYN 2010) se termíny přejaté zangličtiny vyskytují také, je jich však méně amají mnohem nižší frekvenci než vkorpusu italském, takže se do našeho vzorku nejfrekventovanějších MS nedostaly. OPEN ACCESS 240 ČASOPIS PRO MODERNÍ FILOLOGII 99, 2017, Č. 2 pusu CORIS se ovšem objevuje téměř výhradně ve významu „účinnost, platnost“, doloženém vprávních dokumentech od 15. století, ato ve spojení entrare/essere in vigore (vstoupit vplatnost, být vplatnosti). Další MS, která byla součástí nejstarší slovní zásoby, jsou arabského, langobardského či jiného původu (auge, spola, briga). Druhá významná skupina MS pochází z16. století apočátku století sedmnáctého (např.impazzata, ridosso, unisono, ombelicale, tracolla, stregua), některá MS byla zaznamenána na konci století osmnáctého (malapena, carbonica, lasso, vertebrale). Vnašem vzorku jsou hojně zastoupena islova nová, doložená vjazyce od druhé poloviny 20. století. Velkou část těchto výrazů tvoří přejímky zangličtiny (tilt, task, line, seller, mailing); přestože byla tato slova většinou přejata již vrámci příslušného víceslovného pojmenování (task force, mailing list), domníváme se, že je zhlediska přijímajícího jazyka lze posuzovat samostatně ana základě korpusových dat je rovněž považujeme za monokolokabilní. Výše uvedené příklady naznačují, že vprocesu monokolokabilizace hraje často významnou úlohu polysémie: slovo se dochová jen vjednom ze svých významů, vrámci určitého ustáleného spojení (termínu nebo frazému), zatímco ve významech ostatních postupně zastarává azběžného jazyka se vytrácí.32 5. ZÁVĚR Slova sextrémně omezenou kolokabilitou byla dosud zkoumána především vrámci frazeologie jako nevydělitelná součást frazémů. Vzhledem kurčité archaičnosti, která je pro některá MS typická, byla nezřídka vnímána jako slova vsoučasném lexikonu nepříliš frekventovaná, hovořilo se onich jako o„jazykových reliktech“, poukazovalo se na to, že se obvykle vyskytují pouze vurčitém tvaru ajejich lemma je nutno uměle rekonstruovat. Korpusový výzkum však ukázal, že problematika monokolokability je mnohem komplexnější aže MS tvoří (přinejmenším vjazycích, jako je čeština aitalština) poměrně heterogenní skupinu. Kromě frazémů bývají velmi často také komponenty víceslovných termínů iběžných kolokací, některá MS jsou vsoučasném jazyce značně frekventovaná, jiná se vyskytují vzácně, některá prošla dlouhým historickým vývojem postupné monokolokabilizace, jiná jsou doložena teprve vnedávné době amnohdy byla přejata, často vrámci celé monokolokabilní kombinace, zjiného jazyka. Některá MS se dochovala jen vurčitém tvaru, ujiných lze za monokolokabilní považovat všechny tvary lexému. Zporovnání českých aitalských MS snejvyšším HHI vyplynuly některé podobnosti, ale také celá řada rozdílů. MS vobou jazycích bývají srovnatelně často komponenty frazémů itermínů avykazují podobné vlastnosti zhlediska slovnědruhového (nejčastěji je lze přiřadit ke kategorii substantiv či adjektiv, velmi vzácná jsou 32 Tuto tendenci můžeme pozorovat nejen uslov, které prošla dlouhým historickým vývojem, ale iuněkterých výrazů novějších (srov.it. technický termín ammortizzatore [tlumič], vyskytující se vkorpusu spřekvapivou četností— vpřeneseném významu— ve spojení ammortizzatori sociali [doslova „sociální tlumiče“, tj.zejména podpora vnezaměstnanosti], srov.Obstová, 2016a, s.20). OPEN ACCESS zORA OBSTOvá 241 naopak monokolokabilní verba). Až na výjimky mají vmonokolokabilním spojení povahu modifikátoru akolokát, snímž tuto kombinaci tvoří, se téměř vždy nachází vbezprostředním sousedství MS (na rozdíl třeba od němčiny, kde může kolokát stát ina pozicích vzdálenějších). Obdobná je ifrekvence analyzovaných MS vsoučasné češtině aitalštině (resp. vpříslušných korpusech). Letmý dicharonní pohled odhalil, že značná část (přinejmenším 1/3) zkoumaných MS byla součástí nejstarší slovní zásoby obou jazyků akolokační paradigma těchto lexémů nebylo původně nijak zvlášť omezeno; teprve později došlo kjeho postupné redukci. Rozdíly, které jsme mezi českými aitalskými MS zaznamenali, jsou dány především typologicky. Výrazně se do problematiky monokolokability promítá zejména odlišná míra flektivnosti: zatímco včeštině, která má silně rozvinutou jmennou flexi, lze MS rozlišovat podle toho, zda monokolokabilní tendenci vykazuje celý lexém, pouze určitý slovní tvar, anebo zda MS dokonce existuje pouze vjediném tvaru ade facto nemá lemma, vitalštině, kde se jmenná flexe omezuje na odlišné tvary singuláru aplurálu, je takové rozlišování obtížnější (rozdíl mezi lemmatem aslovním tvarem je zde méně patrný, aje tudíž problematičtější označit určitá MS za verboidy). Typologicky jsou dány iněkteré rozdíly ve formálních strukturách (např.častější vyjadřování přívlastku adjektivem včeštině) astrukturách kolokačních (vzhledem kobvyklému postavení adjektiva před substantivem jsou včeštině víceméně rovnoměrně zastoupeny obě strany kontextu, zatímco vitalštině stojí kolokáty téměř vždy vlevo od MS). Další odlišnosti mezi oběma jazyky lze vysvětlit historicky, např.přítomnost řady verbálních substantiv či dějových jmen se sufixem -ná včeštině nebo vysoký počet přejatých MS vsoučasné italštině.33 Vtéto studii jsme zkoumali jen slova, která dosahují nejvyšších hodnot indexu anavíc jsou vkorpusu poměrně frekventovaná (nad 200 výskytů). Aby byl synchronní obraz MS vobou jazycích přesnější aúplnější, bylo by třeba zohlednit islova snižšími hodnotami HHI (jejich kolokační paradigma bývá širší, přesto je však lze stále považovat za monokolokabilní)34 apředevším slova snižší frekvencí apodrobit analýze také korpusy mluveného jazyka, kde předpokládáme významný výskyt frazémů smonokolokabilním komponentem. příloha 1.Abecední seznam českých monokolokabilních slov sHHI (L/P) 1–0,7 antimonopolní mezipohlavní pokrčit takž berná načase polohrubá točivý bobkový nadmořská potaz tržná čerpací naskrz pozměňovací třetice činění nedávnem požádání ublížení činžovní nedílná provždy uhličitý 33 Historickým procesem monokolokabilizace ovšem prošlo každé MS aukaždého byl tento proces (ijeho příčiny) pochopitelně jiný, srov.výše kap.1 akap.10. 34 Stanovit přesnou hodnotu HHI, od níž už lze slovo považovat za monokolokabilní, vzhledem ke škálovité povaze fenoménu nelze: to je ijedním zdůvodů, proč jsme analyzovali pouze slova snejvyššími hodnotami. OPEN ACCESS 242 ČASOPIS PRO MODERNÍ FILOLOGII 99, 2017, Č. 2 dálný nedohlednu předvečer úkor diplomová nepaměti přesilová ustání dispozici neposlední přestání uzdě dobírku nepoznání převážná valná dohledné nevíře přihlédnutím vínku domnění nynějška přimhouřit visací dostání objezd příspěvková vrub facto objízdná radno všudy fakultní oblibou rámci výkladní hákový obývací rozloučenou výkupní holičkách očitý rozmyšlenou vyměřovací hydrometeorologický odiv sdělovací vysvětlenou chtě odkvětu shledanou vyvolávací jakž odnětí sklonku zalapat klíční odpadkový skrytu zastupitelství koncentrační ohledem souladu zatajeným krážem onak spadnutí zavazadlový laskav oplátku stroužek zbrusu lícní ostnatý střehu zdaňovací lubem památkově širým zoologická mání pokraji štítná životně příloha 2.Abecední seznam italských monokolokabilních slov sHHI (L/P) 1–0,7 alter frantumi particolar spinato auge frattempo personam spola autonomasia furie pian squarciagola bilico galla pick stento braccetto immunitario precedenza stragrande briga impazzata prescindere stregua capolino incirca pressi subordine carbonica insù primis suon casaccio integrante priori talk cipollina intenderci prossimità tantino concetramento lasso quartier tantum condicio line quinte task court lizza rado tempore datore made rendersi tentoni decorrere mailing repentaglio tilt dismisura malapena rettorale tracolla disuso malincuore ridosso unisono dosso mountain ritroso vedenti OPEN ACCESS zORA OBSTOvá 243 editrice novero sbarrati vertebrale egida occhiello seller vigore erta ombelicale sitter vitro espiatorio operator sommato voga extravergine palio sopravvento week extremis part spasso LITERATURA: Aronoff, M. (1976): Word Formation in Generative Grammar. Massachussetts: The MIT Press. Cvrček, V. (2013): Kvantitativní analýza kontextu. Praha: NLN. Čermák, F.— Čermák, J.— Obstová, Z.— Vachková, M. (2016): Language Periphery. Monocollocable Words in English, German, Italian and Czech. Amsterdam: John Benjamins. Čermák, F.— Holub, J. (2005): Syntagmatika aparadigmatika českého slova. 1. Valence akolokabilita. Praha: Karolinum. Čermák, F. (2010): Lexikon asémantika. Praha: NLN. Čermák, F (2014): Periferia jazyka. Slovník monokolokabilních slov. Praha: NLN. Dobrovolʼskij, D. (1988): Phraseologie als Objekt der Universalienlinguistik. VEB Verlag Enzyklopädie Leipzig. Linguistische Studien. Dobrovolʼskij, D.— Piirainen, E. (1994): Sprachliche Unikalia im Deutschen. Zum Phänomen phraseologisch gebundener Formative. Folia Linguistica, 28, 3–4, s.449–473. Filipec, J.— Čermák, F. (1985): Česká lexikologie. Praha: Academia. Fleischer, W. (1989): Deutsche Phraseologismen mit unikaler Komponente. Struktur und Funktion. In: G. Gréciano (ed.), Europhras 88, Phraséologie Contrastive. Actes du Colloque International Kligenthal— Strasbourg, 12–16 mai 1988. Strasbourg: Université des Sciences Humaines, Département d’Etudes Allemandes, Collection Recherches Germaniques 1, s.117–126. Fleischer, W. (1997): Phraseologie der deutschen Gegenwart. Tübingen: Niemeyer. Kochová P.— Opavská Z. (eds.) (2016): Kapitoly zkoncepce Akademického slovníku současné češtiny. Praha: Ústav pro jazyk český AV ČR. Konecny, Ch. (2010): Kollokationen. Versuch einer semantisch-begrifflichen Annäherung und Klassifizierung anhand italienischer Beispiele. München: Meidenbauer [Forum Sprachwissenschaften 8]. Lamprecht, D.— Šlosar, D.— Bauer, J. (1986): Historická mluvnice češtiny. Praha: SNP. Obstová, Z. (2016a): Afrequency dictionary of Italian monocollocable words“ a„An alphabetical dictionary of Italian monocollocable words. In: F. Čermák et al., Language Periphery. Monocollocable Words in English, German, Italian and Czech. Amsterdam: John Benjamins, s.55–68 a89–97. Obstová, Z. (2016b): Fenomeno della collocabilità ristretta nell’italiano di oggi. Linguistica Pragensia, 26, 2, s.33–46. Obstová, Z.— Vachková, M. (vtisku): Aktuelle Korpusforschung zu monokollokablen Wörtern im Italienischen und Deutschen: Bericht und Ausblick. In: Ch. Konecny— E.Autelli— A. Andrea— L. Zanasi (eds.), Lexemkombinationen und typisierte Rede im mehrsprachigen Kontext. 2 vols. Tübingen: Stauffenburg [Stauffenburg Linguistik]. Saussure, F. de (1996): Kurz obecné lingvistiky. Přel. F. Čermák. Praha: Academia. Sinclair, J. (1991): Corpus, Concordance, Collocation. Oxford: Oxford University Press. Skalička,V. (2004, 2006): Souborné dílo, I.–III. díl. Ed. F. Čermák— J. Čermák— P.Čermák— C. Poeta. Praha: Karolinum. Trawiński, B.— Sailer, M.— Soehn, J.-P.— Lemnitzer, L.— Richter, F. (2008): OPEN ACCESS 244 ČASOPIS PRO MODERNÍ FILOLOGII 99, 2017, Č. 2 Cranberry Expressions in English and in German. In: Proceedings of the LREC 2008 Workshop: Towards aShared task for Multilingual Expressions (MWE 2008). Marrakech, Morocco, 2008, s.35–38. Veland, R. (2006): Il concetto di collocazione unica e il valore di predizione della dicitura “solo nella loc.” in uso nella pratica lessicografica. Zeitschrift für Romanische Philologie, 122, s.260–280. Voghera, M. (2004): Polirematiche. In Grossmann, M.— Rainer, F. (eds.), La formazione delle parole in italiano. Tübingen: Max Niemeyer Verlag. KORPUSY ASLOVNÍKY: Křen, M.— Bartoň, T.— Cvrček,V.— Hnátková, M.— Jelínek,T.— Kocek,J.— Novotná,R.— Petkevič,V.— Procházka,P.— Schmiedtová,V.— Skoumalová, H.: SYN2010: žánrově vyvážený korpus psané češtiny. Ústav Českého národního korpusu FF UK, Praha 2010. Dostupný z<http://www.korpus.cz>. CORIS/CODIS, Università di Bologna, dostupný z<http://corpora.dslo.unibo.it/coris_ita. html)>. Battaglia, S. (1961–2002): Grande dizionario della lingua italiana. 21 sv. Torino: UTET. Cortelazzo, M.— Zolli P. (1999): Dizionario etimologico della lingua italiana (DELI). Bologna: Zanichelli. De Mauro, T. (2000): GRADIT, Grande dizionario italiano dell’uso. Torino: UTET, 2000. Il Sabatini-Coletti (2005): Dizionario della Lingua Italiana— versione CD-ROM, Milano: Rizzoli Larousse. Kartotéka lexikálního archivu [on-line]. Oddělení současné lexikologie alexikografie Ústavu pro jazyk český AV ČR, v. v. i., 2007–2008 [citováno ze dne 1. 12. 2016]. Dostupný na <http://www.ujc.cas.cz/eletronicke-slovnikya-zdroje/kartoteka_lexikalniho_archivu. html>. Machek, V. (2010): Etymologický slovník jazyka českého. Praha: NLN. Nejedlý, P. et al.: Lexikální databáze humanistické abarokní češtiny [on-line]. Praha: Ústav pro jazyk český AV ČR, v. v. i., 2010 [citováno stav z1. 12. 2016]. Dostupné zWWW: <https:// madla.ujc.cas.cz>. Rejzek, J. (2015): Český etymologický slovník. Praha: Leda. Vokabulář webový [on-line]. Verze 1.1.1.. Oddělení vývoje jazyka Ústavu pro jazyk český AV ČR, v. v. i. [citováno ze dne 1. 12. 2016]. Dostupný na <http://vokabular.ujc.cas.cz>. Zora Obstová | Ústav románských studií, Filozofická fakulta Univerzity Karlovy | nám. Jana Palacha 2, 116 38 Praha 1 [email protected] OPEN ACCESS