Korpusová kritická analýza diskurzu: povaha, možnosti a limity (na příkladu analýzy jazykových ideologií v českém parlamentním diskurzu)
Abstract
7
Full text
Korpusová kritická analýza diskurzu: povaha, možnosti alimity (na příkladu analýzy jazykových ideologií včeském parlamentním diskurzu)1 Ondřej Dufek ABSTRACT: Corpus-assisted Critical Discourse Analysis: nature, possibilities and limits (Exemplified on the analysis of language ideologies in the Czech parliamentary discourse). The paper provides athorough review of the corpus-linguistic approach to critical discourse analysis. It briefly presents the core of critical discourse analysis (CDA) and examines the possibilities of applying corpus tools to it. In the next step, critical commentaries on CDA are summarized and at the same time, possible corpus-linguistic solutions are offered. The final part offers an illustrative application of corpus-assisted CDA focusing on language ideologies in the Czech parliamentary discourse. KLÍČOVÁ SLOVA / KEYWORDS český parlamentní diskurz, jazykové ideologie, jazykový zákon, korpusová kritická analýza diskurzu, kritická analýza diskurzu, korpusová lingvistika, kritika kritické analýzy diskurzu corpus linguistics, corpus-assisted critical discourse analysis, critical discourse analysis, criticism of critical discourse analysis, Czech parliamentary discourse, language bill, language ideologies 1. ÚVOD Studium užívání jazyka (adalších sémiotických kódů) vsociální realitě vkonfrontaci sideologiemi amocenskými vztahy má ve světové vědě tradici dlouhou již několik desetiletí— přinejmenším pod označením kritická analýza diskurzu (critical discourse analysis, CDA). Tento výzkumný proud obdržel za dobu své existence řadu kritických komentářů, které zčásti posílily jeho rozvoj. Ten je do značné míry (ovšem rozhodně ne výlučně) spjat svyužíváním korpusové lingvistiky (corpus linguistics, CL), která umožňuje solidnější datové založení avyužití dříve nedostupných způsobů poznávání textů. Tento článek chce představit korpusovou kritickou analýzu diskurzu, ukázat její výhody arelevanci, diskutovat její limity ailustrovat její využití na českém materiálu. Domnívám se, že takový přehled může být užitečný, neboť včeském prostředí zatím korpusová CDA byla zohledněna jen sporadicky. Ozapojení korpusových nástrojů do analýzy diskurzu se nedávno zmínily Jindřiška Svobodová, Šárka Hamrusová aBarbora Hinková (2018), ovšem na ploše pouhé jedné ačtvrt stránky avpodobě, která je do značné míry redukuje na pouhé dosažení větší spolehlivosti azpracování většího 1 Článek vychází zmé disertační práce (Dufek, 2018)— je přepracovanou verzí části její čtvrté kapitoly rozšířenou ovybrané pasáže zkapitoly šesté. Děkuji oběma recenzentům tohoto článku za kritické čtení vedoucí ke skutečně podnětným připomínkám. OPEN ACCESS
8 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 množství dat. To je— jak ukážu vtomto článku— jen jedna zvýhod korpusové CDA. Solidnější, byť též stručné seznámení nabízí Eva Lehečková (2016b). Jednotlivé případové studie podnikli Tess Slavíčková (2015), Irene Elmerot (2017) aMichal Hořejší (2019). Tím se, pokud vím, literatura vztažená kčeskému prostředí vpodstatě vyčerpává. Sluší se nicméně zmínit, že včeském prostředí / na českém materiálu vzniklo už několik studií, které se sice nehlásí ke kritickým východiskům, ale svou korpusově- -diskurzní povahou se dostávají do nemalé blízkosti toho, co chce představit tento článek. Jsou to např.Zasina (2018) analyzující kolokačně českou mediální reprezentaci političek nebo Fidlerová aCvrček (2018) rozebírající, včem spočívá alternativnost jazyka zpravodajského webu Sputnik Česká republika. Tyto studie sCACDA sdílejí část nástrojů iteoretických konceptů, opírají se zčásti iokritickoanalytickou literaturu, nedeklarují však svou ideologickou/politickou pozici ve vztahu krozebíraným jevům aneformulují takto pozičně ukotvené ahodnotící interpretace. Vtomto textu nejprve velmi stručně představím podstatu CDA apak rozeberu možnosti jejího obohacení okorpusové prvky. Následně shrnu nejdůležitější kritické výtky vůči CDA azhodnotím, nakolik je může pomoci vyřešit právě korpusový přístup. Poslední částí textu je ilustrativní analýza části parlamentního diskurzu onávrzích jazykových zákonů, která předestře praktické možnosti využití korpusových nástrojů vkritické analýze jazykových ideologií. 2. ZÁKLADY KRITICKÉ ANALÝZY DISKURZU Definovat CDA není snadný úkol. Pro účely toho článku se omezím na několik stručných poznámek věnovaných samé podstatě CDA, jejím cílům, vnitřnímu členění na samostatné směry apovaze její kritičnosti. 2.1 CO JE CDA CDA2 je obecně vzato přístup ke studiu jazyka aspolečnosti, sociopoliticky angažovaný vědecký směr; není to však teorie ani metoda (ke zdrojům, znichž CDA čerpá, podrobněji vnásledujícím oddílu). Označuje také síť lidí spodobnými hodnotovými východisky, cíli azpůsoby jejich dosahování, ale není to jednotná škola; termín CDA se vžil jako zastřešující označení do značné míry samostatných přístupů. Za dobu své existence (resp.existence onoho označení, lze říct iznačky) už CDA získala akademickou relevanci, má vlastní časopisy,3 konference.4 2 Nověji se začíná prosazovat ioznačení critical discourse studies (CDS), které bylo určitou dobu synonymní sCDA, ale nyní podle Johna Flowerdewa aJohna E.Richardsona (2018) odráží stále výraznější posun od aplikovaných analýz kfilozofickému, teoretickému, metodologickému ipraktickému obohacování tohoto směru (ostatně si všímají změny názvu 3.vydání knihy Ruth Wodakové aMichaela Meyera zMethods of Critical Discourse Analysis na Methods of Critical Discourse Studies (2015)). 3 Discourse & Society, Journal of Language and Politics, Critical Discourse Studies aj. 4 Např.Critical Approaches to Discourse Analysis Across Disciplines. OPEN ACCESS
ONDřEJ DUfEK 9 Stručně řečeno, CDA je analýza diskurzu využívající vědecké metody, ovšem nikoli se snahou onedosažitelnou objektivnost, nýbrž spřiznanými politickými cíli upozornit na nerovnost apřispět kjejímu odstranění. 2.2 CÍLE ATÉMATA CDA se snaží rozkrývat azviditelňovat mocenské vztahy ve společnosti ajejich jazykovou/diskurzní povahu; soustředí se na moc vdiskurzu amoc nad diskurzem. Ztoho důvodu coby materiál analýzy používá autentické promluvy, reálné texty. Vtomto smyslu se řadí do souboru směrů reagujících na redukcionistický Chomského generativismus. Vznikla primárně na lingvistickém základě, snaží se však zohledňovat ijiné sémiotické kódy, především však není popisem jazyka, nýbrž popisem jeho užívání. Využívá lingvistický deskriptivní aparát, zajímá ji především nadvětná, textová adiskurzní rovina; lexikon či gramatiku vždy vykládá ve vztahu krovinám vyšším ausouvztažňuje srelevantním kontextem (významy kontextu viz níže). Lingvistické analýzy zpravidla poukazují na ideologie ana nich postavenou nerovnost, nespravedlnost, uplatňování a/nebo zneužívání mocenského postavení ve společnosti pomocí rozkrývání jejich projevů vdiskurzu.5 Widdowson (1998, s.136) ji označuje za uvědomělou lingvistiku („linguistics with aconscience“). CDA není studium humanitní, nezkoumá člověka ajeho nástroje dorozumívání, nezjišťuje primárně, jak jazyk funguje vmozku či mysli6— je studiem sociálním, protože ji zajímá, jak jazyk funguje coby prostředek určitých sociálních aktů, jak jazykové prostředky manifestují interakci vrámci sociálních vztahů. Jinak řečeno, propojuje „lingvistický výzkum jazykových struktur aspolečenskou roli jazykové komunikace jako prostředku pro utváření, předávání auchovávání různých sociálních praktik (social practices)“ (Lehečková, 2016a, s.79). Rozpětí vztahu CDA kjazyku lze postihnout mj.dvojicí výrazů language in use alanguage in action— jde oto, co kdo (s) jazykem činí. 2.3 SMĚRY Když uvádím, že CDA není koherentní školou, patří se vysvětlit, zčeho různého se tedy skládá. Označení critical discourse analysis se (podle Breezeové (2011, s.495)) obje5 Někteří badatelé jsou spatřují stopy mocenských vztahů ipřímo vsystému jazyka, viz např.Caldas-Coulthardová aCoulthard (1996, s. xi), podle nichž CDA zjišťuje, „how power and discriminatory value are inscribed in and mediated through the linguistic system“. Většinově však dnes panuje konsensus na tom, že jádrem zájmu CDA je užívání jazyka. Mocenské potenciály přímo vjazyce bychom našli např.vstarší kritické lingvistice (např.Fowler et al., 1979; Fowler, 1996; či Kress & Hodge, 1979), ale také např.vlingvistice genderové (včeském prostředí viz např.Valdrová, 1997; Čmejrková, 1995; 2002). 6 Srov.však zaměření na kognitivní rozměr reprezentace diskurzu např.uTeuna van Dijka (např.2000, s.11n.), Paula Chiltona (2011, 2014) nebo Chrise Harta (2015, 2019) aj.; viz též odd. 2.3. OPEN ACCESS
10 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 vilo poprvé včlánku Normana Fairclougha (1985, s.739), ve známost vešlo hlavně svydáním jeho knihy Critical discourse analysis (1995). Zčásti fundující funkci mělo (jak uvádí Wodaková aMeyer (2009, s.3)) sympozium vAmsterdamu vr.1990; ve stejném roce vznikl ičasopis Discourse & Society. Hlavní směry jsou dialekticko-relační přístup Normana Fairclougha, socio-kognitivní přístup Teuna A. van Dijka adiskurzně- -historický přístup Ruth Wodakové, multimodální studia vrámci CDA rozvíjí Theo van Leeuwen. Někdy se uvádějí ještě francouzská škola (Michel Pêcheux), duisburská škola (Siegfried Jäger) aj. (viz Wodak, 2011). Vposlední době se rozvíjejí novější zajímavé varianty: kognitivní CDA (viz např.Hart, 2015, 2019; Cap, 2018), kombinace CDA ateorie metafor (Musolff, 2016; Li, 2016; Charteris-Black, 2004, 2014) aj. 2.4 VČEM SPOČÍVÁ KRITIČNOST? Přestože je kritičnost obsažena vsamém názvu CDA, její podstata není nikterak samozřejmá ani nesporná. Ruth Breezeová (2011, s.499–500) poukazuje na to, že může mít přinejmenším dva významy: Může jít oodkaz ke kritické teorii frankfurtské školy (ovšem vrámci toho ještě není zřejmé, zda se akcentuje kritický postoj ke statu quo, anebo k„authoritarian positivism of orthodox Marxism“ (ibid.)), stejně tak ale dává smysl kritický ve významu nepřijímající vše bez okolků, ověřující apromýšlející. Norman Fairclough (1992, s.9) při charakteristice CDA napsal, že „‚Critical‘ implies showing connections and causes which are hidden“. Příbuzná, byť ne tak vyhraněná, je pozice Ruth Wodakové aMichaela Meyera (2009, s.2), kteří vysvětlují, že „[a]ny social phenomenon lends itself to critical investigation, to be challenged and not taken for granted“. Podle jejich slov je frankfurtská kritická teorie důležitý inspirační zdroj. Kromě toho (ibid., s.7) sodkazem na Thea van Leeuwen (2005, s.293) vysvětlují, že „[n] aming oneself ‚critical‘ only implies superior ethical standards: an intention to make their position, research interests and values explicit and their criteria as transparent as possible, without feeling the need to apologize for the critical stance of their work“. Ostatně soudím, že tyto dvě strany kritického postoje nejsou vrozporu. 3. KORPUSOVÁ KRITICKÁ ANALÝZA DISKURZU Na základě kritiky CDA se množství badatelů začalo ohlížet po korpusové lingvistice (corpus lingustics; CL), jelikož se zdá(lo), že některé výtky může alespoň částečně řešit. Zodpovídání otázky, proč takové zdání budí (anakolik to je/není zdání iluzorní), bude předmětem následující kapitoly. Nejprve však učiním několik poznámek kvariaci označování korpusové CDA (oddíl 3.1) astručně vysvětlím podstatu kombinace CL aCDA (oddíl 3.2). 3.1 CORPUS-ASSISTED CRITICAL DISCOURSE ANALYSIS Stejně jako CDA ani corpus-assisted critical discourse analysis (CACDA) není homogenní skupina či škola. Ostatně na rozdíl od CDA nemá ani označení, na němž by se OPEN ACCESS
ONDřEJ DUfEK 11 všichni shodli. Vliteratuře se, často bez jakýchkoli vysledovatelných pravidelností, objevují kombinace naznačené ve schématu 1— aani to nevyčerpává všechny možnosti, např.corpus approaches to discourse studies nebo discourse-oriented corpus studies.7 Ostatně název tohoto oddílu je prostě jen dosud neobsazená kombinace, která se zdá být dostatečně výstižná. Výraz assisted je navíc výhodný tím, že nevstupuje do dichotomie corpus-based vs. corpus-driven (viz níže). corpus assisted (critical) discourse analysis computer based studies driven approach informed aided Schéma 1:Kombinatorika složek označení přístupů kombinujících CL aCDA Jediná škola, která sama sebe označuje ustáleným názvem, je corpus-assisted discourse studies (CADS), spojovaná především spracemi Alana Partingtona ajeho spolupracovníků (např.Partington, Duguid & Taylor, 2013). Proti tomu lze postavit podobný, leč vněkterých základních aspektech (přinejmenším deklarativně) odlišný přístup, který můžeme označit jako corpus-based critical discourse analysis (CBCDA) reprezentovaný lancasterskou školou, zejména Paulem Bakerem, Costasem Gabrielatosem aj. (např.Baker, Gabrielatos & McEnery, 2013). Alternaci studies/analysis zde můžeme považovat za málo významotvornou (srov.však poznámku 2); vdruhém přístupu je klíčový výraz critical; nejproblematičtější je pak rozlišení corpus-assisted vs. -based. První podobu si pro sebe rezervovala CADS, naopak lancasterská škola se proti pouhé asistenci korpusové lingvistiky vymezuje aprosazuje rovnoprávnost CL aCDA (Baker et al., 2008, s.274).8 Kromě výše nastíněných pojmenovacích odlišností zmíním ještě variantu corpus- -informed, kterou nalezneme uKierana O’Hallorana (2007) nebo computer-assisted vyskytující se zejména ve starších pracích Michaela Stubbse (1994, 1996). Už vdevadesátých letech vznikla řada průkopnických studií, viz např.Louw (1993), Caldas-Coulthard (1993; 1995), Hardt-Mautner (1995), Krishnamurthy (1996), Stubbs (1996), Flowerdew (1997). Před necelými patnácti lety se počet článků kombinujících CL aanalýzu diskurzu začal významně zvětšovat aod té doby téměř neustále roste— viz graf 1. 7 Dvě varianty názvu oborové bibliografie sestavované Costasem Gabrielatosem, donedávna dostupné na <http://www.gabrielatos.com/CLDA-Biblio.htm>. 8 Distinkce assisted vs. based ovšem není tak jednoznačná, jak bývá deklarováno. Paul Baker má vsamotném názvu některých svých studií (viz např.Baker, 2014, 2015) označení corpus-assisted, naproti tomu Alan Partington (2006) hned vabstraktu svého článku říká, že rozpracoval „corpus-based methodology“. OPEN ACCESS
12 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 Graf 1:Vývoj počtu studií kombinujících korpusovou lingvistiku a(kritickou) analýzu diskurzu vdatabázi Scopus; dotaz: TITLE-ABS-KEY(corpus OR corpora OR „corpus linguistics“) AND TITLE- -ABS-KEY(CDA OR „critical discourse analysis“ OR „discourse analysis“ OR „discourse studies“); výběr omezen na články, konferenční příspěvky akapitoly vmonografiích; manuálně nečištěno. 3.2 PODSTATA KORPUSOVÉ KRITICKÉ ANALÝZY DISKURZU Vtomto oddíle představím samotnou povahu korpusové kritické analýzy diskurzu, především to, jaké korpusové nástroje ajakými způsoby pro kritické rozbory využívá. Jak trefně poznamenává Debbie Orpinová (2005, s.38), „[t]he major problem in combining aCDA approach with corpus methodology is deciding where to start“. Jedním zvýznamných smyslů využívání CL je možnost zvládnout analyticky zpracovat větší množství dat, tj.takový jejich objem, který by člověk jednoduše nedokázal vrozumném čase / při rozumné námaze přečíst, natož pak intelektuálně uchopit ahledat výrazné prvky, pravidelnosti apod. To však rozhodně není jediná motivace— korpusový pohled na diskurz nabízí zároveň příležitost dostat se kběžným čtením nepostihnutelným pravidelnostem napříč texty. Korpusový přístup (nejen vCDA), ostatně jako empirický výzkum jazyka obecně, nutně staví na práci sjednotkami vedoucí kjistému abstrahování od jejich zasazení vjazykovém, situačním asociálním kontextu. Tato ztráta informací je však vyvážena ziskem na jiné straně. Michal Hořejší (2016, s.5) ktomu poznamenává, že „[k]aždá korpusová analýza je zprincipu postavená na mechanismu nabývání informací zvertikály protínající velký počet jednotlivých textů (či korpusů) za cenu ztráty přirozené horizontály realizované linearitou textu adialogickým rámcem diskurzu (intertextualitou)“. Corpus-assisted critical discourse analysis (CACDA) minimalizuje míru ztráty horizontály obvykle několika způsoby: opakovaným pohybem od počítačově generovaných průřezů korpusem kjednotlivým konkordancím až kširšímu kotextu originálních textů (azpět) azapojováním znalostí osituačním asociálním kontextu na různých stupních analýzy. Přidaná hodnota korpusového přístupu je přitom nemalá. Jejím smyslem je „snaha se od této reality [jazykové situace; OD] odpoutat ado0 1982 1986 1990 1994 1998 2002 2006 2010 2014 zákon_noun český_adjective ochrana být_verb používání_noun právní_adjective mít_verb L L L R R R R jazyk_noun 20 40 60 80 100 120 OPEN ACCESS
ONDřEJ DUfEK 13 stat se za jazykovou praxi její fragmentací amechanizací (sr. Stubbs 1996, Partington 2008). CL [korpusová lingvistika; OD] vCDA jinými slovy slouží kautomatickému odhalování pravidelných (lexikálně-gramatických) schémat vrámci daného diskurzu za současného rozbití přirozené textové linearity (kotextu)“ (Hořejší, 2016, s.3). Vtakto nastaveném prostředí, kde máme velké množství textů zpracovaných do korpusově prohledávatelné podoby, se nabízejí dvě cesty. První předpokládá, že analytik již alespoň do určité míry zná diskurz a/nebo že má již určité hypotézy, předpoklady, jež chce otestovat. Vtakovém případě může zadat dotaz na určité slovo či obecněji jazykový prostředek, který ho zajímá, anapř.zkoumat, jak se chová vkonkordancích. Jsouli kdispozici taková data aje-li korpus vhodně strukturován, lze věnovat pozornost diachronii asledovat vývoj funkce či pozice onoho jazykového prostředku vdiskurzu. Na takovýto přístup se dobře hodí označení corpus-based— korpus asním spojené standardní nástroje pomáhají hledat anacházet to, co analytik hledá. Druhá možnost se hodí pro situace, kdy analytik buď nemá dobrou představu opovaze diskurzu, anebo se chce záměrně co nejvíce oprostit od svých intuicí; to bychom mohli označit jako corpus-driven přístup. Pak může být dobré začít něčím takovým, jako je frekvenčně seřazený seznam slov (který concordancery běžně umějí generovat). Aniž bych zabíhal do problematických detailů, můžu si snad dovolit tvrdit, že frekvence nějak souvisí stypičností, významem— míněno významností— vrámci diskurzu. Přirozeně takový frekvenční seznam bude na horních příčkách obsahovat jen těžko překvapivá, „zajímavá“ slova— snejvětší pravděpodobností tam nalezneme synsémantika, pak nejspíš pomocná slovesa, osobní zájmena apod., tedy slova, která se velmi často vyskytují přirozeně vkaždém textu bez ohledu na příslušnost kurčitému diskurzu. Pro ilustraci uveďme dvacet nejfrekventovanějších lemmat zprvní kapitoly knihy Paula Bakera (2006, s.1–24) Using corpora in discourse analysis (viz tabulka 1).9 Vtabulce vidíme, že prvních osm pozic zabírají synsémantika10 asloveso to be, užité pravděpodobně zvelké části jako pomocné. Poté však narazíme na lemmata, která už mohou ozkoumaném diskurzu (resp.vnašem případě malé části textu) něco vypovídat. Je patrně vpořádku, že mezi nejčastějšími autosémantiky najdeme lemmata discourse, corpus alanguage. Čtenář by mohl zapochybovat nad užitečností takového seznamu, mohl by ho považovat za nepřekvapivý anezajímavý. Avšak itato ukázková tabulka nabízí podnětů mnohem víc, než se na první pohled zdá: Vztahuje se sloveso/substantivum use spíš kuplatňování nějakých postupů/nástrojů, anebo kužívání jazyka (language use)? Je tedy kapitola zaměřena spíše na techničtější, instrumentálnější výklad, anebo na konceptuální podloží analýzy diskurzu? Dále, proč je zosobních zájmen nejčastější we anikoli Inebo you? Jaký plurál Baker používá— začleňuje do něj čtenáře, nebo 9 Seznam byl vytvořen vsoftwaru AntConc svyužitím anglické lemmatizace nabízené na webu softwaru. 10 Vědomě nechávám stranou otázku, jak přesně je ošetřena lemmatizace výrazu that, tedy jaká část dokladů je ve funkci spojky ajaká ve funkci zájmena— pro můj výklad to není relevantní. OPEN ACCESS
14 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 ne? Apokud ano, jde okontaktovou strategii, nebo má jinou funkci? Ado třetice, proč mezi frekvenční špičkou chybí poslední slovo ztitulu celé knihy, unějž by bylo možno předpokládat taktéž jistou prominenci, tedy analysis? Toto lemma je ve skutečnosti 25.aje pouze důsledkem formálně založeného výběru, že se nedostalo před oči čtenáře (stejně tak dobře mohla mít tabulka 15 nebo třeba 30 řádků adůvod/vysvětlení by těžko mohl/obýt lepší či horší). Poslední otázka však poukazuje na klíčový problém využívání CL vCDA: Co vkorpusu není, to vkorpusu nenajdeme. Moderní korpusové softwary jako #Lancsbox (Březina, Timperley & McEnery, 2018) však při použití některých metrik velikosti účinku nabízejí kromě seznamů (pozitivních) klíčových slov také negativní klíčová slova, tj.výrazy, které se výrazně málo vyskytují ve zkoumaném korpusu vporovnání skorpusem referenčním. Taková negativní klíčová slova mohou analytika upozornit na jevy, jejichž přítomnost by očekával, které však vkorpusu chybějí. Nepřítomnost (nebo méně kategoricky vzato nízká frekvence) může být srovnatelně důležitá avýznamná jako vysoká četnost. Zde je vhodné upozornit na neustálou nutnost kontroly azvažování kroků, které analytik nechá na počítači akteré by měl podniknout sám dále. Takový frekvenční seznam, jaký představuje tabulka 1, je jistě podnětný, jenže— jak jsme viděli— itak plný balastu pravděpodobně bez větší relevance pro rozkrývání na první pohled neviditelné povahy diskurzu. Vtomto směru může lépe sloužit navazující seznam klíčových slov. Klíčová slova jsou totiž postavena na optice frekvenční významnosti určitých slov pro zkoumaný korpus vporovnání skorpusem referenčním, atudíž opomíjejí to, co je oběma srovnávaným souborům společné. Zde takový seznam nenabídnu, neboť není zcela triviální říct, sčím by se měla četnost porovnávat, oproti čemu by mělo být klíčové slovo četnější. Jedna možnost by samozřejmě byla porovnat předmět našeho zájmu sobecným korpusem, dejme tomu Bank of English nebo British National Corpus. Možná by však bylo zajímavější zkusit porovnat knihu Paula Bakera sněčím srovnatelnějším, např.spublikací Patterns and Meanings in Discourse Alana Partingtona et al. (2013). Klíčová slova budou představena avyužita vnásledující kapitole. pořadí frekvence lemma pořadí frekvence lemma 1 399 of 11 119 or 2 395 be 12 110 as 3 346 the 13 90 have 4 303 a 14 86 we 5 297 to 15 82 for 6 237 and 16 76 language 7 232 in 17 73 which 8 166 that 18 72 it 9 132 discourse 19 71 use 10 130 corpus 20 67 this Tabulka 1:Začátek word listu první kapitoly knihy Baker (2006). OPEN ACCESS
ONDřEJ DUfEK 15 Dalším krokem může být kolokační analýza. Může mít například smysl ptát se, sjakými adjektivy-přívlastky se určité klíčové slovo pojí, jak se (např.na škále pozitivně–negativně) konstruuje vdiskurzu. Uslov reprezentujících aktéry lze sledovat statisticky podložené pravidelnosti vuvádění charakteristik, činností apod. Evaluativní potenciál kolokací pokrývá koncept sémantické/diskurzní prozodie— viz Monika Bednareková (2008) aPaul Baker, Andrew Hardie aTony McEnery (2006, s.58). Obvyklou součástí CACDA bývá analýza konkordancí. Ta umožňuje sledovat pravidelnosti bezprostředního jazykového kontextu vyhledaného výrazu azvýrazňuje tak vlastnosti korpusu/diskurzu vjiž vyváženějším poměru horizontálního avertikálního pohledu. Většina dosavadního výkladu se orientovala především na lexikální stránku diskurzu. Užitečnou součástí korpusových analýz diskurzu však bývají irozbory gramatických pravidelností (viz např.Partington, 2002, s.7–9; Baker, 2006, s.151–174). Lze si představit např.studii zahrnování či vylučování určitých aktérů pomocí sledování zájmen a/nebo užití kategorie čísla. Vúvahu přichází výzkum výskytu konkrétního výrazu vrůzných syntaktických funkcích (např.podmět/agens vs. předmět/patiens), Podmínkou uskutečnitelnosti takových sond je však do značné míry gramaticky (typicky morfologicky, případně isyntakticky) anotovaný korpus. Zásadním principem CACDA, má-li si zachovat ohled na kontext, je (podle potřeby opakovaně aplikovaná) kombinace kvantitativního aspektu skvalitativním. Konkrétní sled kroků zapojujících frekvenčně založené korpusové nástroje adetailní čtení širších jazykových kontextů spolu se zohledněním kontextu situačního, sociál ního, kulturního apod. je třeba samozřejmě ušít na míru příslušnému předmětu zkoumání aanalyzovanému materiálu. Bez kvantitativní složky bychom však studii vrámci CDA těžko mohli označit za korpusovou, bez kritického kvalitativního zaměření na kontextualizovaný detail bychom podnikali korpusovou studii bez kritické analýzy diskurzu. 4. KRITIKA CDA AJEJÍ KORPUSOVÁ ŘEŠENÍ Poté, co se kritická analýza diskurzu ustálila azačala být vnímána jako (alespoň do určité míry) smysluplný areálně praktikovaný způsob vědeckého bádání jak samotnými jejími představiteli (tzn.že se sami identifikovali jako příslušníci směru, jejž lze označit zkratkou CDA), tak akademiky stojícími mimo tento proud, začaly se pochopitelně objevovat na její adresu kritické poznámky. Některé byly vzneseny, protože se původní jednotlivosti vrostoucím objemu vznikající literatury ukazovaly být pravidelnostmi, jiné zase proto, že se představitelé kritizovaných praktik postupně stali vůdčími osobnostmi apříslušníky kánonu, ajejich práce tedy částečně reprezentovala celou CDA. Vnásledujících odstavcích shrnu hlavní výtky— kritériem jejich výběru je kombinace frekvence azávažnosti. Dělím je na dvě základní skupiny: (1) na ty, které se týkají samotné podstaty CDA, jejího založení, tedy výtky jdoucí kjádru přístupu jako takového; (2) na ty, které upozorňují na neblahou praxi, nedostatečné dodržování postupů považovaných za nezbytné pro vědecké počínání, jež je však spatřováno nikoliv OPEN ACCESS
22 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 5. ANALÝZA JAZYKOVÝCH IDEOLOGIÍ VČESKÉM PARLAMENTNÍM DISKURZU 5.1 DATA Použití představeného přístupu teď předvedu na ilustrativní ukázce, která představuje jen úzký výřez plné analýzy, ale zachycuje všechny její fáze. Ukázka vychází zrozboru jazykových ideologií včeském parlamentním diskurzu (podrobněji Dufek, 2018). Východisko tvoří návrhy jazykových zákonů vPoslanecké sněmovně Parlamentu ČR od vzniku samostatné České republiky do současnosti (srov.Velčovský, 2015; Sojka, 2018).16 Zde analyzovaný materiál se skládá se dvou korpusů— jednoho zkoumaného ajednoho referenčního. Jádrem je korpus nazvaný JazParl obsahující sněmovní rozpravy onávrzích jazykových zákonů17 apříslušné dokumenty (texty zákonů, důvodové zprávy, stanoviska vlády apod.) od vzniku České republiky do roku 2015 (viz tabulka 2). Texty zařazené do korpusu jsou zkopírovány zdigitálního repozitáře stenoprotokolů rozprav volně přístupného ve Společné česko-slovenské digitální parlamentní knihovně.18 Korpus je lemmatizován aanalyzován pomocí softwaru #LancsBox (Březina, Timperley & McEnery, 2015).19 Ktomuto zkoumanému korpusu byl pro potřeby analýzy klíčovosti stejným způsobem pořízen referenční korpus RefParl, který obsahuje přepisy tematicky nespecifikovaných sněmovních rozprav— zvolil jsem vždy celou jednu předchozí ajednu následující schůzi po té, na níž se projednával některý znávrhů jazykových zákonů. 16 Vdobě započetí analýzy byl návrh zákona „oúředním jazyce České republiky aozměně zákona č.200/1990 Sb., opřestupcích, ve znění pozdějších předpisů (zákon oúředním jazyce)“ (sněmovní tisk t0629) ze dne 21.října 2015 nejnovějším pokusem olegislativní regulaci jazyka. Poté ještě poslanci KSČM předložili podobný návrh vroce 2017, ale Poslanecká sněmovna ho— stejně jako zmíněný návrh zroku 2015— do konce svého funkčního období neprojednala. Vliv jeho nepřítomnosti ve zkoumaném korpusu je tedy ve výsledku marginální. 17 „Jazykový zákon“ je zde idále označení neterminologické, zahrnující pro stručnost veškeré legislativní návrhy týkající se nějak úpravy věcí souvisejících sjazykem, tj.od dílčího pozměňovacího návrhu novely zákona oprovozování rozhlasového atelevizního vysílání přes samostatné návrhy zákona ostátním/úředním/apod. jazyce až po návrhy ústavních zákonů. 18 Viz <http://www.psp.cz/eknih/index.htm>. 19 #LancsBox lemmatizuje data pomocí nástroje TreeTagger, který podporuje ičeštinu, není však zcela spolehlivý. Proto se vanalýzách např.jako samostatná klíčová slova objevují inezákladní tvary, neboť jsou chybně nepřiřazeny k(často) separátně existujícímu správně rozpoznanému lemmatu (např.etnický_adjective ietnických_adjective). Dalším typem chyby, kterou TreeTagger generuje, je chybné slovnědruhové tagování (např.čl_verb— ve skutečnosti zkratka pro „článek“). To sice potenciálně znamená do určité míry zkreslení, na základě práce sdaty popsané vnásledujícím oddíle ho však lze prohlásit za velmi malé. Při samotném nakládání sklíčovými slovy, jejich sémantickém sdružování ainterpretaci už tyto chyby zohledňuji avdůsledku odstraňuji. OPEN ACCESS
ONDřEJ DUfEK 23 Díky tomu, že se takto sestavený referenční korpus shoduje skorpusem zkoumaným zhlediska časového ižánrového, lze předpokládat, že jediná proměnná, kterou bude pomocí analýzy klíčových slov možné sledovat, bude téma, tedy vpřípadě korpusu JazParl legislativní úprava jazykové oblasti. Korpus JazParl dělím na dva subkorpusy— JazParl_pro aJazParl_proti; viz tabulka 3. Tyto subkorpusy neodrážejí pouze diskurzně konstituované skupiny aktérů, jejichž přesvědčení se projevují vpromluvách— dělicí linie mezi nimi je demonstrována ireálně existujícími projevy, totiž hlasováním poslanců opříslušném návrhu zákona. Např.hlasování poslance pro jeho postoupení do dalšího čtení, resp.proti jeho zamítnutí (dohledatelné na webu poslanecké sněmovny) tedy znamená zařazení jeho promluv do subkorpusu JazParl_pro.20 skupina (sub)korpus textů tokenů typů lemmat zkoumaný JazParl 89 40423 7843 5155 pro × proti JazParl_pro 38 28671 6249 4112 JazParl_proti 40 10502 3214 2258 referenční RefParl 14 300779 28377 19195 Tabulka 3:Velikost korpusů asubkorpusů. 5.2 ANALÝZA JAZYKOVÝCH IDEOLOGIÍ VČESKÉM PARLAMENTNÍM DISKURZU Ideologie, včetně jejich konkrétních aplikací/realizací týkajících se jazyka, považuji za vlastní každému jedinci účastnícímu se sociálních interakcí avstupujícímu do sociálních kontextů (viz např.Silverstein, 1979, s.193; Woolard, 1998, s.3. Tyto ideologie 20 Do ani jednoho ztěchto subkorpusů nebyly zařazeny promluvy poslanců, kteří se sice vprůběhu projednávání kzákonu vyjádřili, nakonec však oněm nehlasovali nebo se zdrželi hlasování. Vtakovém případě je nebylo možno spolehlivě přiřadit kani jedné skupině, vsubkorpusech proto nejsou. Vtabulce 3 proto subkorpusy JazParl_pro aJazParl_proti mají dohromady jen 78 textů / 39 173 tokenů, přestože JazParl jako celek má o11 textů / 1 250 tokenů víc. Zkritéria postoje projeveného hlasováním se vymykají dokumenty (texty zákonů, důvodové zprávy, stanoviska vlády apod.), které byly rozřazeny na základě převažujícího stanoviska na základě kvalitativního čtení. období zákon 1995 ústavní zákon 1995/1996 zákon ostátním jazyce České republiky aojazycích národnostních menšin 1999/2000 zákon ojazyce České republiky 2002/2003 pozměňovací návrh knovele zákona oprovozování rozhlasového atelevizního vysílání 2003/2004 ústavní zákon 2015 zákon oúředním jazyce České republiky (neprojednáno) Tabulka 2:Přehled návrhů jazykových zákonů. OPEN ACCESS
24 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 mají potenciál formovat sociální akce, které se mohou střetávat se zájmy ostatních jedinců askupin (např.McGroarty, 2008, s.98). Vtomto momentu se do úvah oideologiích dostávají jako proměnné moc (příp. hegemonie apod.). Právě uplatňování moci ssebou nese riziko nespravedlnosti autlačování. To je také perspektiva, která spoluutváří relevanci jakožto faktor při mém rozhodování opodrobení konkrétních částí diskurzu bližšímu zkoumání ajíž interpretuji výsledky analýzy. Jazykové ideologie jsem ve zde představených datech zkoumal perspektivou komparace textů dvou diskurzních skupin— zastánců aodpůrců jazykových zákonů. Zprostorových důvodů se zaměřím pouze na druhou znich, díky své reaktivní podstatě však zčásti osvětlí ipovahu skupiny první. Kzodpovězení otázky, jaké jazykové ideologie jsou manifestovány vpromluvách poslanců, použiju analýzu klíčových slov, kolokační analýzu, konkordanční analýzu akvalitativní, interpretativní kritickou analýzu. Klíčovými slovy rozumím lexikální jednotky, které mají ve zkoumaném korpusu významně vyšší frekvenci než vkorpusu referenčním sohledem na jejich disperzi. Výpočet klíčovosti kombinuje tři podstatné aspekty: zamítnutí nulové hypotézy (tj.že konkrétní slovo je ve zkoumaném korpusu frekventovanější jen náhodou) na určité hladině pravděpodobnosti, velikost efektu azohlednění vnitrokorpusové variability. Proto využívá log-likelihood (která plní první požadavek) aCohenovo d (druhý atřetí požadavek). Za klíčová budu tedy považovat taková slova, která budou mít kladnou hodnotu Cohenova d azároveň hodnotu log-likelihood vyšší než 3,84 (což odpovídá p < 0,05). Kritická reflexe konceptu klíčovosti viz Dufek (2018, s.35–45).21 Jelikož jsou předmětem zájmu témata (koncepty, motivy), zaměřím se na plnovýznamová slova (bez zájmen ačíslovek). Klíčová slova, která se zdají být významově související, vždy sdružím do sémantických skupin (toto sdružování dělám pouze na základě lemmat, ověřování vkonkordancích je vždy předmětem následných kroků; názvy skupin jsou ilustrativní, rozhodně nikoliv jediné možné), poté uvedu zbývající klíčová slova seskupená podle slovnědruhové platnosti.22 21 Dufkův (2018) přehled způsobů výpočtu klíčových slov ajejich výhod aomezení ovšem nezahrnuje aktuální návrh Jesseho Egberta aDouga Bibera (2019). Autoři představují novou metodu určování klíčových slov— text dispersion keyness, která na rozdíl od corpus frequency keyness zcela opomíjí frekvenci asoustředí se pouze na disperzi slov vkorpusu. Jejich kvalitativní zhodnocení seznamů klíčových slov generovaných jednou čistě frekvenčně založenou metodou, třemi metodami různými způsoby zohledňujícími disperzi anakonec čistě disperzní metodou se zdá zřetelně favorizovat jejich vlastní text dispersion keyness. Je však třeba podotknout, že Egbert aBiber svou metodu nekonfrontují spřístupy používajícími metriky velikosti efektu. Důkladnější validizace jejich návrhu je tedy zatím otevřenou otázkou, přesto jde bezesporu opozoruhodný apotenciálně zásadní příspěvek do debaty oadekvátnosti užívání klíčových slov vanalýze diskurzu. Za upozornění na tuto práci děkuji recenzentovi. 22 Neuvádím chybně lemmatizované výrazy, tj.např.případy, kdy jsou jako lemmata uvedeny nezákladní tvary. Také přehlížím výrazy zjevně odkazující ksněmovnímu diskurzu, jako jsou pan, kolega, předsedající, předkladatel, navrhovatel, paragraf apod., kromě toho též rodná jména apříjmení. OPEN ACCESS
ONDřEJ DUfEK 25 Logika analýzy je následující: Zaprvé srovnám prozkoumám seznam klíčových slov vytvořený pro subkorpus JazParl_proti na pozadí subkorpusu JazParl_pro coby referenčního. To zvýrazní specifika zkoumaného subkorpusu vůči tomu druhému (specifika korpusů lze pak vztáhnout kspecifikům subdiskurzů). Zadruhé budu věnovat pozornost klíčovým slovům subkorpusu JazParl_proti sreferenčním parlamentním korpusem RefParl. To ukáže specifika subkorpusu/ subdiskurzu vůči obecnému sněmovnímu korpusu/diskurzu. Zatřetí prověřím vnávaznosti na druhý krok některá klíčová slova společná pro oba subkorpusy (tedy iJazParl_pro) pomocí kolokační analýzy, která pomůže ukázat, do jakých kontextů se klíčová slova prostřednictvím svých kolokátů zasazují. Každý ztěchto tří kroků bude podle potřeby průběžně podpořen detailnějším popisem užívání vybraných klíčových slov pomocí konkordanční analýzy akvalitativního, kontextualizujícího kritického čtení. Nejen vtéto ilustrativní sondě, ale ivplné analýze je přijatelné (nikoliv ideální, leč obhajitelné) nepodrobit všechna klíčová slova detailní analýze. Některá lze ponechat stranou už jen na základě úvahy ojejich relevanci pro zkoumané téma, některá lze prověřit pohledem na výpis konkordancí, oněkterých může rozhodnout až podrobnější konkordanční analýza či přímo kvalitativní čtení širších kontextů. Podstatné je činit takové kroky transparentně. Vnásledujících oddílech věnuji pozornost zejména těm klíčovým slovům, která dobře plní ilustrativní funkci, ato buď ve vztahu kprůběhu analýzy, nebo kzjištěním vzešlým zanalýzy (jejichž užití je výstižně dokládají). Vzhledem knutně omezenému rozsahu komentování postupu analýzy vtomto článku platí, že nejsou projevem strategie popsané voddílu 4.4 jako cherry-picking, aže ta klíčová slova, která zde nepodrobuji podrobnějšímu rozboru, byla vyhodnocena jako doklady vyjádření nepřispívajících kutváření jazykových ideologií, ato právě těmi postupy, které jsem načrtl. Kompletní analýza viz Dufek (2018, s.53–98). 5.2.1 JAZPARL_PROTI — JAZPARL_PRO Seznam klíčových slov subkorpusu JazParl_proti vůči referenčnímu JazParl_pro obsahuje (opět mimo jiné) tato klíčová slova: — cizí: slovensky, slovenština, Slovák, Morava; — legislativa: řád, projev, přepracování, legislativně, přijmout; — hodnocení: dostatečný, stávající, nutný, obvyklý, duplicitní, protiústavní, proklamativní, upravený. — substantiva: závěr, titulek, aplikace, pocit, výjimka, tvrzení, kvóta, soudruh, potíž; — adjektiva: následující, faktický, jasný, chybný, konkrétní, stručný, pouhý, praktický; — slovesa: souhlasit, mít, způsobit, být, omezovat, učit, vystupovat, spadat, odpovědět, hodit, naznačovat, vracet, přinést;— OPEN ACCESS
26 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 — adverbia: jaksi, pouze, zvláště, fakticky, totiž, případně, bohužel, nikoliv, koncepčně, přesně, shora, krásně, výjimečně. Potenciál vyjadřovat postoje kprojednávanému tématu nebo jeho protagonistům lze předpokládat uslov, jako jsou soudruh, dostatečný, nutný, chybný, souhlasit či krásně. Klíčové slovo krásně tento předpoklad jako jediné nepotvrzuje— jde pouze odvě ocenění kvality projevu předřečníka. Ostatní slova však předpoklad potvrzují: Soudruh se sice objevuje pouze třikrát, ale jak ukazují příslušné texty, jeho funkce je delegitimizační. Všechna tři adjektiva vyjadřují většinově odmítavou pozici odpůrců jazykových zákonů: dostatečná je současná zákonná úprava, nedostatečná pak provázanost konkrétního návrhu správním řádem, jeho určitost či jeho ochrana slovenštiny; polovina výskytů adjektiva nutný říká, že navrhovaná úprava není nutná, koncepčně chybný je pak vždy návrh zákona. Níže uvádím dva příklady projevů, které mj.pomocí uvedených (tučně zvýrazněných) klíčových slov vyjadřují signifikantní mínění jejich autorů stran jazyka ajeho legislativní regulace. (1) „Národní“ je ve své podstatě něco, co se dotýká jednotlivých národů, kmenů, atěch na našem území žil vprůběhu dějin nemalý počet. Češi, Moravané, Slezané, Valaši, to vše jsou historické kmeny, které se naučily žít nejen pospolu, ale též sNěmci, Poláky, Židy, Slováky anevyjímaje ani Romy, Araby adalší. Proto by nebylo správné určovat češtinu za kulturní dědictví „jen“ Čechů, Moravanů aSlezanů. Čeština není jazykem jediného národa, je to jazyk občanů České republiky. […] idíky cizím vlivům, se čeština vmluvené formě vyvíjí, ato do podoby, která vyhovuje všem, takže se stala jakýmsi univerzálním dorozumívacím nástrojem lidí žijících na území Čech, Moravy aSlezska. Jazyk je totiž jako živý organismus— žije, roste avyvíjí se ažádná omezení nebo zákony na tomto nemohou nic změnit (t0485-20040615-004-USDEU-Bielesz). (2) Osobně vážím si snahy předkladatelů, hluboce však nesouhlasím stím, že jazykovou kulturu unás je možno zlepšovat zákonem, který nadto pouze apeluje aneukládá sankce. Dobré ovládání už je— adoufám bude— prestižní záležitostí zvýhodňující všechny, kteří dobrou češtinu používají. Český jazyk je poklad, který svobodně kultivujme (t0319-20000222-009-ODS-Nájemník). Vzávěru prvního příkladu nacházíme projev jazykového organicismu (jazyk má podobné vlastnosti aprojevy jako živé organismy), jinak je však celá citace zaměřena na obhajobu inkluzivnějšího pojetí jazyka, než je pojetí nacionální. Druhý příklad je pozoruhodný tím, že obsahuje dva výrazy, které nejsou jednoznačně kompatibilní— poklad asvobodně. Interpretuji to tak, že poklad znamená cosi cenného acenné věci je běžné chránit, což by předpokládalo spíš regulační opatření vtom smyslu, aby cennost nebyla ohrožena. Adverbium svobodně však jde významově proti takové představě. Na druhou stranu lze isvobodu pojímat jako hodnotu, která si zaslouží ochranu. Spojují se tak zde dva potenciálně, ale nejednoznačně odlišné pohledy na jazyk; jak uvidíme dále, není to případ ojedinělý. OPEN ACCESS
ONDřEJ DUfEK 27 Už zprostého pohledu na klíčová slova ajejich skupiny lze získat hrubou představu osubkorpusu/subdiskurzu odpůrců návrhů jazykových zákonů— mimo jiné je orientován evaluativně. Ukazují to výše komentovaná adjektiva dostatečný, nutný achybný. Blíže kjádru diskurzu se však dostaneme až vnásledujících dílčích analýzách, které se budou zabývat klíčovými slovy lépe odrážejícími podstatu subdiskurzu. 5.2.2 JAZPARL_PROTI — REfPARL Vtéto části subkorpus JazParl_proti vztáhnu kreferenčnímu korpusu RefParl. Vyjdu ze dvou seznamů, zde pro názornost dokumentovaných itabulkami: Tabulka4 1/3 2/3 3/3 Pořadí Lemma Pořadí Lemma Pořadí Lemma 5dámy_noun 50 nesouhlas_noun 82 zajišťovat_verb 9 pán_noun 52 titulek_noun 83 předkladatel_noun 13 kolega_noun 54 například_adverb 84 nerozumí_verb 14 předsedající_ adjective 56 spotřebitel_noun 86 takový_pronoun 16 stručný_adjective 57 vedle_preposition 88 kučera_noun 21 slovensky_adverb 60 tlumočníka_noun 89 nikterak_adverb 22 nadbytečný_ adjective 61 předkladatelům_ noun 90 rodném_adjective 23 projev_noun 62 ústavou_noun 93 spisovný_adjective 24 paragraf_noun 64 nepřijal_verb 96 živnostenském_ adjective 25 často_adverb 65 slovenština_noun 97 kučery_noun 27 mít_verb 66 dostatečně_adverb 98 důvodová_adjective 30 hovořit_verb 67 velice_adverb 100 ověřeného_adjective 32 dostatečný_adjective 68 potřeba_noun 102 aplikační_adjective 33 řád_noun 69 česky_adverb 103 legislativy_noun 34 pouze_adverb 71 úředním_adjective 105 tolik_adverb 35 předkladatele_noun 72 předložený_ adjective 107 občanství_noun 37 jaksi_adverb 73 legislativně_adverb 108 ustanovením_noun 38 předkladatelů_noun 74 upravující_adjective 109 bičík_noun 39 výjimka_noun 75 dobře_adverb 110 nějaký_pronoun 40 obsažený_adjective 76 navazovat_verb 112 právnickými_ adjective 42 navrhovatelé_noun 78 řešit_verb 113 dobala_verb 44 navrhovatelů_noun ti 65_numeral Tabulka 4:Klíčová slova přítomná ve 100 nejklíčovějších slovech subkorpusu JazParl_proti vůči referenčnímu RefParl azároveň nepřítomná ve 100 nejklíčovějších slovech subkorpusu JazParl_pro vůči referenčnímu RefParl; šedě jsou uvedena klíčová považovaná za irelevantní, kurzívou chybně lemmatizovaná klíčová slova. OPEN ACCESS
28 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 ukazuje klíčová slova, která se vyskytují mezi sto nejvýznamnějšími vsubkorpusu JazParl_proti, anejsou mezi první stovkou klíčových slov druhého subkorpusu ( JazParl_pro). Po jejich analýze se dostanu ktabulce 5, která obsahuje klíčová slova sdílená mezi první stovkou oběma subkorpusy. Jinak řečeno, zaměřím se nejprve na komparativní specifika, poté na společné motivy. Klíčová slova uvedená vtabulce opět pro větší názornost sdružím do skupin. — zahraničí: slovenský, slovensky, slovenština; nerozumí; — český: česky, rodném; — mluvení: hovořit, projev; — hodnocení: dobře, dostatečný, dostatečně, stručný, pouze, výjimka, nadbytečný; — legislativa: dámy, pán, kolega, předsedající, paragraf, řád, předkladatel, předkladatele, předkladatelů, předkladatelům, navrhovatelé, navrhovatelů, ústavou, legislativy, legislativně, ustanovením, předložený, upravující, důvodová, nepřijal. — substantiva: nesouhlas, titulek, spotřebitel, tlumočníka, potřeba, občanství; — adjektiva: obsažený, úředním, spisovný, živnostenském, ověřeného, aplikační, právnickými; — slovesa: mít, navazovat, řešit, zajišťovat; — adverbia: velice, často, jaksi, například, nikterak, tolik. Lemmata dobře, nadbytečný, potřeba, spisovný ahovořit relevanci vzhledem kpřesvědčením týkajícím se jazyka vanalýze konkordancí akontextů většinově nepotvrzují. Podobně ponechám stranou lemmata hovořit, spisovný, dobře apotřeba. Adjektivum nadbytečný přesvědčení připsatelná předkladatelům jazykových zákonů odráží přece jen lépe: tři výskyty zpěti představují citace či parafráze jiných výroků (onadbytečnosti zákonné úpravy jazykové situace), knimž se připojuje nesouhlas, ve dvou výskytech se pak uznává nadbytečnost jednoho konkrétního článku návrhu zákona. Pro zajímavost připojuji jeden příklad ze subkorpusu JazParl_pro: (3) Nedomnívám se, že ohrožení českého jazyka neúměrně velkým působením cizích slov lze zabránit např.tím, že napíšeme nesouhlasný dopis tomu redaktorovi soukromé rozhlasové stanice, který hovoří jakýmsi „světovým českých jazykem“, jak otom píše vLidových novinách právě již zmíněný profesor filozofické fakulty bohemista Alexander Stich. Nesouhlasím ani snázorem ředitele Ústavu českého jazyka filozofické fakulty Univerzity Karlovy Oldřichem Uličným— jakkoli si obou bohemistů velmi vážím—, který mimo jiné nevítá tento zákon, protože, cituji: „Žijeme ve společnosti, která se nachází vhluboké morální depresi, ve společnosti bez ideálů, cílů, víry avzorů, ale také bez respektu kzákonům. Od této společnosti lze stěží očekávat, že bude respektovat nadbytečný jazykový zákon.“ Ajá dodávám: to by také mohlo znamenat, že není-li vnaší společnosti respekt kzákonům, nebudeme tedy přijímat zákony žádné (t0319-19991102-009-KSČM-Svobodová). Nyní přesunu svou pozornost kpodobnostem obou subkorpusů. OPEN ACCESS
ONDřEJ DUfEK 29 1/2 2/2 JazParl_ pro Lemma JazParl_ proti JazParl_ pro Lemma JazParl_ proti Cohenovo d Pořadí Pořadí Cohenovo d Cohenovo d Pořadí Pořadí Cohenovo d 2,09 1 jazyk_noun 1 1,65 0,58 33 užívat_verb 18 0,50 1,03 2 český_adjective 7 0,61 0,57 34 úprava_noun 11 0,59 1,00 3 ústava_noun 58 0,37 0,57 35 kulturní_adjective 59 0,37 0,95 4 čeština_noun 4 0,71 0,57 36 styk_noun 47 0,40 0,88 6 národnostní_adjective 8 0,61 0,56 39 chránit_verb 19 0,45 0,88 7 zákon_noun 3 0,77 0,55 43 ochrana_noun 2 0,78 0,87 8 národní_adjective 70 0,36 0,55 44 menšina_noun 29 0,42 0,81 12 používání_noun 15 0,55 0,53 51 překlad_noun 26 0,42 0,77 13 jazykový_adjective 17 0,50 0,51 54 evropa_noun 111 0,32 0,73 14 úřední_adjective 10 0,59 0,51 56 francie_noun 55 0,38 0,67 17 právní_adjective 28 0,42 0,50 59 jiný_adjective 63 0,37 0,66 19 etnický_adjective 101 0,32 0,47 69 upravovat_verb 95 0,33 0,65 20 etnických_adjective 31 0,42 0,47 71 národnost_noun 20 0,44 0,64 21 menšin_noun 12 0,59 0,46 76 upravit_verb 43 0,41 0,63 25 cizí_adjective 6 0,62 0,46 78 slovenský_adjective 45 0,40 0,62 27 užívání_noun 51 0,39 0,44 91 předkladatelé_noun 41 0,41 0,61 28 identita_noun 53 0,38 0,43 100 listina_noun 104 0,32 0,60 29 příslušník_noun 49 0,39 Tabulka 5:Klíčová slova přítomná ve 100 nejklíčovějších slovech subkorpusu JazParl_pro vůči referenčnímu RefParl azároveň ve 100 nejklíčovějších slovech subkorpusu JazParl_proti vůči referenčnímu RefParl; kurzívou chybně lemmatizovaná klíčová slova. — jazyk: jazyk, jazykový, český, čeština; — atributy jazyka: národní, úřední; — užívání: užívat, užívání, používání; — zákony: ústava, zákon, úprava, upravovat, upravit, listina; — menšiny: národnost, národnostní, etnický, etnických, menšina, menšin, příslušník; — cizí: Evropa, Francie, slovenský, cizí; — styk: styk, překlad, jiný; — hodnoty: kulturní, identita, chránit, ochrana. Zklíčových slov obsažených vtabulce 5 je vidět, že se oba subkorpusy shodují ve zmiňování základních pojmů diskurzu ojazykových zákonech— kromě výrazů označujících legislativní stránku věci (ústava, zákon, úprava, upravovat, upravit, listina) zde najdeme lemmata přímo „jádrová“— jazyk, jazykový, český, čeština, národní, úřední; používání, užívání, užívat. Obě strany se zjevně vyjadřují kprávům menšin (národnost, OPEN ACCESS
30 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 národnostní, etnický(ch), menšin(a), příslušník). Shodují se též ve vztahování se kzahraničním situacím, viditelném už vpředchozím oddíle (evropa, francie, slovenský, cizí). Sohledem na to, že podstatnou součástí jazykových ideologií jsou hodnoty, bude zajímavé podrobit bližšímu zkoumání skupiny klíčových slov, která do této skupiny řadím: 1) chránit, ochrana; 2) kulturní, identita. 5.2.3 KOLOKAČNÍ ANALÝZA Obrázek 1 atabulka 6 zachycují kolokace23 lemmatu ochrana vsubkorpusu JazParl_ proti. Podrobnější pohled do konkordancí prokázal, že lemmata zlevého kontextu vypovídají okonceptualizaci ochrany vkorpusu/diskurzu jen málo. Vpravo vsubkorpusu JazParl_proti však najdeme typicky (odhlédnuto od skloňování) sousloví ochrana českého jazyka (13 výskytů), pouze jednou jde oto, zda český jazyk potřebuje [takovouto] ochranu. Obrázek 1:Kolokace lemmatu ochrana vJazParl_proti-RefParl. Pozice Lemma Log-likelihood Frekvence kolokace Frekvence kolokátu vpravo jazyk_noun 117,78 22 206 vpravo být_verb 117,21 28 522 vpravo český_adjective 80,49 15 125 vlevo používání_noun 36,77 5 15 vlevo zákon_noun 35,6 10 191 vlevo právní_adjective 33,39 7 70 vpravo mít_verb 16,77 5 100 Tabulka 6Kolokace lemmatu ochrana vJazParl_proti-RefParl 23 Hodnota log-likelihood 6,63, frekvence kolokátu min. 5. 0 1982 1986 1990 1994 1998 2002 2006 2010 2014 zákon_noun český_adjective ochrana být_verb používání_noun právní_adjective mít_verb L L L R R R R jazyk_noun 20 40 60 80 100 120 OPEN ACCESS
ONDřEJ DUfEK 31 Jelikož je sousloví jako ochrana českého jazyka společné pro oba subkorpusy, mohli bychom usuzovat, že zastánci předkládaných jazykových zákonů ji budou prezentovat jako potřebnou, nutnou apod., zatímco odpůrci budou totéž zmiňovat, avšak odmítat, tj.že ochrana českého jazyka není žádoucí. Detailnější rozbor rozšířených kontextů avněkterých případech icelých textů však vyznívá zřetelně méně jednoznačně. Uvedu několik příkladů ze subkorpusu JazParl_proti. (4) Český jazyk je dostatečně chráněn speciálními právními předpisy pro jednotlivé obory atento zákon není třeba (t0319-20000331-004-ODS-Pejřil). (5) Nepochybuji otom, že předkladatele návrhu vedl skutečně dobrý aušlechtilý úmysl, tj.legislativně podpořit ochranu českého jazyka, který— jak všichni víme— je vystaven těžkým zkouškám, ato nejen vkaždodenním životě, vúředním styku, médiích, reklamě, adovolíte-li, velice často ivtomto sále. […] Mne překvapilo, že navrhovatelé zákona— přestože, jak říkám, důvod kjeho přípravě byl nepochybně ušlechtilý— se sami vzdali možnosti sankcionovat jednání, které bude vrozporu sliterou či duchem zákona, aspoléhají na to, že použití češtiny bude vpříslušných případech vynuceno jinými, již existujícími zákony. Jako příklad bych uvedl zákon na ochranu spotřebitele. Předložený zákon skutečně ani vjednom zparagrafů neuvádí, jaké sankce hrozí tomu, kdo nebude jednat vsouladu stímto zákonem, přičemž ani nestanoví, zda avjakých situacích je čeština chráněna jako jazyk obecně, kdy je to spisovná čeština, kdy jsou to oprávněné dialekty atd. Ačkoliv já sám— stejně jako naprostá většina znás, předpokládám— mám velmi často pocit, že čeština jako součást kulturní identity je devastována nad únosnou mez, nedomnívám se, že předložený zákon této devastaci vtéto podobě bude bránit účinněji než jiné aktivity aexistující legislativa (t031919991102-002-US-Matějů). (6) Smyslem návrhu zákona je— slovy předkladatelů, teď budu citovat: „rámcovým způsobem kodifikovat platné právní normy azvyklosti založené vhistorickém vývoji tak, aby se vkoncentrované normativní podobě zdůraznil morální, politický aprávní příkaz zachovávat češtinu jako jeden ze základních prvků české kulturní identity“. Autoři zákona sami přiznávají, že smyslem zákona není zavádět nová opatření kpoužívání aochraně češtiny. Zákon si tedy klade za cíl češtinu chránit. Spadá tedy do skupiny jazykových zákonů, které mají bránit devastaci národního jazyka, zejména pronikáním různých -ismů— amerikanismů, germanismů atd.—, které souvisejí skulturní aprofesionální globalizací, asamozřejmě omezit používání cizích jazyků tam, kde se buď zpraktických, či kulturních důvodů předpokládá použití národního jazyka, vnašem případě češtiny (t0319-19991102-002-US-Matějů). Uvedené příklady ukazují, že zmínky oochraně jazyka se rozpadají na několik skupin. Některé jsou neutrální nebo citátové (např.č.6). Významná je skupina takových, které říkají, že češtinu není třeba chránit víc, než je tomu dosud (např.č.4). Poslední OPEN ACCESS
38 STUDIE ZAPLIKOVANÉ LINGVISTIKY 2/2019 Pragmatics (s.50–69). Amsterdam: John Benjamins. Wodak, R., & Meyer, M. (2009). Critical discourse analysis: history, agenda, theory, and methodology. In R.Wodak & M.Meyer (Eds.), Methods for Critical Discourse Analysis (s.1–33). London: Sage, Wodak, R., & Meyer, M. (2015). Methods of Critical Discourse Studies. London: Sage. Woolard, K.A. (1998). Language ideology as afield of inquiry. In B.B.Schieffelin, K.A.Woolard, & P.V.Kroskrity (Eds.), Language Ideologies: Practice and Theory (s.3–47). Oxford: Oxford University Press. Zasina, A.J. (2018). Image of Politicians and Gender in Czech Daily Newspapers. In M.Fidler & V.Cvrček (Eds.), Taming the Corpus. From Inflection and Lexis to Interpretation (s.167–194). Cham: Springer. Ondřej Dufek | Ústav pro jazyk český AV ČR, Praha <[email protected]> OPEN ACCESS