Od lwa do gogusia salonowego historycznopragmalingwistyczne studium o bohaterach polskich salonów czyli Na materiale korpusowym z lat 1876-2020 Aleksandra Ryś
Frazeologia Pragmalingwistyka Frazeologia i pragmalingwistyka – jak czytać język w kontekście? •bada stałe połączenia wyrazowe →„pamięć języka i kultury” •łączy stabilność formy z różnorodnością użyć •bada język w kontekście użycia (nadawca, odbiorca, sytuacja) •łączy formę językową z intencją komunikacyjną
Narzędzia cyfrowe w lingwistyce Nowe możliwości •cyfrowe korpusy tekstów •narzędzia do analizy sentymentu (np. Multiemo, CLARIN-PL) •modele deep learning →automatyczna ocena emocji i nastawienia Co daje połączenie? •analiza ewolucji nacechowania emocjonalnego •nowe perspektywy w badaniach nad polszczyzną
Wprowadzenie Temat: tekstowe realizacje frazeologizmu lew salonowy Definicja: ‘przest. człowiek bywały w towarzystwie, umiejący robić dobre wrażenie; też: uwodziciel’ (Müldner-Nieckowski 2003: 351) Cel: identyfikacja użyć + ocena wydźwięku Ramy czasowe: 1876–2020
Perspektywa badawcza Historycznopragmalingwistyczna Analiza sentymentu wypowiedzi wykorzystanie cyfrowych korpusów tekstów (1876–2020) narzędzie Multiemo (CLARIN-PL)
Materiał badawczy 1876–2020 4 korpusy: 51 poświadczeń: literatura piękna, teksty non-fiction, publicystyka Dobór: jednolita próba + reprezentacja każdego korpusu + obecność frazeologizmu
Próbki tekstów FISZBINOWICZ. (nadymając się). Ja nie przyzwyczajony? – a któż nim będzie, jeżeli nie ja? Wszak musiałeś słyszeć jakim dawniej byłem rozbójnikiem salonowym – powiadam ci ofiar mnóstwo... (KorTeDa, 1878 [1876]). Od luksusowych puderniczek do prymitywnych piecyków żelaznych, poprzez zwiewny welon oblubienicy, 6 okazyjnych zastrzyków Salvarsanu, terenową mapę Afryki północnej, aż do skadynawskich półbucików emerytowanego lwa salonowego – wszystko jest do sprzedania (ChronoPress, 1945). Cosmo przychodzi ci więc z pomocą: przeczytaj naszą ściągawkę, a żadne przyjęcie cię już nie onieśmieli, zaś znajomi będą przecierali oczy ze zdumienia, nie mogąc się nadziwić przemianie szarej myszki w salonową lwicę, brylującą w każdym towarzystwie (NKJP, 2000).
Analiza sentymentu Multiemo (CLARIN-PL): •oparte na deep learning •ocenia wydźwięk: pozytywny / negatywny / neutralny / ambiwalentny •jednostka analizy = spójna próbka tekstu Długość próbek: •17–336 słów •średnia: 107, mediana: 78 Warianty: 13 postaci frazeologizmu (lew salonowy, lwica salonowa, playboy salonowy itd.)
Podział chronologiczny Okresy badawcze •1876–1887 – ziemie pod zaborami (pierwsze użycia) •1945–1966 – powojenna odbudowa, PRL •1990–2003 – transformacja, traktat ateński •2004–2014 – Polska w UE •2015–2020 – rządy Zjednoczonej Prawicy, pandemia Luki: •1887–1945 •1966–1990 (brak danych w korpusach)
Interpretacja wyników 1945–1966 – dominacja negatywnych ideologiczny kontekst PRL (salon = dekadencja, burżuazja, wyzysk) 1990–2014 – wzrost pozytywnych i neutralnych transformacja ustrojowa, wejście do UE, większa akceptacja różnorodności 2015–2020 – przewaga pozytywnych + rosnące ambiwalentne ruchy społeczne (#MeToo, protesty), narracje feministyczne, popfeminizm
Konkluzje stabilność –lew salonowy obecny w każdym okresie, najczęstszy wariant wydźwięk – od „światowca salonowego” →ku neutralnemu/pozytywnemu metoda – połączenie historii języka i LLM = nowe perspektywy badań Analiza = stabilność leksykalna + zmienność pragmatyczna
Perspektywy badań rozszerzenie materiału – inne frazeologizmy o podobnym charakterze zróżnicowanie źródeł – większe spektrum gatunków i rejestrów analiza porównawcza – różnice płciowe, ale też pokoleniowe i stylistyczne rozwój metod – testowanie nowszych narzędzi (LLM, AI) do detekcji ironii i sarkazmu kontekst międzynarodowy – porównania międzyjęzykowe
Bibliografia (wybór) Kieraś, W., Marciniak, M., Łaziński, M., Woliński, M., Bojałkowska, K., Eźlakowski, W., … Zawadzka-Paluektau, N. (2024). Korpus Współczesnego Języka Polskiego. Dekada 2011–2020. Język Polski, 104(1), 1–16. https://doi.org/10.31286/JP.001055 Miłkowski, P., Gruza, M., Kazienko, P., Szołomicka, J., Woźniak, S., & Kocoń, J. (2022). Multiemo: Language-agnostic sentiment analysis. W: International Conference on Computational Science (s. 72–79). Springer. Mitrenga, B., Pastuch, M., & Wąsińska, W. (w druku). The Corpus of Polish Dramatic Texts (1772–1939) – structure, specificity and application. Müldner-Nieckowski, P. (2003). Wielki słownik frazeologiczny języka polskiego. Warszawa: Świat Książki. Pastuch, M., Mitrenga, B., & Wąsińska, K. (2024). Anotacja socjolingwistyczna w Korpusie dawnych polskich tekstów dramatycznych (1772–1939). LingVaria, 19(1[37]), 151–170. https://doi.org/10.12797/LV.19.2024.37.10 Pawłowski, A. (2021). ChronoPress – Korpus Tekstów Prasowych [Zbiór danych]. Repozytorium CLARIN-PL. https://doi.org/10.34616/139101 Przepiórkowski, A., Bańko, M., Górski, R. L., & Lewandowska-Tomaszczyk, B. (red.). (2012). Narodowy Korpus Języka Polskiego. Warszawa: Wydawnictwo Naukowe PWN. Ryś, A. (2024). Jak współcześnie badać frazeologię w tekstach dawnych? Możliwości wykorzystania narzędzi cyfrowych w pracy historyka języka. Forum Lingwistyczne, 12(2), 1–17. https://doi.org/10.31261/FL.2024.12.2.08
Dziękuję za uwagę
[email protected]