Full text
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 1! El corpus ESLORA de español oral: un recurso para la investigación en ELE Victoria VÁZQUEZ ROZAS (Autor para correspondencia) Universidade de Santiago de Compostela (España) [email protected] https://orcid.org/0000-0001-8155-669X Marta BLANCO Universidade de Santiago de Compostela (España) [email protected]s https://orcid.org/0000-0002-8635-6950 Resumen: En esta contribución se presenta el corpus ESLORA (https://eslora.usc.es/) y se describen, mediante ejemplos concretos, algunas de sus posibilidades de explotación como recurso para la investigación en español lengua extranjera (ELE). En primer lugar (§ 1.1), se contextualiza el proyecto y se resumen sus objetivos generales; en el § 1.2 se presentan las características de composición y diseño del corpus, con especial atención a aquellos aspectos directamente relacionados con sus posibilidades de explotación para la investigación lingüística; y en el § 1.3 se exponen las opciones que ofrece la interfaz de consulta para recuperar la información. La segunda parte incluye la descripción de varios casos prácticos de utilización del corpus para el estudio de fenómenos relevantes en la enseñanza y aprendizaje de ELE. El § 2.1 está dedicado a dos mecanismos derivativos, los afijos -ito/a/os/as y super-; el § 2.2 trata aspectos de la combinatoria sintáctica de los verbos ser y estar; el § 2.3 se centra en el uso y valores de las partículas discursivas; por último, en el § 2.4 se recoge un ejemplo de trabajo colaborativo entre docentes e investigadores de acuerdo con la metodología de investigación-acción, que atiende a la expresión del futuro en español. Palabras clave: explotación de corpus; español oral; ELE Català: El corpus ESLORA d'espanyol oral: un recurs per a la investigació en espanyol llengua estrangera Resum: En aquesta contribució es presenta el corpus ESLORA (https://eslora.usc.es/) i es descriuen, mitjançant exemples concrets, algunes de les seves possibilitats d'explotació com a recurs per a la recerca en espanyol llengua estrangera (ELE). En primer lloc (§ 1.1), es contextualitza el projecte i se'n resumeixen els objectius generals; al § 1.2 es presenten les característiques de composició i disseny del corpus, amb especial atenció a aquells aspectes directament relacionats amb les seves possibilitats d'explotació per a la investigació lingüística; i al § 1.3 s'exposen les opcions que ofereix la interfície de consulta per recuperar la informació. La segona part inclou la descripció de diversos casos pràctics d'utilització del corpus per a l'estudi de fenòmens rellevants en l'ensenyament i l'aprenentatge d'ELE. El § 2.1 està dedicata dos mecanismes derivatius, els afixos -ito/a/os/as i super-; el § 2.2 tracta aspectes de la combinatòria sintàctica dels verbs ser i estar; el § 2.3 se centra en l'ús i valors de les partícules discursives; finalment, al § 2.4 es recull un exemple de treball col·laboratiu entre docents i investigadors d'acord amb la metodologia de recerca-acció, que atén a l'expressió del futur en espanyol. Paraules clau: explotació de corpus; espanyol oral; ELE
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 2! English: ESLORA corpus of spoken Spanish: a resource for the research into Spanish as a foreign language (ELE) Abstract: This paper introduces the ESLORA corpus (https://eslora.usc.es/) and describes, by means of specific examples, some possibilities of its use as a resource for the research into Spanish as a foreign language (ELE). First (section 1.1), the project is contextualized and its main goals are summarized. In section 1.2, we introduce the structure and design of the corpus, paying special attention to those aspects that are immediately related to its use in linguistic research. In section 1.3, we present the possibilities the interface offers in gathering linguistic information. The second part of this contribution concerns the description of several practical cases of how the corpus can be used in ELE teaching and learning. Section 2.1 deals with two derivative mechanisms, the affixes -ito/a/os/as and super-. Section 2.2 is about certain features of the combinatorial syntax of ser and estar. Section 2.3 focuses on the use and the functions of discourse particles. Finally, in section 2.4, we present an example of teamwork between teachers and researchers in accordance with the action research methodology, which is about the way future tense is expressed in Spanish. Keywords: corpus use; spoken Spanish; Spanish as a foreign language Introducción La aportación que brindan la lingüística de corpus, como disciplina, y los corpus, como recurso, a la enseñanzaaprendizaje de lenguas extranjeras es hoy en día un hecho indiscutible. En la actualidad, se dispone de numerosos corpus de distinto tipo (oral, escrito, general, especializado, multilingüe, de aprendientes, entre otros), con un diseño que permite la recuperación de la información textual y contextual que contienen y con unas opciones de acceso cada vez menos restrictivas, todas ellas condiciones muy favorables para que el ámbito de la didáctica de lenguas se beneficie de su uso. Este trabajo se centra en la utilidad de los corpus aplicada a la enseñanza del español como lengua extranjera, atendiendo a la vertiente investigadora. El recurso utilizado, el corpus ESLORA de español oral (https://eslora.usc.es/), responde a un diseño concreto que determina las opciones de uso y explotación en cuanto al área específica de estudio (nivel fónico, morfosintáctico, léxico y pragmático-discursivo, incluyendo la perspectiva sociolingüística); por otra parte, el tratamiento y anotación que han recibido los materiales que lo integran es de crucial importancia para su aprovechamiento, pues condiciona la información que puede ser objeto de búsqueda y recuperación, algo que resulta decisivo desde la perspectiva del corpus como fuente de datos para la investigación lingüística. Siguiendo a Leech (1997), se pueden establecer tres líneas de confluencia entre corpus lingüísticos y enseñanza de lenguas. La primera remite al uso indirecto de los corpus como fuente de datos, la segunda se relaciona con el uso directo de los corpus en la práctica docente, mientras que la tercera hace referencia al desarrollo de corpus orientados a un aprovechamiento didáctico. De las tres líneas señaladas nos centraremos en la primera de ellas y aportaremos algunos ejemplos concretos de uso de ESLORA de acuerdo con ese enfoque.
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 3! 1. El corpus ESLORA 1.1. Contexto y objetivos El corpus ESLORA es un recurso integrado por entrevistas semidirigidas y conversaciones espontáneas audiograbadas en Galicia entre 2007 y 2015. En su versión 2.1 (junio de 2022), la transcripción de los materiales, que se presenta alineada con el audio, alcanza 768 023 palabras ortográficas, lematizadas y anotadas morfosintácticamente. El corpus fue creado para poner a disposición pública una muestra del español hablado en Galicia en condiciones adecuadas para su uso y explotación en la investigación lingüística. Con anterioridad no existía un corpus de materiales orales accesibles y representativos del español de esta comunidad; por una parte, debido a las dificultades intrínsecas a la elaboración de un corpus oral, frente a la relativa rapidez con que se compilan actualmente los corpus escritos; y por otra, por la tradicional desatención a las variedades del español en contextos bilingües, producto de la “ideología del estándar” (Lippi-Green 2012), que favorece a un patrón normativo monolingüe. Aunque el español convive con el gallego en Galicia desde finales del s. XV, cuando se impuso como lengua de la administración del reino de España, su expansión se aceleró desde mediados del siglo XX, con la generalización de la escolarización obligatoria (en español) y la migración progresiva del campo a los núcleos urbanos. El resultado es que actualmente el 70 % de los gallegos tiene el español como lengua habitual en algunas situaciones de comunicación o en todas ellas 1 . A pesar de este uso extendido, el español de Galicia está escasamente documentado. La mayor parte de las referencias y descripciones disponibles están basadas en la observación personal de los gramáticos y en textos en español (en su mayoría literarios) de autores gallegos. Además, las menciones al uso del español en Galicia adoptan en general un enfoque prescriptivista que refuerza los estereotipos negativos hacia la variedad. Es preciso subrayar que ESLORA nació como parte del macroproyecto PRESEEA, con el que comparte el objetivo de contribuir al conocimiento de la variación geográfica del habla en el ámbito hispánico. En ese marco, pretende asimismo documentar el uso oral atendiendo a la variación social, lo que condiciona, como veremos, la distribución de los materiales y las opciones necesarias para la recuperación de los datos (cf. Barcala et al., 2018; Vázquez Rozas et al., 2020, para obtener información detallada sobre la construcción y características del corpus). 1.2. Diseño del corpus: composición, codificación y anotación El diseño del corpus está determinado por los objetivos que persigue su elaboración. En ESLORA los objetivos indicados en el § 1.1 se plasman en su composición y en la anotación de los textos transcritos, un proceso que facilita su consulta posterior. ! 1 Según los datos del IGE de 2018, el 24 % de los encuestados declara usar solo español, el 23 % más español que gallego, el 22 % más gallego que español, el 30 % solo gallego y el 1 % otras lenguas.
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 4! ESLORA contiene materiales obtenidos a través de dos tipos distintos de interacción, la conversacional coloquial y la entrevista semidirigida. Permite así el estudio de la variación asociada al registro y al género (Fernández Sanmartín, 2018, 2023). Además, siguiendo la configuración común a PRESEEA, el subcorpus de entrevistas está distribuido de forma equilibrada entre hablantes mujeres y hombres, tres grupos etarios (de 20 a 34, de 35 a 54, y de más de 54 años) y tres niveles educativos (con estudios primarios, medios y universitarios). Las grabaciones de entrevistas se completaron con las respuestas de los hablantes a un cuestionario con información sociolingüística y actitudinal. Las conversaciones, por su parte, llevan asociadas fichas que recogen los datos sociolingüísticos básicos y la información contextual necesaria para interpretar adecuadamente las situaciones de comunicación. Los textos del corpus se enriquecieron mediante diferentes tipos de codificación, que dan acceso a la información que se considera relevante. Saber qué se ha codificado y con qué criterios es imprescindible para un buen aprovechamiento de los materiales. La Figura 1 recoge los tipos de codificación que incluye la versión 2.1 de ESLORA. Figura 1 Tipos de codificación del corpus ESLORA Se establece una primera distinción entre codificación no lingüística y codificación lingüística. La codificación no lingüística tiene un componente extratextual y otro intratextual. Se considera extratextual la indicación de los metadatos, que se introduce en la cabecera de los documentos en formato XML y abarca, entre otras informaciones, el tipo de discurso -conversación o entrevistay las características sociolingüísticas y roles de los hablantes, es decir, edad, sexo, nivel educativo y, para las entrevistas, si es informante o entrevistador. La codificación no lingüística intratextual señala ciertos elementos o condiciones de los textos que se consideran relevantes tanto para su adecuada interpretación como para la recuperación de la información mediante las opciones de consulta. Las marcas incluidas
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 5! en ESLORA se refieren a la asignación de turnos de habla, solapamientos, alternancia de código, nombres propios anonimizados, risas, siglas, segmentos de discurso referido, palabras cortadas, fragmentos ininteligibles, etc 2 . La codificación lingüística, por su parte, enriquece los textos con información léxica y gramatical, identificando los lemas y las unidades multipalabra y asignándoles la categoría y subcategoría gramatical que les corresponde. A las categorías gramaticales tradicionales se añaden las indicaciones de pausas y silencios, junto con los signos de puntuación de interrogación y admiración. En ESLORA, la anotación morfosintáctica se ha llevado a cabo con el etiquetador XIADA adaptado para textos orales en español y testado mediante su aplicación a un amplio corpus de entrenamiento 3 . 1.3. Recuperación de la información: la interfaz de consulta El motor de búsqueda de ESLORA (https://eslora.usc.es/search) admite la combinación de los diferentes tipos de codificación presentados en el § 1.2 y facilita la construcción de búsquedas complejas sin requerir el conocimiento detallado de la larga lista de etiquetas de codificación y anotación empleadas en su elaboración. No obstante, para rentabilizar todas las posibilidades que ofrece la interfaz de consulta, es preciso conocer previamente (i) qué tipo de búsquedas pueden hacerse, (ii) qué tipo de resultados se obtienen, y (iii) qué opciones de exportación hay. (i) La Búsqueda puede ser ortográfica o gramatical, y puede referirse a elementos únicos o a varias unidades contiguas o distantes. Si elegimos la opción de Elementos gramaticales podremos combinar las indicaciones de clases y subclases de palabras y categorías morfológicas con información léxica (lema) y ortográfica. Todos los términos de búsqueda, sean etiquetas morfosintácticas o lemas, son compatibles con los caracteres comodín ? y *. El sistema de consulta incluye además los operadores booleanos OR (|) y NOT (!), que enriquecen notablemente el filtrado de los datos. (ii) Los Resultados pueden obtenerse en forma de concordancias, frecuencias e inventarios. Las Concordancias KWIC (Key Word in Context) dan acceso al contexto ampliado y a los fragmentos de audio. Las Frecuencias proporcionan información cuantitativa general, tanto en términos absolutos como relativos (frecuencia normalizada por millón de formas), así como los datos parciales de los diferentes subcorpus virtuales derivados de los metadatos del corpus. El sistema permite, de esta manera, comparar la frecuencia relativa de uso de un elemento o combinación de elementos entre hablantes jóvenes y mayores, mujeres y hombres, en entrevistas y conversaciones, etc. La opción Inventarios ofrece la relación de elementos gramaticales o lemas distintos que cumplen las condiciones de la búsqueda, junto con el dato de frecuencia total y normalizada de cada uno. ! 2 V. https://eslora.usc.es/guide_oral_tags 3 Sobre XIADA v. http://corpus.cirp.gal/xiada/. El etiquetario morfosintáctico completo de ESLORA puede consultarse en https://eslora.usc.es/guide_tags.
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 6! Para ilustrar algunas de las opciones de Búsqueda y Resultado, en la Figura 2 vemos cómo obtener la lista de adjetivos registrados en el corpus con el sufijo -ísimo/a/os/as. Figura 2 Captura de la interfaz de consulta de ESLORA 2.1 La captura de pantalla de la Figura 2 muestra enmarcadas en rojo la opción de Elementos gramaticales en Tipo de búsqueda y la cadena *ísim?|*ísim?s en la casilla Elem. gramaticales junto con la selección de la categoría Adjetivo en el menú desplegable de la casilla Etiqueta (la aplicación indica el número de etiquetas seleccionadas, que depende de las variantes morfológicas de cada categoría). Otra manera de hacer la misma búsqueda es poner en la casilla de Etiqueta A*, formada por la A inicial de todas las etiquetas de adjetivo seguida del comodín * para incluir todas las subcategorías y formas morfológicas de esta clase de palabras (v. supra nota 3 para la lista completa de etiquetas morfosintácticas). En cuanto a la configuración de los resultados, enmarcados en verde, la Figura 2 presenta activada la opción de Inventarios, con Ordenación Total (de mayor a menor frecuencia) y agrupados por Elemento gramatical. En la parte inferior de la imagen se seleccionan los datos cuantitativos que interese obtener en cada caso (Selección de columnas), como la frecuencia absoluta y relativa y los metadatos disponibles (no activados en el ejemplo). Los resultados se visualizan en la interfaz de consulta. Siguiendo con el mismo ejemplo, la Figura 3 representa las primeras 20 líneas de la relación obtenida con las condiciones de búsqueda de la Figura 2. La Figura 4 recoge las primeras líneas de la misma búsqueda y resultado de Inventarios, pero con Ordenación por Coincidencia
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 7! (alfabética, no Total) y agrupación por Lema (no por Elemento gramatical). Figura 3 Lista parcial del inventario de elementos gramaticales de los adjetivos en - ísimo/a/os/as ordenados por frecuencia Figura 4 Lista parcial del inventario de los lemas de los adjetivos en -ísimo/a/os/as ordenados alfabéticamente (iii) La opción Descargar de la interfaz de consulta facilita la exportación de los resultados de Concordancias e Inventarios cuando se desea exportar los datos obtenidos en un formato directamente integrable en una base de datos o en una hoja de cálculo. La aplicación genera un fichero con campos delimitados por comas (.csv) o bien en formato de libro de Excel (.xlsx). Las opciones de descarga son especialmente útiles para organizar y filtrar los resultados de frecuencias absolutas y normalizadas de Inventarios en función de los parámetros que estructuran el corpus (metadatos), que hemos visto que se seleccionan en la parte inferior de la pantalla de búsqueda (v. supra Figura 2). Con estas opciones la aplicación aporta las funcionalidades de un diccionario de frecuencias dinámico que incluye las frecuencias absolutas y normalizadas de los elementos léxicos o gramaticales que interesen al usuario, tanto para todo el corpus como para los subcorpus que se pueden definir mediante los parámetros de tipo de texto y características de los hablantes.
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 8! 2. El corpus ESLORA y la investigación en ELE El corpus ESLORA constituye un recurso versátil como fuente de datos para investigaciones destinadas a la enseñanza y aprendizaje de ELE. Por una parte, da acceso al contexto lingüístico -sonoro y en transcripción ortográficade las unidades léxicas y gramaticales y sus combinaciones tal como se producen en un discurso oral informal. Por otro lado, proporciona información cualitativa y cuantitativa sobre el uso de dichas unidades y combinaciones por parte de hablantes de diferentes características sociales. En los siguientes apartados se presenta una muestra de las múltiples posibilidades de explotación del corpus en el campo de los estudios sobre ELE. En el § 2.1, tomando como ejemplos el sufijo -ito/a/os/as y el prefijo superse ilustran las ventajas que ofrece ESLORA para investigar el uso los procedimientos derivativos en el discurso oral. A continuación (§ 2.2), mostraremos algunas posibilidades de explotación sintáctica del corpus a través de las combinaciones de ser y estar con atributos adjetivos. El § 2.3 se centra en el uso y valores de las partículas discursivas y, finalmente, el § 2.4 describe un ejemplo de trabajo colaborativo entre docentes e investigadores sobre la expresión del futuro en español. 2.1. Mecanismos derivativos. El sufijo - ito/a/os/as y el prefijo super - La lematización y anotación morfosintáctica de los materiales de ESLORA permite abordar los fenómenos morfológicos integrando aspectos léxicos, gramaticales y pragmático-discursivos. Además, el diseño del corpus da acceso a la distribución social de los procedimientos de formación de palabras, que revela en algunos casos la correlación existente entre ciertas características de los hablantes y sus elecciones lingüísticas. Ambas perspectivas se ilustran a continuación mediante los afijos -ito/a/os/as y super-. -ito/a/os/as es el afijo diminutivo más frecuente y general en español y constituye, por tanto, un elemento del sistema que los aprendientes de esta lengua han de incorporar a su competencia morfológica. Tanto la diversidad de contenidos expresados por el diminutivo como las diferencias de uso constatadas entre dialectos, incluido el contraste con otros sufijos apreciativos, justifican el interés del tema en el campo de ELE (v. los trabajos con datos de corpus de Criado de Diego y Andión Herrero, 2016; Malaver, 2019; Hu, 2020). Ciertamente, las descripciones gramaticales generales (NGLE § 9) aportan información sobre los diferentes matices de contenido que manifiesta el diminutivo (tamaño o extensión, atenuación, ironía, intensificación) y sobre su empleo con diferentes clases de palabras, mayoritariamente sustantivos (casa – casita) y adjetivos (pequeño – pequeñito), pero también con algunos adverbios (cerca – cerquita) y pronombres (todo – todito). La bibliografía presta asimismo atención a la mayor extensión del diminutivo en variedades americanas, en las que se registra con una amplia gama de adverbios (ahorita, despuesito), con gerundios (andandito), interjecciones (adiosito) y ocasionalmente con posesivos (tuyito) y numerales (unito). Se
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 9! indica también que estos sufijos presentan variantes morfológicas dependientes de la base léxica (cafecito, pueblecito, pero también pueblito) y que algunas unidades o subclases se resisten a la combinación con el diminutivo, como ocurre con los adjetivos de relación (anual, marino, familiar). Los estudios de corpus sobre diferentes variedades geográficas del español aportan una base empírica consistente al conocimiento de la sufijación apreciativa (Manjón Cabeza, 2016; Malaver y Paredes, 2020). En esta línea, es útil completar con datos de otros dialectos, en nuestro caso del español de Galicia, la información disponible sobre el sufijo -ito, puesto que conocer con más detalle su distribución efectiva en el discurso es esencial para facilitar el aprendizaje de ELE. La aportación novedosa de ESLORA, gracias a su interfaz de consulta, es dar acceso inmediato a datos cuantitativos y cualitativos del uso real de este y otros sufijos en el habla. Mediante las opciones de búsqueda se identifican rápidamente las unidades léxicas que aparecen con -ito/a/os/as, ordenadas por frecuencia o alfabéticamente, y también categorizadas según la clase de palabras, el género gramatical o el número. Además, cabe observar la distribución de los diminutivos en función de las características de los hablantes o el tipo de discurso. La Figura 5 corresponde a las condiciones de búsqueda que recuperan las unidades léxicas registradas en el corpus con el sufijo en cuestión: Figura 5 Condiciones de búsqueda de elementos gramaticales con sufijo - ito/a/os/as El uso del operador OR (|) junto con el comodín * en la casilla de Elemento gramatical (la primera de la izquierda) en combinación con el operador NOT (!) en la casilla del Lema (la tercera por la izquierda) permite excluir cualquier lema cuya terminación coincida formalmente con el sufijo buscado (como bonito, hábito, requisito, etc.). Además, la búsqueda se restringe a las clases de palabras que no sean verbos, de ahí que en la casilla de Etiqueta (segunda por la izquierda) se utilice el operador de negación seguido de la etiqueta V y el comodín *. Debe notarse que esta búsqueda deja fuera formas de participio sufijadas, que requieren una búsqueda específica con la etiqueta de participio (VP*) en la casilla Etiqueta (o su elección en el menú desplegable), que según muestra la Figura 6, se completa excluyendo ciertos participios irregulares terminados en -ito/a/os/as (como adscrito, escrito, frito, suscrito y variantes) mediante el operador de negación y las cadenas *scrit* y frit* en la casilla de Palabra ortográfica (la casilla de la derecha).
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 16! 2. a. era un tío abierto b. era una madera africana c. pues era / ciudadano argentino d. era muy muy buena niña e. pues esto era del famoso tirachinas f. para mí antes era mucho más difícil g. era / muy espabilado La búsqueda por proximidad puede resultar útil en las distancias cortas, pero produce muchos resultados no deseados al aumentar la separación entre los elementos buscados, ya que no permite restringir los elementos que aparecen entre las dos unidades fijadas por el usuario. Para un filtrado más preciso es necesario condicionar las características del material situado entre el verbo y el núcleo atributivo: podemos eliminar de los resultados casos como (1f-h) si impedimos que el elemento intermedio entre verbo y adjetivo / participio sea un determinante o un sustantivo. La interfaz de consulta permite aplicar tal restricción usando el tipo de búsqueda por Elem. gramaticales y abriendo y rellenando con las condiciones oportunas las filas de casillas necesarias, como muestra la Figura 10: Figura 10 Búsqueda del verbo ser seguido de un elemento que no sea determinante ni sustantivo y de adjetivo o participio Con la restricción indicada para el elemento intermedio, el número de casos se reduce de 1548 a 1126, de lo que se infiere que más de 400 ocurrencias del resultado inicial de distancia 2 no correspondían a la construcción pretendida. Ahora, con un filtrado más preciso, podemos visualizar y descargar los inventarios de las combinaciones más frecuentes, como el de la Figura 11, que corresponde a la ordenación por frecuencia (Total) de los lemas, o bien de alguna de las otras opciones de ordenación y agrupación que ofrece la interfaz (en la Figura 12 vemos una muestra de la ordenación alfabética por Lema_3, el adjetivo o participio, con agrupación de Lema y Elemento gramatical):
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 17 Figura 11 Lista parcial del inventario de lemas de ser + elemento no determinante y no sustantivo + adjetivo / participio ordenados por frecuencia Figura 12 Lista parcial del inventario de lemas y elementos gramaticales de ser + elemento no determinante y no sustantivo + adjetivo / participio ordenados alfabéticamente por el adjetivo / participio Si nos interesa comparar las combinaciones vistas del verbo ser con el uso de estar en estructuras semejantes, es sencillo obtener la correspondiente información del corpus con búsquedas similares. Las Figuras 13 y 14 reproducen las capturas de parte de los listados obtenidos 6 . ! 6 Se podrían refinar más las búsquedas eliminando la posibilidad de que el segundo elemento sea una preposición, para evitar casos como estar + de pequeño.
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 18 Figura 13 Lista parcial del inventario de lemas de estar + elemento no determinante y no sustantivo + adjetivo / participio, ordenada por frecuencia Figura 14 Lista parcial del inventario de lemas y elementos gramaticales de estar + elemento no determinante y no sustantivo + adjetivo / participio, ordenada alfabéticamente por el adjetivo / participio Desde cualquiera de estos listados, podemos consultar automáticamente las concordancias correspondientes, que a su vez nos dan acceso al contexto extendido junto con la anotación morfosintáctica y al audio de cada fragmento. Las Figuras 15 y 16 visualizan, respectivamente, las concordancias de la estructura buscada con las combinaciones de lemas estar mucho contento y estar bien hacer de la lista de la Figura 13. Figura 15 Concordancias del inventario de lemas estar mucho contento
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 19 Figura 16 Concordancias del inventario de lemas estar bien hacer La comparación entre las estructuras atributivas con ser y con estar se beneficia asimismo del análisis de las concordancias correspondientes a aquellos adjetivos o participios que se combinan con ambos verbos, fácilmente identificables confrontando la relación de los inventarios combinatorios de cada verbo. Al disponer del contexto real de uso de las unidades es posible valorar cuantitativa y cualitativamente la funcionalidad del contraste entre ser y estar con atributos como abierto, bueno, cansado, cómodo, fácil, feliz, jodido, libre, mayor, rico, seguro, soltero, y otros registrados con ambos verbos en ESLORA. Además de un mejor conocimiento de la combinatoria léxico-sintáctica de las cláusulas atributivas en el discurso oral, hay otros aspectos del uso de estas estructuras que pueden ser analizados en profundidad a partir del corpus, ya que este proporciona, por ejemplo, información precisa sobre la distribución de las formas del paradigma verbal, un dato relevante para la planificación didáctica de la enseñanza del uso de las formas verbales según su valor temporal y modal. 2.3. Uso y valores de las partículas discursivas La interacción oral es una de las actividades comunicativas de la lengua que se debe contemplar en el proceso de enseñanza-aprendizaje de español/LE. La adquisición de esta destreza requiere que el aprendiente desarrolle una serie de habilidades no solo lingüísticas, sino también cognitivas, sociales, discursivas y pragmáticas. Entre los numerosos elementos verbales y no verbales propios de la comunicación oral se encuentran las denominadas partículas discursivas, cuyo dominio por parte de los aprendientes suele constituir un área de dificultad. Las opciones que ofrece la interfaz de consulta de ESLORA permiten recuperar información cuantitativa (Figuras 17 y 18) y cualitativa (Figura 19) sobre el uso y valores de estos elementos que puede resultar de enorme utilidad para la investigación en ELE. De acuerdo con el etiquetario morfosintáctico empleado, el acceso a estas unidades requiere que seleccionemos en la opción Tipo, Elementos gramaticales, y en Etiqueta (Categoría), Interjección. Si nos interesa saber cuáles son esas unidades y con qué frecuencia se emplean, debemos seleccionar al mismo tiempo en la opción Tipo de resultado, Inventarios, en la opción Ordenación, Total, y en la opción Agrupar, Lema, como se muestra en la Figura 17.
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 20 Figura 17 Búsqueda de las interjecciones ordenadas por frecuencia y resultado parcial en forma de Inventario La aplicación también nos devuelve las unidades por orden alfabético, simplemente cambiando en la opción Ordenación, Total por Lema 1. Esta ordenación permite comparar el comportamiento de unidades similares, como por ejemplo eeh, eemm, eh, ehm. Figura 18 Búsqueda de las interjecciones por orden alfabético y resultado parcial en forma de Inventario Además, la aplicación facilita el acceso a las concordancias desde las listas generadas pinchando sobre los valores numéricos (resaltados en rojo en las Figuras 17 y 18). Las concordancias dan acceso al contexto ampliado y a los fragmentos de audio, a partir de los cuales se podrían extraer datos sobre valores y usos (posición, sintaxis, prosodia y entonación) de las partículas discursivas, como se muestra en la Figura 19.
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 21 Figura 19 Captura parcial de las concordancias y del contexto ampliable del ejemplo 20 2.4. La expresión del futuro Una forma de aprovechamiento de los corpus como fuente de información responde a la obtención de muestras reales de lengua en las que sustentar la descripción de determinadas estructuras gramaticales, elementos léxicos (palabras, colocaciones) y unidades discursivas (marcadores, conectores). Ahora bien, el empleo de los corpus como fuente de información se puede abordar también desde la colaboración entre los agentes implicados en el proceso de enseñanzaaprendizaje de idiomas en la línea de la denominada investigación-acción (action research) (Kemmis y McTaggart, 1988; McNiff, 2013 [1988]; McNiff y Whitehead, 2006). La muestra de explotación de ESLORA que se recoge en este apartado combina las dos aproximaciones antes mencionadas. Es el resultado de la fase inicial de una experiencia de colaboración entre docentes de ELE e investigadoras de lengua española y se centra en la expresión del futuro en español (cf. Blanco et al., 2021). El primer paso de la investigación consistió en buscar un área de estudio de interés común que permitiera compartir el conocimiento y combinar la experiencia de las investigadoras con la experiencia de las docentes. Se optó por trabajar con la expresión del futuro en español, concretamente con el futuro morfológico (FM), atendiendo al desequilibrio observado entre el tratamiento habitual de esta forma verbal en el aula de ELE y su actualización por parte de los hablantes nativos. En el segundo paso se consultó el PCIC (2006) y algunas gramáticas pedagógicas (Matte Bon, 2001; Martí Sánchez et al., 2008; Borrego Nieto, 2013) y manuales de ELE (Equipo Prisma, 2005; Corpas et al., 2013; Martínez et al., 2020), con el fin de comprobar cómo abordan la descripción de este contenido gramatical. Se observó que los valores asociados al futuro se relacionan fundamentalmente con acciones futuras absolutas (Estaré fuera de martes a jueves), hipótesis y probabilidad (Serán unos siete), uso en frases interrogativas (¿Será imbécil?), futuro concesivo (Estará lloviendo, pero yo voy a salir), cortesía verbal atenuadora (Veré qué puedo hacer), futuro de mandato (Obedecerás en todo lo que te digan) y futuro impreciso (Ya veremos). En el tercer paso se llevó a cabo el análisis de los datos arrojados por el corpus ESLORA. El
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 22 aprovechamiento futuro de los resultados obtenidos se materializará en un cuarto paso centrado en la elaboración de materiales a partir del uso tanto directo como indirecto del corpus. Su uso directo, como fuente de información, permitirá basar las descripciones y explicaciones didácticas sobre la expresión de futuro en datos reales y contextualizados. Su uso indirecto, como herramienta de aprendizaje, posibilitará el diseño de actividades en la línea del Data-Driven Learning (aprendizaje guiado por datos), que potencia la autonomía y la motivación de los aprendientes, ya que favorece una práctica lingüística significativa al trabajar con muestras auténticas de lengua. Por último, el quinto paso consistirá en el pilotaje de las actividades en un contexto de instrucción formal y requerirá la implicación activa de las docentes en el diseño de la herramienta para llevarlo a cabo, así como en la interpretación de la información obtenida y sus consiguientes implicaciones didácticas. El examen detenido del uso oral contextualizado en contraste con las descripciones que ofrecen el PCIC y los manuales y gramáticas pedagógicas de ELE permitió no solo comprobar en el corpus los valores atribuidos al FM en la bibliografía sino también observar la productividad de los diferentes usos de la forma. De esta manera se introducen nuevos conocimientos empíricos en la práctica de la enseñanza de la lengua, que responde así de forma más adecuada a las condiciones y exigencias comunicativas reales. Además, el acceso inmediato al audio de las entrevistas y conversaciones que integran el corpus constituye una ventaja añadida para el reconocimiento de valores diversos en contextos dialógicos. Como se muestra en la Figura 20, los usos del FM registrados de ESLORA responden a algunas de las funciones atribuidas al FM en manuales y gramáticas pedagógicas de ELE, pero el corpus no aporta ejemplos ni del futuro de mandato ni del futuro de cortesía verbal atenuadora. Esta ausencia puede considerarse indicativa de su menor extensión en el uso actual y, en consecuencia, puede determinar decisiones sobre la introducción didáctica de las funciones del FM. Figura 20 Expresión del futuro (FM) PCIC, manuales y gramáticas pedagógicas de ELE Datos de ESLORA a) Acciones futuras absolutas b) Hipótesis y probabilidad c) Uso en frases interrogativas d) Futuro concesivo e) Futuro impreciso (ya) f) Cortesía verbal atenuadora g) Futuro de mandato a) mañana vendrá por ejemplo y <pausa/> y haré eso <pausa/> y preparo la comida b) con los alumnos ¿qué tal? porque habrá alguno que será casi de tu edad c) ¿qué le pondré? <silencio/> siete <silencio/> ocho d) entonces digo bueno pues inglés no sabré la mandaré a clases pero creo que soy un buen ejemplo e) Ya me informaré cuando llegue el momento f) Uso no documentado en el corpus g) Uso no documentado en el corpus Por otra parte, los datos extraídos del corpus muestran la recurrencia de varias fórmulas semilexicalizadas
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 23 (entre paréntesis se indica la frecuencia absoluta): ya verás (14), ya veremos (4), tú dirás (7), tú sabrás (3), como comprenderás (3), ya me contarás (3). El trabajo colaborativo de recuperación y análisis de los datos de ESLORA permite enriquecer la clasificación de valores del futuro que ofrecen los manuales con información empírica sobre la frecuencia y distribución de las funciones. Asimismo, el corpus facilita la comparación del uso del FM con el de la perífrasis ir + infinitivo, con la que comparte la expresión de valores temporales. La combinación de datos cuantitativos, extraídos de forma automática, con la clasificación semántica llevada a cabo manualmente de forma coordinada por todo el equipo, señala con claridad la asociación del FM con el sentido de conjetura o probabilidad y en menor medida con el valor temporal de posterioridad. Del análisis detallado realizado sobre una muestra parcial del corpus integrada por 338 casos de futuro y 528 de la perífrasis se concluye que el FM expresa posterioridad solo en el 28 % de los casos, frente al 69 % de usos temporales de la perífrasis. El corpus aporta, además, datos sobre la distribución de la persona en relación con la forma, morfológica o perifrástica, y con el sentido, temporal o modal. Así se comprueba que el FM se registra en 3ª persona de singular en el 45 % de los casos, frente al 18 % de la 1ª persona de singular, pero si se tienen en cuenta solo los casos de interpretación temporal, la 1ª persona es bastante más frecuente que la 3ª (46 % vs. 14 %). Por su parte, ir + infinitivo tiende a usarse en 1ª persona de singular (42 %) más que en 3ª (23 %), una diferencia que aumenta en el uso temporal de la perífrasis: 1ª persona de singular 50 % frente al 18 % de la 3ª. Consideraciones finales A pesar de su indudable potencial para la investigación lingüística en la enseñanza y aprendizaje del español, hay que reconocer que a día de hoy el aprovechamiento de los corpus en ELE no es aún una práctica generalizada (pero v. Cruz Piñol, 2021; Vázquez Rozas y Blanco, 2022; Marcos Miguel y Bonilla, 2023, y referencias allí citadas). Para promover la difusión de la lingüística de corpus (y con corpus) en este campo deben cumplirse varias condiciones. En primer lugar, es fundamental disponer de suficientes recursos de acceso público que proporcionen muestras amplias y diversas del español, tanto escritas como orales, representativas de las variedades geográficas, sociales y de los diferentes registros de la lengua. Además, los materiales recopilados han de estar enriquecidos con la codificación y las anotaciones pertinentes que permitan un aprovechamiento completo y adaptable a diferentes finalidades. Para lograr este objetivo es preciso asimismo facilitar la recuperación de la información contenida en los corpus mediante motores de búsqueda potentes y aplicaciones de consulta claras e intuitivas. Por último, pero no menos importante, es necesario difundir e impulsar el conocimiento y el empleo de los corpus por parte de los agentes en la enseñanza de lenguas, tanto en su vertiente investigadora como pedagógica. El diseño y construcción de ESLORA reúne las condiciones señaladas en el párrafo anterior y este trabajo responde, en particular, a la última dirección apuntada. Ciertamente, los ejemplos de utilización del corpus esbozados
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 24 en los diferentes apartados constituyen solo una muestra parcial de las múltiples opciones de explotación que ofrece el recurso para los estudios de ELE. No obstante, esperamos que la contextualización, la presentación de las características de composición y diseño y la descripción de ejemplos concretos de explotación del corpus sirvan para promover y facilitar su uso para la investigación en español lengua extranjera. Agradecimientos Este trabajo se ha realizado en el marco del proyecto de investigación El corpus ESLORA de español oral: enriquecimiento, análisis lingüístico y aplicaciones (PID2020-118133GB-I00-P), financiado por MCIN/AEI/ 10.13039/501100011033. Referencias Barcala, Mario; Domínguez Eva; Fernández, Alba; Rivas, Raquel; Santalla, Mª Paula; Vázquez, Victoria; Villapol, Rebeca (2018). El corpus ESLORA de español oral. Diseño, desarrollo y explotación. CHIMERA: Revista de Corpus de Lenguas Romances y Estudios Lingüísticos, 5(2), 217-237. https://doi.org/10.15366/chimera2018.5.2.003 Blanco Domínguez, Marta; Barros Lorenzo, Rocío; Paz Doce Rosa Ana (2021). Corpus y ELE: una experiencia práctica colaborativa. XXXI Congreso Internacional de ASELE. Creatividad, innovación y diversidad en la enseñanza del español como LE/L2, celebrado en la Universidad de León, 1-3 de septiembre de 2021. Borrego Nieto, Julio (dir.) (2013). Gramática de referencia para la enseñanza de español: la combinación de oraciones. Ediciones Universidad de Salamanca. Corpas, Jaime; Garmendia, Agustín; Soriano, Carmen (2013). Aula 3. Nueva Edición B1.1. Difusión. Criado de Diego, Cecilia; Andión Herrero, María Antonieta (2016). Variación y variedad del diminutivo en español a través de dos corpus originales. Apuntes para su enseñanza como lengua extranjera. RAEL: Revista Electrónica de Lingüística Aplicada, 15(1), 87-108. https://rael.aesla.org.es/index.php/RAEL/article/view/283 Cruz Piñol, Mar (Ed.) (2021). E-research y Español LE/L2: investigar en la era digital. Routledge. https://doi.org/10.4324/9780429433528 Equipo Prisma. (2005). Prisma Consolida C1. Edinumen. ESLORA: Corpus para el estudio del español oral. http://eslora.usc.es Fernández Sanmartín, Alba (2018). La entrevista libre como método para evitar la paradoja del observador. Un estudio de corpus. CHIMERA: Revista se Corpus de Lenguas Romances y Estudios Lingüísticos, 5(2), 141-196. https://doi.org/10.15366/chimera2018.5.2.001 Fernández Sanmartín, Alba (2023). Teoría y métodos para la elaboración de corpus orales: la entrevista sociolingüística. [Tesis doctoral, Universidade de Santiago de Compostela]. Hu, Jingyuan (2020). La enseñanza del diminutivo en ELE a sinohablantes a través de contenidos audiovisuales Españoles e Hispanoamericanos. [Tesis doctoral. Universidad Complutense de Madrid]. https://eprints.ucm.es/id/eprint/63410/ IGE: Instituto Galego de Estatística. https://www.ige.gal
ISSN 2696-676X ! Vázquez Rozas, Victoria; Blanco, Marta (2023). El corpus ESLORA de español oral: un recurso para la investigación en ELE. TEISEL. Tecnologías para la investigación en segundas lenguas, 2, Artículo e-a_hr02, 1-25. http://doi.org/10.1344/teisel.v2.41757 © Las autoras | Recepción: 16/01/2023 | Revisión: 23/01/2023 | Aceptación: 06/03/2023 | Publicación: 27/03/2023 ! 25 Kemmis Stephen; Robin McTaggart (1988). The action research planner. Deakin University Press. Leech, Geoffrey (1997). Teaching and language corpora: a convergence. En Anne Wichmann; Steven Fligelstone; Tony McEnery; Gerry Knowles (eds.), Teaching and language corpora (pp. 1-23). Longman. Lippi-Green, Rosina (2012). English with an Accent: Language, Ideology and Discrimination in the United States. (2ª ed.). Routledge. Malaver, Irania (2019). Diminutivos en el habla de aprendices de español. MarcoELE: Revista de Didáctica de Español Lengua Extranjera, 29. https://marcoele.com/descargas/29/malaver-diminutivos_aprendices.pdf Malaver, Irania; Paredes, Florentino (2020). Convergences and divergences in the use of the diminutive in Medellin, Caracas and Madrid. En Isabel Molina Martos, Ana M. Cestero Mancera y Florentino Paredes García (eds.), Sociolinguistic patterns and processes of convergence and divergence in Spanish). [Spanish in Context 17, 2] (pp. 317340). https://doi.org/10.1075/sic.00061.mal Manjón-Cabeza Cruz, Antonio (2016). Los sufijos –ico, –ito, –illo en el español de Granada, España. Spanish in Context 13(3), 421-436. https://doi.org/10.1075/sic.13.3.05man Martínez, Daniel; Rodríguez, Marta; Ruiz, Juana; Suárez, Elena (2020). Agencia ELE 5. Nueva Edición B2.1. SGEL. Matte Bon, Francisco (2001). Gramática comunicativa del español. Tomo 1 De la lengua a la idea. (Nueva edición revisada). Edelsa. Marcos Miguel, Nausica; Bonilla, Carrie L. (2023). Utilización de corpus de español L1 en el aula de LE/L2/LH: ¿por qué y para qué? Journal of Spanish Language Teaching. https://doi.org/10.1080/23247797.2022.2157083 Martí Sánchez, Manuel; Penadés Martínez, Inmaculada; Ruiz Martínez, Ana María (2008). Gramática española por niveles. (Volumen 2). Edinumen. McNiff, Jean (2013 [1988]). Action research. Principles and practice. (3ª ed). Routledge. McNiff, Jean; Jack Whitehead (2006). All you need to know about action research. Sage Publications. NGLE: RAE y ASALE (2009). Nueva gramática de la lengua española. Espasa. PCIC: Instituto Cervantes (2006). Plan curricular del Instituto Cervantes. Niveles de referencia para el español (3 vols.). Biblioteca Nueva. https://cvc.cervantes.es/ensenanza/biblioteca_ele/plan_curricular/default.htm PRESEEA: Proyecto para el Estudio Sociolingüístico del Español de España y de América. https://preseea.uah.es/ Vázquez Rozas, Victoria; Barcala, Mario; Domínguez Noya, Eva; Fernández Sanmartín, Alba; Rojo, Guillermo y Santalla, María Paula (2020). Codificación y anotación del habla en un contexto bilingüe: el corpus ESLORA de español de Galicia. En Ángel J. Gallego y Francesc Roca Urgell (eds.), Dialectología digital del español, [Anexo nº 80 de Verba] (pp. 191-226). Servizo de Publicacións e Intercambio Científico da USC. https://dx.doi.org/10.15304/9788418445316 Vázquez Rozas, Victoria y Blanco, Marta (2022). Corpus y enseñanza del español. En Giovanni Parodi, Lewis C. Howe y Pascual Cantos (eds.), Lingüística de corpus en español/ The Routledge Handbook of Spanish Corpus Linguistics (pp. 342-356). Routledge. https://doi.org/10.4324/9780429329296-26