Full text
The Available Lexicon: A Tool to Aid the Selection of Appropriate Vocabulary for the Teaching Spanish as a Foreign Language Antonio Manuel Ávila-Muñoz Universidad de Málaga [email protected] Abstract This study aims to provide foreigns languages professionals with a sound methodology for selecting a suitable lexicon apropos of their students’ level in the language. The justification of said selection is, herein, rooted in a cognitive argument: If we are able to observe the manner in which words are organized within the mind, we will be better able to select the words needed for the natural process of communication. After poring over lists of lexical availability compiled by previous analyses, this study puts forth a glossary filtered by way of an objective procedure based on the mathematical concept known as Fuzzy Expected Value. I begin first by rigorously defining the concept of lexical availability and then thoroughly examining and explaining the manner in which I have obtained the results. Next, I employ the cognitive theory of prototypes to expound upon the organizational apparatus which arranges words within speakers’ minds. Subsequently and in accordance with objective criteria, a lexical selection is proposed. To end, I contemplate and muse upon the significance of a program that would enable us to identify the most appropriate vocabulary according to the students’ level of linguistic competence. In order to further substantiate this study, it will be juxtaposed to the specific notions outlined by the curriculum of The Cervantes Institute. Moreover, it will be relationed with the teaching levels proposed by American Council on the Teaching of Foreign Languages (ACTFL) and Common European Framework of Reference for Languages (CEFR). Keywords: lexical aviability, theory of prototypes, lexical selection, Fuzzy expected value 1. Introducción Las diversas posibilidades de aplicación práctica que ofrecen los estudios de disponibilidad léxica son incuestionables. Uno de los ámbitos en los que se ha desarrollado más extensamente estas opciones ha sido el de la enseñanza de la lengua, sea materna o extranjera. De hecho, los estudios de disponibilidad nacieron a mediados del siglo XX para dar respuesta a preocupaciones surgidas en este ámbito de estudio. Sin embargo, esta línea de aplicación didáctica de las listas de disponibilidad no se ha explotado suficientemente en el ámbito de la enseñanza de ELE, salvo en contadas ocasiones (Cardedo González 2000, Samper Hernández 2002, Bombarelli 2005, entre otros). En este trabajo proponemos un procedimiento de selección del léxico a partir de la teoría de los conjuntos difusos aplicada al ámbito de la disponibilidad léxica (Ávila Muñoz y Sánchez Sáez 2010, 2011). A grandes rasgos, la propuesta permite diferenciar varios niveles de compatibilidad del léxico respecto a un centro de interés. Cada nivel recoge un número de vocablos que aumenta a medida que decrece el grado de compatibilidad. Puesto que las listas de disponibilidad léxica suelen obtenerse a partir de hablantes nativos, esos parámetros permiten identificar los vocablos que cuentan con alta disponibilidad en estos informantes y, por tanto, facilita la selección de aquellos que no deberían faltar en el diseño de los programas de aprendizaje del léxico en el ámbito de lenguas extranjeras. La obtención de un índice matemático de compatibilidad de cada vocablo con el ámbito nocional al que se asocia permite, además, seleccionar de manera objetiva los vocablos más adecuados a cada nivel de aprendizaje. 2. Orígenes y fundamentos Los orígenes de la disponibilidad léxica se remontan a 1951, cuando el Ministerio de Educación Nacional francés crea una comisión para elaborar un léxico de base con fines didácticos (Gougenheim et al. 1954). Se podría decir que el primer objetivo de estos estudios fue crear una lista con las palabras básicas para estudiantes de francés como lengua extranjera.
En la génesis de las investigaciones sobre la disponibilidad está la crítica a los procedimientos lexicoestadísticos de selección basados únicamente en criterios de frecuencia. Para obtener el léxico de frecuencia de una lengua se usan procedimientos que nos acercan al léxico que posee una estabilidad estadística concreta. En otras palabras, los listados de frecuencia contienen el léxico al que los hablantes recurren más a menudo para construir sus mensajes, independientemente del tema del discurso. Es sabido que tendemos a utilizar un reducido número de unidades tanto léxicas como estructurales que son, evidentemente, las más frecuentes. La variable ‘frecuencia de uso’ es una de las de mayor peso en el procesamiento del lenguaje, sea desde una perspectiva de producción o de descodificación. Existen diccionarios de frecuencias léxicas de las principales lenguas occidentales que son aplicados de manera diversa. De modo general, estos trabajos se aprovechan en las planificaciones de la enseñanza del léxico de lenguas maternas y de segundas lenguas (Davies 2005, Lonsdale y Le Bras 2009). Sin embargo, las listas de frecuencia contienen casi exclusivamente vocablos ‘atemáticos’ sin significado propiamente léxico (palabras gramaticales) y faltan otros de contenido léxico, vocablos ‘temáticos’ muy comunes para cualquier hablante, siempre que se den las condiciones comunicativas necesarias para su actualización. Las palabras ‘temáticas’ están relacionadas con un tema determinado, designan seres y objetos (sustantivos, en su mayoría). Se trata de palabras que suelen aparecer en agrupaciones, de modo que el empleo de alguna favorece el de otras y casi siempre se repiten cuando se abordan determinados temas (De Kock 1983, 59-60). Los léxicos disponibles pueden resultar el complemento adecuado para compensar las irregularidades observadas en los repertorios de frecuencia: en ellos encontramos el reflejo del caudal léxico usado en una situación comunicativa determinada. Este tipo de listado explota el concepto de ‘situación frecuente’, que contrasta con el manejado por los listados de frecuencia, centrados en el de ‘léxico frecuente’. El léxico de disponibilidad encuentra su sentido en la máxima de que ciertas palabras muy usadas en una lengua están relacionadas con la aparición o no de determinados temas. Para la recolección del vocabulario disponible —aunque no necesariamente frecuente— se parte de la elaboración de pruebas asociativas que giran en torno a unos centros de interés. Alrededor de estos núcleos nocionales surge determinado vocabulario relacionado que, se supone, es el léxico potencial que pertenece al vocabulario activo de los sujetos y del que estos hacen uso si una conversación discurre por los cauces necesarios. El número total de vocablos que componen estos listados de léxico disponible está normalmente limitado, bien por el tiempo de reacción de los hablantes, bien por el cierre de las listas tras una cantidad determinada de palabras. Se supone que son más disponibles las palabras que acuden antes a la memoria, es decir, aquellas que aparecen en los primeros lugares de las listas. El léxico disponible forma parte del lexicón mental de los hablantes, pero no suele actualizarse en los intercambios lingüísticos cotidianos, a menos que exista una especialización temática. Si bien es cierto que algunos estudios recomiendan no introducir el vocabulario por campos semánticos para evitar interferencias (Nation 2000), como vamos a demostrar, las listas de disponibilidad favorecen el aprendizaje de segundas lenguas tanto en niveles iniciales como en avanzados, cuando el problema de las interferencias ya no resulta tan preocupante. En la obtención de las listas de léxico disponible se aplica una fórmula matemática que se basa en el índice de disponibilidad. Este índice es un parámetro numérico que pone en relación criterios de frecuencia y orden. El cálculo matemático en el que se basa pondera la frecuencia con la que se actualiza una palabra en un centro de interés con su posición en las listas que se estudian. Los vocablos más disponibles —es decir, aquellos que obtienen un
índice de disponibilidad más cercano a 1 en un intervalo entre 0 y 1— son aquellos que aparecen más veces en las primeras posiciones de las listas. 3. Metodología El presente trabajo está basado en los resultados de las listas de disponibilidad léxica obtenidas en Málaga entre los años 2005 a 2010 a partir de los siguientes principios metodológicos propios de las investigaciones sobre disponibilidad: 1. La muestra se diseñó a partir de criterios de representación basados en una población estratificada por la edad, el sexo y el nivel de instrucción (n = 72), sobre un total de 557.770 habitantes en 2005, lo que significa una relación muestra/población de 1/7746. Creemos que el número de informantes usados en este trabajo es suficiente para cubrir su objetivo principal: mostrar la eficacia del modelo teórico que sirve para realizar una selección adecuada del vocabulario a enseñar en las aulas de ELE. Sin embargo, somos conscientes de las ventajas que supondría trabajar con una muestra mayor formada por diferentes variedades diatópicas: A. La ampliación de la muestra —tal y como ha quedado demostrado en investigaciones anteriores— hace que la fórmula empleada para el cálculo de la disponibilidad resulte más estable y fiable. B. Ampliar el corpus a partir de una muestra poblacional más variada es una condición necesaria para el establecimiento de estándares que demuestren los beneficios del citado modelo teórico y su aplicación universal a la enseñanza de ELE, tal y como se discute en el apartado 6 de este artículo. 2. En el diseño de la muestra se tuvieron en cuenta, además, numerosas variables de postestratificación. La información sociológica se recogió por medio de un cuestionario individual. En él, los sujetos proporcionaron información referida a variables sociales, psicosociales y reticulares. 3. Los datos lingüísticos se recogieron según los procedimientos usuales en el ámbito de los estudios de disponibilidad: los informantes disponían de dos minutos por cada centro de interés para que escribiesen en columnas, en un folio en blanco, todas las palabras que le viniesen a la mente relacionadas con los estímulos propuestos por el encuestador. 4. Se propusieron los siguientes centros de interés: 01. El cuerpo humano; 02. La ropa; 03. Partes de la casa (sin los muebles); 04. Los muebles de la casa; 05. Alimentos; 06. Objetos colocados en la mesa para la comida; 07. La cocina y sus utensilios; 08. La escuela: muebles y materiales; 09. Calefacción, iluminación y medios de airear un recinto; 10. La ciudad; 11. El campo; 12. Medios de transporte; 13. Trabajos del campo y del jardín; 14. Los animales; 15. Juegos y distracciones; 16. Profesiones y oficios. 5. Una vez obtenidas las listas léxicas se editaron los materiales mediante unos criterios consensuados de lematización. Las bases de datos resultantes se sometieron a un proceso de análisis estadístico que proporcionó, en última instancia, las listas de disponibilidad léxica. Para ello, se utilizó un software de distribución gratuita desarrollado por la Universidad de Alcalá y el Instituto Cervantes: LexiDisp calcula la disponibilidad léxica a partir de la fórmula matemática desarrollada por López Chávez y Strassburger en 1987 y revisada en 2001. Además, los investigadores cuentan con un lugar de encuentro electrónico desde el cual se informa de las últimas novedades a quienes investigan la disponibilidad léxica o se interesan por el estado de la cuestión: http://www.dispolex.com/ [última consulta: 6 de noviembre de 2015].
4. Concepto de ‘prototipicidad’ y disponibilidad léxica Para definir el concepto de ‘léxico disponible’ necesitamos adoptar una perspectiva interdisciplinaria que integre al sistema lingüístico en el entramado complejo de la cognición humana. Cuando se actualizan listas de léxico disponible se pone en marcha una tarea cognitiva individual donde se activan diversos mecanismos del procesamiento de la información. Disciplinas como la psicolingüística, la etnolingüística o la lingüística cognitiva se convierten, así, en esenciales para captar la naturaleza de las listas de léxico disponible. De entre todas, quizás sea la psicolingüística la disciplina que más ayude a entender la esencia del léxico disponible. Sin entrar ahora en dicotomías propias del ámbito de la psicolingüística, parece haber consenso en que existen dos niveles de representación que contienen la información necesaria para actualizar las palabras asociadas a una categoría semántica: el primer nivel es el lexicón mental, concepto muy recurrente en las explicaciones que la mayor parte de los investigadores han usado para pergeñar una teoría sobre los fundamentos psicológicos de las listas de disponibilidad; el segundo nivel es la memoria semántica donde parece producirse una primera selección del material léxico. A grandes rasgos, los modelos más importantes de organización de la memoria semántica son: 1. La teoría de los rasgos o teoría descomposicional (Feature theory); 2. La teoría de las redes semánticas (Semantic networks); 3. La teoría de los prototipos (Prototypes theory); 4. Los postulados de significado (Meaning postulates). De estos cuatro modelos, los estudiosos del léxico disponible han prestado especial atención a la teoría de los prototipos (Wittgenstein 1953; Rosch 1978; Lakoff 1987). No en vano, el índice de disponibilidad es un excelente indicador del grado de prototipicidad que los vocablos poseen dentro de los centros de interés (Hernández Muñoz, Izura y Ellis, 2006). En este sentido, conviene no asociar el índice de disponibilidad a la simple naturaleza de los vocablos, pues ese índice está relacionado con la categorización conceptual colectiva. La disponibilidad de un vocablo en un centro de interés responde, esencialmente, al concepto de ‘accesibilidad’. Cada centro de interés gira en torno a un prototipo creado a partir del concepto que determina ese centro de interés. Cuando un individuo se somete al experimento de la disponibilidad, accede a su red léxica a partir del prototipo del núcleo nocional como puerta de entrada. Posteriormente, recorre la red léxica, acción que lo irá alejando progresivamente del centro del prototipo (Ejemplo 1): Ejemplo 1. Acceso y desarrollo de una red léxica individual. Sujeto 009. Centro de interés 01: El cuerpo humano cabeza, ojo, boca, nariz, oreja, mano, dedo, pie, pierna, tronco, pecho, uña, codo, hombro, rodilla, empeine, tobillo Tal y como ilustra el Ejemplo 1, la disponibilidad corresponde al concepto de ‘accesibilidad’ desde el centro de una red léxica, y cada individuo ofrece un recorrido particular de esa red. En nuestro ejemplo, el informante accede a la red léxica a través del vocablo cabeza y, en ese momento, se activa el entramado léxico. La única instrucción que reciben los informantes para confeccionar las listas de disponibilidad es que escriban todos los vocablos que les sugiera el estímulo inicial. Así, a modo de red, cada vocablo facilita la actualización de otro con el que está asociado y de esta manera continúa hasta que el hablante agota su red léxica. Según nuestra hipótesis, se podría interpretar que las listas producidas por cada informante corresponden, en su forma, a una representación del acceso a su léxico particular. Cada individuo tiene, por su propia evolución psicosocial y educativa, un léxico diferente que, no obstante y debido a factores culturales y ambientales, tiende a ser similar al del resto de los individuos de su comunidad (Hernández Muñoz 2006). Como es lógico, obtener la estructura de esta red léxica para cada sujeto es una tarea imposible, ya que se supone determinada por multitud de factores biográficos incontrolables, sin tener en cuenta el hecho de que es una estructura dinámica en continuo cambio provocado por la interacción del hablante con el
entorno. Sin embargo, a partir de las realizaciones particulares, el índice de disponibilidad puede permitirnos estimar cuantitativamente la estructura de la accesibilidad al léxico para una población en cada centro de interés. La cuantificación de esta accesibilidad es la medida del concepto de disponibilidad de cada término en ese centro de interés, una vez que se ha integrado la información proporcionada por todos los informantes. La asociación entre las palabras y su accesibilidad determina la representación de la estructura del léxico en un centro de interés. En esa representación los vocablos más próximos al prototipo del núcleo nocional mostrarán mayor valor de accesibilidad (o lo que es lo mismo, mayor índice de disponibilidad). La Tabla 1 muestra los vocablos encontrados en el centro de interés 09. Calefacción, iluminación y medios de airear un recinto con índice de disponibilidad (ID) > 0,1 y empleados por el 30 % de la muestra. Estas medidas de corte se han empleado tradicionalmente en los estudios de disponibilidad con el propósito de establecer parámetros de delimitación —evidentemente subjetivos— del léxico más relevante. Tabla 1. Vocablos con índice de disponibilidad (ID) > 0,1 y empleados por el 30 % de la muestra. 09. Calefacción, iluminación y medios de airear un recinto. VOCABLO Disponibilidad % Aparición 1. aire acondicionado 0,64306 80,556 2. ventilador 0,62193 83,333 3. lámpara 0,51540 73,611 4. bombilla 0,43327 62,500 5. estufa 0,35961 50,000 6. calefactor 0,21845 33,333 7. radiador 0,19440 26,389 8. ventana 0,17350 23,611 9. chimenea 0,16346 26,389 10. linterna 0,12765 23,611 11. vela 0,12677 25,000 12. calefacción 0,11601 16,667 13. brasero 0,10488 16,667 Como se observa, los seis vocablos empleados por más del 30% de la población estudiada (columna % Aparición) son los que alcanzan mayor índice de disponibilidad. Se confirma que los vocablos con mayor índice de disponibilidad de cada centro de interés forman la categorización conceptual colectiva del estímulo en cuestión. A medida que el índice de disponibilidad de los vocablos disminuye y, por tanto, es empleado por menor número de hablantes, los elementos léxicos se van alejando del núcleo prototípico del centro de interés. Según este planteamiento, y en función de los valores alcanzados por cada vocablo en sus correspondientes centros de interés, se pueden establecer diferentes líneas de seguridad de categorización conceptual que abarcarían, en un primer estadio, a los vocablos más próximos al núcleo prototípico del centro de interés estudiado. A medida que decrece el índice de disponibilidad, y por tanto, los vocablos se alejan del centro del estímulo, los elementos léxicos comienzan a acercarse a lo que podemos llamar ‘línea de incertidumbre’, límite a partir del cual el sujeto podría empezar a dudar incluso de si la información que está aportando corresponde exactamente al estímulo propuesto. El límite de incertidumbre es, en definitiva, el umbral a partir del cual el hablante duda acerca de si el término anotado es suficientemente compatible o no con el prototipo. La existencia de esta línea de incertidumbre queda patente cuando se observa que en las listas de disponibilidad existen patrones de reentrada cuando los informantes perciben que se alejan en exceso del núcleo prototípico comunitario. Como hemos visto en el Ejemplo 1, el recorrido por las redes léxicas asociadas a nociones concretas (centros de interés) aleja a los sujetos progresivamente de lo que se considera el centro prototípico compartido a medida que se consumen los elementos más
accesibles. Lo habitual es que un individuo vuelva a introducirse en la red en el momento que considere que se ha alejado demasiado —línea de incertidumbre— y busca un nuevo punto de entrada que vuelve a situarlo en una posición más centralizada respecto al prototipo comunitario (Ávila Muñoz y Sánchez Sáez 2010: 60-70). 4.1. La Teoría de los conjuntos difusos Uno de los principales inconvenientes a los que se enfrenta el docente en el aula de ELE es, precisamente, el que se refiere a la selección del léxico más adecuado al nivel de sus estudiantes (Schmitt 2010, Barcroft 2015). Parece necesaria la búsqueda de herramientas contrastadas para la correcta selección de este corpus léxico. El concepto matemático de ‘conjunto difuso’ (Zimmermann 2001) puede sernos de utilidad. Los conjuntos difusos son una generalización de la teoría de conjuntos en la que, en lugar de la pertenencia de los elementos, se considera la compatibilidad de estos con el concepto representado por el conjunto. Así, pueden establecerse diferentes niveles de compatibilidad entre un elemento y el conjunto respecto al que se mide esa compatibilidad, antes que la dicotomía pertenencia-no pertenencia propia de la teoría clásica de conjuntos. Este concepto de ‘compatibilidad’ se corresponde, en nuestro caso, con el concepto de ‘accesibilidad’. Lo interesante de este planteamiento no está en el propio proceso de determinación de la disponibilidad, que viene a ser una reformulación de los modelos previos y es compatible con ellos. Lo esencial es trasladar el problema a un marco matemático establecido que permite emplear las herramientas disponibles en ese marco. Ello, finalmente, facilitará la resolución de otros problemas a partir del ya planteado de la simple ordenación de los términos. Uno es solucionar definitivamente y de manera objetiva el inconveniente que supone una selección precisa del léxico que se ajuste a los diferentes niveles de aprendizaje de las lenguas extranjeras. Una de las herramientas que pone a nuestro alcance la teoría de los conjuntos difusos es la determinación del valor de compatibilidad característico del conjunto difuso, FEV (Fuzzy Expected Value) o su variación WFEV (Weighted Fuzzy Expected Value). Con su empleo podemos establecer, por un lado, un límite de caracterización de los valores de pertenencia, y, por otro, parámetros para identificar elementos ‘muy característicos’ o ‘poco característicos’. Como hemos dicho, uno de los principales inconvenientes a los que se enfrentan los estudios de disponibilidad léxica es la determinación del léxico relevante para un centro de interés. Hasta ahora ha sido habitual la discusión entre diferentes opciones que no ofrecen otra justificación que planteamientos subjetivos. Dichos planteamientos, si bien son relevantes por sí mismos, no dejan de ser discutibles por la escasa formalización en la que se basan. Gracias al modelo Fuzzy Expected Value (FEV) podemos determinar el valor característico de pertenencia en un conjunto difuso respecto a una determinada medida, que en nuestro caso será el tamaño relativo de los conjuntos de términos que superan un nivel de compatibilidad (conjuntos de corte). Este FEV es capaz de proponer un valor de pertenencia que establece un equilibrio entre el número de términos que lo supera y el propio valor. Además, si ponderamos en diferente grado la relevancia del tamaño del conjunto de corte, se pueden establecer grados de restricción en su interior que permitirían construir conceptos como ‘muy representativo’ o ‘poco representativo’. Se trata, en definitiva, de proponer una marca objetiva de corte en los niveles superiores e inferiores del conjunto difuso que no dependa directamente de la percepción subjetiva del investigador; tal marca pondría en relación directa el grado de compatibilidad de cada elemento con una valoración del conjunto de los elementos seleccionados. Este factor es el que permite parametrizar el proceso diferenciador. En Ávila Muñoz y Sánchez Sáez (2010: 59-63) se explica con detalle y paso a paso el procedimiento de construcción del modelo teórico capaz de representar al conjunto difuso que utilizamos para la discriminación del
léxico relevante en cada etapa del proceso. Este modelo ha servido para construir una herramienta informática capaz de calcular de manera automática el grado de pertenencia de un conjunto de elementos —los vocablos contenidos en las listas de disponibilidad— a un conjunto determinado —centros nocionales prototípicos compartidos por la población— Si aplicamos estos planteamientos a un ejemplo real, podremos precisar mucho mejor cuál es la composición de las zonas próximas al núcleo prototípico para, de esta manera, seleccionar los vocablos adecuados a cada etapa en el proceso de aprendizaje del ELE. Estos vocablos serían aquellos que muestren el máximo grado de compatibilidad porque, en nuestro caso, tendrían disponibilidad alta en todos los hablantes y, por tanto, son compatibles con el conjunto. En nuestro ejemplo, el modelo construido considera que de los 184 vocablos que componen el núcleo temático 01. El cuerpo humano, solo cuarenta y tres (23,4 % del total) pueden considerarse en el rango de ‘muy compatible’ con el conjunto al que representan (el cuerpo humano). El nivel de corte fue establecido de manera automática en un índice de compatibilidad de 0.18 por el modelo teórico Fuzzy Expected Value (FEV). Como se muestra en la Tabla 2, estos cuarenta y tres vocablos se organizan en seis niveles de compatibilidad y solo cuatro forman el núcleo de máxima prototipicidad: cabeza, ojo, mano, pie, es decir, el 1,64 % del conjunto con un nivel de compatibilidad del 0.88. A partir de aquí aparece el resto de niveles de corte que corresponden a las distintas zonas que, aun siendo muy compatibles con el estímulo de referencia, se van alejando progresivamente del núcleo central. Como es lógico, el inventario podría extenderse y abarcar los diferentes límites de seguridad hasta alcanzar la zona de incertidumbre límite del centro de interés. En cualquier caso, los vocablos que están organizados en la Tabla 2 resultan ser los más compatibles con el enunciado del centro de interés o, lo que es lo mismo, suponen la categorización conceptual colectiva del estímulo propuesto (conjunto de referencia). En consecuencia, son los únicos que de manera objetiva deberían seleccionarse en este núcleo nocional si quisiéramos considerar en nuestros materiales de clase la inclusión de los vocablos más accesibles a la población nativa general y, por consiguiente, más útiles y funcionales para el estudiante. Con este procedimiento de selección léxica, como vemos, evitamos trabajar con fenómenos particulares del habla individual. En este caso, el empleo de herramientas matemáticas fiables y objetivas permite centrarnos únicamente en hechos de norma compartida. Tabla 2. Representación de la categorización conceptual colectiva del prototipo. Centro de interés 01. El cuerpo humano. NIVEL 1 cabeza, ojo, mano pie NIVEL 2 dedo, brazo, nariz, boca, oreja, pierna, pelo NIVEL 3 uña NIVEL 4 cara, cuello, ceja, hombro, codo NIVEL 5 diente, espalda, rodilla, pestaña, pecho, labio, lengua, tobillo, tronco, corazón NIVEL 6 muñeca, frente, estómago, mejilla, pulmón, cráneo, barriga, cadera, hueso, culo, antebrazo, cerebro, cintura, muslo, riñón, barbilla 5. El léxico nuclear y el nivel según el Marco Común Europeo de Referencia para las Lenguas y el American Council for the Teaching of Foreign Languages Durante el año 2001, se celebró el Año Europeo de las Lenguas y se publicó el Marco Común Europeo de Referencia para las Lenguas (MCERL). Con estos acontecimientos, el Consejo de Europa puso de manifiesto la importancia que se le concedía al aprendizaje de lenguas en el
ámbito de la Unión Europea. Desde entonces, todos los estados pertenecientes se centraron en desarrollar la comunicación y la interacción entre sus ciudadanos para fomentar la movilidad, la colaboración y la comprensión mutua. Se insistía, así, en la necesidad del aprendizaje de las lenguas como medio para conseguir estos propósitos. Por otro lado, el American Council for the Teaching of Foreign Languages (ACTFL) presenta unas guías de capacitación lingüística oral donde se describen las funciones que los hablantes pueden realizar en cada uno de los niveles de habilidad lingüística establecidos. En estas guías podemos consultar el contenido, el contexto, la precisión y el tipo de discurso relacionados con las funciones en cada nivel. Si nos centramos en la labor desarrollada por el Consejo de Europa, podemos observar cómo este organismo propuso una serie de ámbitos de relevancia comunicativa que, en gran medida, se corresponden con los centros de interés que se trabajan en las investigaciones sobre disponibilidad léxica. Estos ámbitos de relevancia se escogieron con el fin de fomentar y facilitar las situaciones comunicativas reales de los estudiantes de lenguas extranjeras. La Tabla 3 muestra el alcance de esta correspondencia (Bartol Hernández 2010, 94-95). Tabla 3. Comparativa: centros de interés-temas y subtemas del Consejo de Europa. Fuente: (Bartol Hernández 2010, 95). Centros de interés. Disponibilidad léxica Temas y subtemas del Consejo de Europa 01. Partes del Cuerpo 7.1. Partes del cuerpo 02. La ropa 9.3. Ropa y moda 03. Partes de la casa 2. Vivienda 04. Los muebles de la casa 2. Vivienda 05. Comidas y bebidas 10. Comidas y bebidas 06. Objetos colocados en la mesa para la comida 10. Comidas y bebidas 07. La cocina y sus utensilios 2. Vivienda 08. La escuela 8. Educación 09. Iluminación, calefacción y medios de airear un recinto 10. La ciudad 9. Compras 11. Servicios públicos 12. Lugares 11. El campo 12. Lugares 2.8. Flora y fauna 12. Medios de transporte 5.1. Transporte público 5.2. Transporte privado 13. Trabajos del campo y el jardín 14. Animales 2.8. Flora y fauna 15. Juegos y diversiones 4. Tiempo libre, entretenimiento 16. Profesiones y oficios 1.10. Profesión, trabajo El Instituto Cervantes elaboró en 2006 su Plan Curricular (PCIC) a partir de las recomendaciones propuestas en el MCERL. Con él se pretendía concretar y desarrollar los niveles en español. El PCIC incluye, además, dos inventarios nocionales que recogen las especificaciones de contenidos relacionados con el significado basados en el enfoque nociofuncional de los años 70. Estos inventarios no solo incorporan palabras sino también unidades léxicas pluriverbales, colocaciones y expresiones idiomáticas. El primer inventario, Nociones Generales, relaciona las unidades léxicas predominantemente abstractas que un hablante puede utilizar en cualquier situación comunicativa. El segundo inventario, Nociones específicas, es más relevante para nuestros intereses. Se refiere a situaciones concretas relacionadas con un tema determinado. La consideración de los centros de interés como campos nocionales hace posible la comparación con el inventario de nociones específicas. No obstante, hemos de reconocer que la
comparación de ambos inventarios muestra que los centros de interés propuestos en los estudios clásicos de disponibilidad léxica no abarcan ni la mitad de los ámbitos propuestos en el PCIC, con lo que se plantea la necesidad de renovar y adecuar la lista de centros de interés con los que se trabaja en el ámbito de la disponibilidad léxica (Bombarelli 2005, Bartol Hernández 2010, Tomé Cornejo 2015). No obstante lo anterior, la falta de adecuación de los centros de interés a las nociones básicas referentes a la vida cotidiana presentes en el MCERL no invalida el presente estudio: una vez realizada una apropiada adaptación, la selección del léxico puede beneficiarse de la propuesta que estamos realizando, tal y como vamos a demostrar en el apartado siguiente en el que tomamos como ejemplo uno de los centros de interés usados en los estudios del léxico disponible que tiene correspondencia con uno de los propuestos en el PCIC: Alimentos. 5.1. Léxico nuclear en el Plan Curricular del Instituto Cervantes Las nociones específicas del PCIC incorporan un tema denominado Alimentación dividido, a su vez, en siete apartados: dieta y nutrición; bebida; alimentos; recetas; platos; utensilios de cocina y mesa; y restaurante. La Tabla 4 recoge el léxico más prototípico del centro de interés Alimentos organizado según los seis niveles de compatibilidad resultantes al aplicar el modelo basado en el Fuzzy Expected Value. A la derecha se señala el nivel según el MCER y, en la siguiente columna, el nivel equivalente en el ACTFGL. La última columna señala el tema específico que asigna el PCIC. Tabla 4. Nivel de referencia del léxico nuclear según el PCIC. Centro de interés 05. Alimentos. Vocablo Compatibilidad Nivel MCER ACTFGL Noción específica PCIC NIVEL 1 pan 0,958877 A1 Novice 5.3. Alimentos NIVEL 2 leche 0,803341 A1 Novice 5.2. Bebidas tomate 0,803224 A2 Lower Intermediate 5.3. Alimentos carne 0,799878 A1 Novice 5.3. Alimentos NIVEL 3 lenteja 0,692349 B1 Intermediate Mid 5.3. Alimentos patata 0,656898 A2 Lower Intermediate 5.3. Alimentos pescado 0,634333 A1 Novice 5.3. Alimentos arroz 0,610909 A2 Lower Intermediate 5.3. Alimentos garbanzo 0,606576 B1 Intermediate Mid 5.3. Alimentos huevo 0,599870 A1 Novice 5.3. Alimentos lechuga 0,588998 A2 Lower Intermediate 5.3. Alimentos NIVEL 4 pimiento 0,554343 5.3. Alimentos verdura 0,499876 A1 Novice 5.3. Alimentos cebolla 0,434353 A2 Lower Intermediate 5.3. Alimentos manzana 0,423343 A2 Lower Intermediate 5.3. Alimentos naranja 0,423230 A2 Lower Intermediate 5.3. Alimentos fruta 0,422985 A1 Novice 5.3. Alimentos aceite 0,422873 B1 Intermediate Mid 5.3. Alimentos plátano 0,419893 A2 Lower Intermediate 5.3. Alimentos queso 0,419211 A2 Lower Intermediate 5.3. Alimentos mantequilla 0,408971 A2 Lower Intermediate 5.3. Alimentos pera 0,400021 5.3. Alimentos NIVEL 5 jamón 0,399873 A2 Lower Intermediate 5.3. Alimentos melón 0,396565 5.3. Alimentos filete 0,395443 A2 Lower Intermediate 5.3. Alimentos sandía 0,389854 5.3. Alimentos azúcar 0,287899 A2 Lower Intermediate 5.3. Alimentos yogur 0,278987 A2 Lower Intermediate 5.3. Alimentos
Bombarelli, Á. 2005. La disponibilidad léxica como herramienta didáctica: una propuesta de selección del vocabulario para un nivel umbral de ELE (Memoria de Máster inédita). Salamanca: Universidad de Salamanca. Consejo de Europa. 2002. Marco común europeo de referencia para las lenguas: aprendizaje, enseñanza, evaluación. Madrid: MECD. http://cvc.cervantes.es/ensenanza/biblioteca_ele/marco/. [consulta 19 de noviembre de 2015]. Davies, M. A. 2005. Frequency Dictionary of Spanish Core Vocabulary for Learners. Abingdon: Routledge. Davies, M. A. y D. Gardner, 2009. Frequency Dictionary of Contemporary American English: Word Sketches, Collocates and Thematic Lists. Abingdon: Routledge. González Fernández, J. 2013. La disponibilidad léxica de los estudiantes turcos de español como lengua extranjera [en línea]. MarcoELE 16. Disponible en http://marcoele.com/disponibilidad-lexica-de-estudiantesturcos/ [consulta 19 de noviembre de 2015]. Gougenheim, G., R. Michéa, P. Rivenc y A. Sauvageot. 1954. L’élaboration du français élémentaire. Étude sur l’établissement d’un vocabulaire et d’une grammaire de base. París: Didier. Instituto Cervantes. 2006. Plan Curricular del Instituto Cervantes. Madrid: Biblioteca Nueva. http://cvc.cervantes.es/Ensenanza/Biblioteca_Ele/plan_curricular/default.htm. [consulta 19 de noviembre de 2015]. Lakoff, G. 1987. Women, Fire and Dangerous Things: What categories reveal about the mind. Chicago-London: The University of Chicago Press. Lonsdale, D. y Y. Le Bras, 2009. A Frequency Dictionary of French: Core Vocabulary for Leaners. Abingdon: Routledge. López Chaves, J. y C. Strassburger Frías. 1987. “Otro cálculo del índice de disponibilidad léxica”. En Presente, y perspectiva de la investigación computacional en México. Actas del IV Simposio de la Asociación Mexicana de Lingüística Aplicada. México: UNAM. Paredes García, F. 2014. “A vueltas con la selección de ‘centros de interés’ en los estudios de disponibilidad léxica: para una propuesta renovadora a propósito de la disponibilidad léxica en ELE” [en línea]. Revista Nebrija de Lingüística Aplicada a la Enseñanza de Lenguas 16. Disponible en http://www.nebrija.com/revistalinguistica/a-vueltas-con-la-seleccion-de-centros-de-interes-en-los estudiosdedisponibilidad-lexica-para-una-propuesta-renovadora-a-proposito-de-ladisponibilidad-lexica-en-ele [consulta 19 de noviembre de 2015]. Rosch, E. 1978. Principles of categorization. En Cognition and Categorization, eds. E. Rosch y B. Lloyd, 27-48. Hillsdale: Lawrence Erlbaum. Samper Padilla, J. A. 1999. “Léxico disponible y variación dialectal: datos de Puerto Rico y Gran Canaria”. En Estudios de lingüística hispánica. Homenaje a María Vaquero, eds. A. Morales, E. Forastieri, J. Cardona y H. López Morales, 550-73. San Juan de Puerto Rico: Universidad de San Juan de Puerto Rico. Sánchez-Saus Laserna, M. 2011. Bases semánticas para el estudio de los centros de interés del léxico disponible. Disponibilidad léxica de informantes extranjeros en las universidades andaluzas. (Tesis doctoral). Cádiz: Universidad de Cádiz. Disponible en http://rodin.uca.es/xmlui/handle/10498/15862 [consulta 19 de noviembre de 2015]. Schmitt, N. 2010. Researching Vocabulary: A Vocabulary Research Manual. Basingstoke: Palgrave Macmillan. Wittgenstein, L. 1953. Philosophical Investigations. Nueva York: McMillan. Zadeh, L. A. 1965. “Fuzzy sets”. Information and Control 8: 338-53. Zimmermann, H. J. 2001. Fuzzy Set Theory and its Applications, Boston: Kluwer Academic Publishers.