| revista.la@nebrija.es
| ISSN 1699-6569
| Publicación semestral
n42
Volumen 22. Número 42. Primavera 2027
Sección temática: Las lenguas de Asia Oriental en los corpus de aprendices de español y otras lenguas romances: Nuevas necesidades, nuevas herramientas
Editores de la sección temática: Nobuo Ignacio López-Sako y Cristóbal Lozano (Universidad de Granada)
Fechas importantes:
- Fecha límite para la presentación de artículos: 15 de febrero de 2027
- Notificación de revisión o aceptación: 31 de marzo de 2027
- Fecha de publicación: Abril-mayo 2027
*Se aceptarán propuestas preliminares con un resumen de 400 palabras hasta el 30 de noviembre de 2026, escribiendo al editor invitado Nobuo Ignacio López-Sako <nilsako@ugr.es>
Los corpus de aprendices se definen como colecciones de datos textuales (cuasi)naturales de aprendices de lenguas extranjeras (LE) o segundas lenguas (L2) en formato electrónico que han sido recopilados siguiendo unos criterios específicos (Granger 2017, 2024). Estos corpus comenzaron a desarrollarse a partir de los años 80 del siglo pasado partiendo de modelos de diseño aplicados a corpus de lenguas nativas (L1), dando así inicio a la disciplina de la Investigación de Corpus de Aprendices (Learner Corpus Research, LCR).
Si bien en el estudio de Adquisición de Segundas Lenguas (ASL) se han priorizado tradicionalmente los métodos experimentales (Granger, 2017, 2024; Lozano, 2021a, 2021b, 2022; Lozano y Mendikoetxea, 2013; Mendikoetxea, 2014, Myles, 2015), hoy en día los corpus de aprendices de L2 se han constituido en un referente para el estudio del aprendizaje y adquisición de LE/L2 (Granger, 2017, 2024; Lozano, 2021a, 2021b, 2022; Lozano, López-Sako y Montaño, 2026; Parodi, 2010; Rojo, 2021; Sampedro Mella, 2026). Esto se debe a la posibilidad de acceder a grandes bases de datos de lenguaje real recopilados con rigor metodológico y siguiendo estrictos criterios de diseño (Lozano, 2022; Lozano y Mendikoetxea, 2013; Sampedro Mella, 2026; Sinclair, 2005; Tracy-Ventura y Paquot, 2021; Tracy-Ventura et al., 2021). Sobre todo a partir de lo que Granger (2024) llama LCR de segunda generación, cuyo inicio data de los años 2000, la investigación basada en corpus de aprendices se ha afianzado tanto en cantidad como en diversidad de objetos de estudio (léxico, morfología, sintaxis, discurso, pragmática), combinaciones de lenguas L1-L2, tipología y diseño de corpus (longitudinales, multimodales, de desarrollo, etc.), tipología y modalidad textual (monológico vs. dialógico, escrito vs. oral, online, correos electrónicos, etc.), y métodos analíticos (p. ej., Key Word In Context, KWIC) y estadísticos utilizados (Chi-cuadrado, modelos de regresión lineal efectos mixtos, modelos Bayesianos, etc.) (vid. Granger, 2024, para una revisión exhaustiva).
Aunque los corpus de aprendices han evolucionado mucho, este auge ha estado dominado por el inglés como LE/L2. Actualmente, el 60% de los 210 corpus que aparecen en la lista de Learner Corpora Around the World (LCAW) de la Universidad Católica de Lovaina corresponden a esta lengua. Del 40% restante, el español apenas representa el 7,6% a pesar del creciente interés por el aprendizaje del español como LE/L2 (Moreno Fernández y Álvarez Mella, 2025) y ser la segunda lengua de comunicación global después del inglés (Muñoz-Basols y Fernández Muñoz, 2019). Otras lenguas de nuestro entorno tienen un índice incluso más bajo (alemán: 5,7%; francés: 5,2%; italiano: 6,7%; portugués: 1,9%).
Por otro lado, como resalta Granger (2024, p. 254), se está haciendo un esfuerzo por diversificar y ampliar el número de las L1 de los participantes en los corpus para permitir comparaciones más robustas y variadas de la interlengua (Lozano, 2021a, 2021b, Lozano, López-Sako y Montaño, 2026). Por ejemplo, el International Corpus of Learner English (ICLE) ha aumentado de once L1 diferentes en su primera versión a 26 en la tercera (Granger, 2024). El Corpus Escrito de Español L2 (CEDEL2) ha crecido exponencialmente: de dos lenguas en la versión 1 pasó a 11 en la versión 2 y 16 en la versión 3 (Lozano, López-Sako y Montaño, 2026) y el Corpus de Aprendices de Español (CAES) contiene 11 lenguas maternas en su versión 2 (Rojo y Palacios, 2022).
Sin embargo, una asignatura pendiente es la distribución geolingüística de las L1. En concreto, a pesar de que Asia Oriental está teniendo cada vez mayor importancia en el escenario global, la representatividad de las lenguas asiáticas en los corpus de español LE/L2 y otras lenguas romances es aún escasa. En el caso del español LE/L2, hasta donde sabemos, solo once corpus incluyen lenguas de Asia Oriental (para las principales, véanse Calero Hernández et al., s.f.; Campillos Llanos, 2014; Cestero Mancera y Penadés Martínez, 2009; Hincapié, 2018; Hincapié y Rubio, 2017; Lozano 2021a, 2021b, 2022; Lozano, López-Sako y Montaño, 2026; Rojo y Palacios, 2022; Valverde, 2023; Yamada et al., 2020) y su presencia en los corpus de italiano, francés y portugués es incluso más precaria.
Es necesario enfatizar la necesidad y oportunidad de potenciar el desarrollo de corpus de L1 de Asia teniendo en cuenta el auge del español LE en la región. En China, se está produciendo un importante aumento del interés por aprender español (Hidalgo Gallardo y Yang, 2020, p. 96; Zhang, 2024, p. 350) y el número de departamentos universitarios de español ha subido de 15 en 2000 a 106 en 2023 (Ministerio de Educación, Formación Profesional y Deportes de España (MEFPD), 2025, p. 139). En Japón, el número de universidades con docencia de español ha aumentado de 109 en 1985 a 228 en 2021 (Moyano López, Hiroyasu y Yamaura, 2025, p. 20) y, en Corea del Sur, se imparte en 48 institutos de bachillerato y en 33 universidades (Lumbreras Cobo y Rodríguez García, 2020, p. 127).
Ante este panorama, es crucial facilitar la labor de investigadores, docentes y diseñadores de materiales didácticos de español como LE/L2 y otras lenguas romances dotándoles de bases de datos lingüísticos y herramientas de análisis adecuados para su contexto investigador y educativo. Por tanto, el objetivo de la sección temática (Las lenguas de Asia Oriental en los corpus de aprendices de español y otras lenguas romances: Nuevas necesidades, nuevas herramientas) es dar visibilidad a trabajos de corpus en los que:
- la L1 sea(n) alguna(s) lengua(s) de Asia Oriental, como el chino, japonés y coreano;
- la L2 sea el español (o alguna otra lengua románica como el francés, italiano, portugués, etc.).
Se buscan trabajos de corte metodológico en los que se expliquen con rigor los principios de diseño del corpus en cuestión (p. ej., instrumentos de recogida de datos, variables de los aprendices y de las tareas, niveles de competencia, proceso de recogida de datos, plataforma para la recogida de datos, limpieza de datos, etc.). Asimismo, se anima a los autores a que ilustren qué fenómenos lingüísticos podrían ser investigados con dichos corpus. No se buscan contribuciones que presenten resultados de investigaciones basadas en corpus, pero se podrán incluir estudios demostrativos para ilustrar su utilidad, ya sea en el ámbito de la investigación lingüística, de la educación (p. ej., el aprendizaje basado en los datos (Data Driven Learning, DDL), diseño de materiales didácticos) o de ambos.
Las contribuciones podrán estar redactadas en cualquiera de las lenguas de publicación de esta revista.
Referencias
Campillos Llanos, L. (2014). A Spanish Oral Learner Corpus for Computer-Aided Error Analysis. Corpora, 9(2), 207–238. https://doi.org/10.3366/cor.2014.0058
Calero Hernández, M.A., et al. [en línea]. Corpus de Interlengua Española de Aprendices Sinohablantes. <https://cineas.udl.cat> [30 de julio de 2026]
Cestero Mancera, A. M. y Penadés Martínez, I. (2009). Corpus de textos escritos para el análisis de errores de aprendices de E/LE (CORANE). Universidad de Alcalá. Recuperado de: https://mele.web.uah.es/wp-content/uploads/2020/12/Cuadernillo-Corpus.pdf
Granger, S. (2017). Learner corpora in foreign language education. En S. Thorne y S. May (Eds.), Language and technology. Encyclopedia of language and education. 3rd edition (pp. 427–440). Springer. https://doi.org/10.1007/978-3-319-02237-6_33
Granger, S. (2024). From early to future learner corpus research. International Journal of Learner Corpus Research, 10(2), 247–279. https://doi.org/10.1075/ijlcr.00050.gra
Hidalgo Gallardo, M. y Yang, X. (2017). Enseñar ELE en la China continental. De un precario inicio a un prometedor futuro. En Méndez Santos, M.C. y Galindo Merino, M.M. (Eds.), Atlas de ELE. Geolingüística de la enseñanza del español en el mundo. Vol. II. Asia Oriental (pp. 89–117). EnClaveELE. Recuperado de http://www.todoele.net/atlas-ele
Hincapié, D. (2018). Corpus de Aprendientes de Español como Lengua Extranjera y Segunda Lengua (CAELE/2): el componente escrito. Forma y Función, 31(2), 129–143. https://doi.org/10.15446/fyf.v31n2.74659
Hincapié, D. y Rubio, R. (2017). Diseño y construcción del CAELE/2: Base para una planificación curricular. Hechos y Proyecciones del Lenguaje, 23(1), 42–52.
Lozano, C. (2021a). Corpus textuales de aprendices para investigar sobre la adquisición del español LE/L2. En Cruz Piñol, M. (Ed.), E-Research y español LE/L2: Investigar en la era digital (pp. 138–163). Routledge. http://doi.org/10.4324/9780429433528-9
Lozano, C. (2021b). Generative approaches. En Tracy-Ventura, N. y Paquot, M. (Eds.), The Routledge handbook of second language acquisition and corpora (pp. 213–27). Routledge.
Lozano, C. (2022). CEDEL2: Design, compilation and web interface of an online corpus for L2 Spanish acquisition research. Second Language Research, 38(4), 965–983. https://doi.org/10.1177/02676583211050522
Lozano, C., López-Sako, N.I., y Montaño, J. (2026). Aportaciones de la versión 3 del corpus CEDEL2 de español L2/LE. Variación, 3, 68–100. https://doi.org/10.30827/3020.9854rvcl.3.2026.36933
Lozano, C. y Mendikoetxea, A. (2013). Learner corpora and second language acquisition: The design and collection of CEDEL2. En Díaz-Negrillo, A., Ballier, N. y Thompson, P. (Eds.), Automatic treatment and analysis of learner corpus data (pp. 65–100). John Benjamins. https://doi.org/10.1075/scl.59.06loz
Lumbreras Cobo, D. y Rodríguez García, O. (2017). Enseñar ELE en Corea del Sur. En Méndez Santos, M.C. y Galindo Merino, M.M. (Eds.), Atlas de ELE. Geolingüística de la enseñanza del español en el mundo. Vol. II. Asia Oriental (pp. 119–147). EnClaveELE. Recuperado de http://www.todoele.net/atlas-ele
Mendikoetxea, A. (2014). Corpus-based Research in Second Language Spanish. En Geeslin, K.L. (Ed.), The Handbook of Spanish Second Language Acquisition (pp. 11–29). Wiley & Blackwell.
Ministerio de Educación, Formación Profesional y Deportes (2025). El mundo estudia español 2024. Unidad de Acción Educativa Exterior
Moreno Fernández, F. y Álvarez Mella, H. (2025). Demografía del español en el mundo 2025. En El español en el mundo. Anuario del Instituto Cervantes 2025 (pp. 30–112). Instituto Cervantes. Recuperado de https://cvc.cervantes.es/lengua/anuario/anuario_25/el_espanol_en_el_mundo_anuario_instituto_cervantes_2025.pdf
Moyano López, J.C., Hiroyasu, Y. y Yamaura, A. (2025). La enseñanza del español en las universidades japonesas. Observatorio Global del Español. Instituto Cervantes. Recuperado de https://cervantes.org/es/sobre-nosotros/publicaciones/ensenanza-espanol-universidades-japonesas
Muñoz-Basols, J. y Hernández Muñoz, N. (2019). El español en la era global: agentes y voces de la polifonía panhispánica. Journal of Spanish Language Teaching, 6(2), 79–95. https://doi.org/10.1080/23247797.2020.1752019
Myles, F. (2015). Second Language Acquisition Theory and Learner Corpus Research. En Granger, S., Gilquin, S. y Meunier, F. (Eds.), The Cambridge Handbook of Learner Corpus Research (pp. 309–332). Cambridge University Press.
Parodi, G. (2010). Lingüística de corpus: de la teoría a la empiria. Iberoamericana.
Rojo, G. (2021). Introducción a la lingüística de corpus en español. Routledge.
Rojo, G. y Palacios, I. (2022). CAES (Corpus de Aprendices de Español) (v. 2.1). http://galvan.usc.es/caes
Sampedro Mella, M. (2026). Los corpus y la lingüística del corpus del español: desarrollos recientes. Variación, 3, 4–12. https://doi.org/10.30827/3020.9854rvcl.3.2026.37868
Sinclair, J. (2005). How to build a corpus. En M. Wynne (Ed.), Developing linguistic corpora: A guide to good practice (pp. 79–83). Oxbow Books.
Tracy-Ventura, N. y Paquot, M. (2021). Second Language Acquisition and Corpora. An overview. En Tracy-Ventura, N. y Paquot, M. (Eds.), The Routledge handbook of second language acquisition and corpora (pp. 1–8). Routledge.
Tracy-Ventura, N., Paquot, M. y Myles, F. (2021). The future of corpora in SLA. En Tracy-Ventura, N. y Paquot, M. (Eds.), The Routledge handbook of second language acquisition and corpora (pp. 409–424). Routledge.
Valverde, P. (2023). El corpus de aprendices japoneses CELEN y su aplicación a la docencia y la investigación en ELE. TEISEL: Tecnologías para la Investigación en Segundas Lenguas, 3, Artículo e-a_hr01, 1–31. http://doi.org/10.1344/teisel.v3.42898
Yamada, A., Davidson, S., Fernández-Mira, P., Carando, A., Sagae, K. y Sánchez-Gutiérrez, C. (2020). COWS-L2H: A corpus of Spanish learner writing. Research in Corpus Linguistics, 8(1), 17–32. https://doi.org/10.32714/ricl.08.01.02
Zhang, Q. (2024). Análisis del sistema educativo para la enseñanza del español como lengua extranjera en China. Del Español. Revista de Lengua, 2, 349–369. https://doi.org/10.33776/dlesp.v2.8046