Contribuíndo ao avance das Humanidades Dixitais: Recursos para o estudo do inglés histórico e contemporáneo
Authors/Creators
Description
O grupo de investigación Variación, Cambio Lingüístico e Gramaticalización (VLCG, polas súas siglas en inglés), fundado en 1991 por Teresa Fanego, centra a súa atención no estudo do cambio e a variación lingüística nos niveis morfosintáctico, semántico e pragmático-discursivo dende o punto de vista diacrónico, diatópico e contrastivo. Na súa actividade investigadora, o grupo adopta unha perspectiva eminentemente variacionista, empregando a metodoloxía da lingüística de corpus e a aproximación teórica dos estudos de gramaticalización, a Lingüística Cognitiva e a Gramática de Construcións. Os membros do grupo VLCG contan, ademais, cunha dilatada traxectoria na compilación de corpus computarizados.
Nesta comunicación en formato póster presentaremos as características máis relevantes dos corpus compilados polo grupo VLCG para o estudo do inglés histórico e contemporáneo.
Catro son os recursos elaborados polo grupo para a análise diacrónica da lingua inglesa:
- CHELAR (Corpus of Historical English Law Reports 1535-1999). Trátase dun corpus de ditames xudiciais británicos emitidos desde principios do século XVI ata finais do século XX. O corpus, que contén 500.000 palabras, está dispoñible en dúas versións: texto cru e texto con etiquetado morfolóxico.
- ARCHER (A Representative Corpus of Historical English Registers). Compilado por un consorcio internacional de 14 universidades europeas e norteamericanas, na súa última versión (ARCHER 3.2) o corpus contén 3,3 millóns de palabras de inglés británico e americano do período 1600-1999 pertencentes a unha variedade de rexistros textuais. O grupo VLCG foi o responsable da compilación dos textos legais do corpus.
- COLMOBAENG (A Corpus of Late Modern British and American English Prose). O corpus, de 1.170.000 palabras, inclúe textos de ficción e non ficción dos séculos XVIII e XIX tanto de inglés británico como de inglés americano.
- BSNC (British Sentimental Novel Corpus). Extraído de 114 novelas de 11 novelistas canónicos do século XIX, entre eles Jane Austen, Mary Shelley, Walter Scott e Charles Dickens, o corpus contén 21 millóns de palabras.
A estes recursos diacrónicos súmanse dous corpus sincrónicos de carácter pedagóxico:
- TTT (Toledo Teachers Trainees Corpus). Trátase dun corpus de 170.000 palabras que reúne datos de 354 estudantes universitarios de Formación do Profesorado relativos á súa percepción acerca do proceso de aprendizaxe de linguas (profesorado, materiais, contidos, metodoloxías e avaliación).
- PELEC (Primary Education Learners’ English Corpus). Corpus de aprendices de inglés con datos de 252 estudantes de 4º e 6º de Educación Primaria de centros públicos na Comunidade Autónoma de Cantabria, tanto de colexios adheridos a programas de Aprendizaxe Integrada de Contidos en Lingua Estranxeira (AICLE) como de centros que non ofertaban programas AICLE. O corpus contén datos orais e escritos que suman un total de 61.609 palabras.
Dada a súa amplitude temática e a súa extensa cobertura temporal e textual, os corpus compilados nos últimos anos polo grupo VLCG representan unha contribución relevante ao desenvolvemento das Humanidades Dixitais e proporcionan á comunidade científica unha ferramenta de enorme potencial que permite obter un maior e mellor coñecemento da lingua inglesa histórica e contemporánea.
Referencias bibliográficas:
ARCHER-X = A Representative Corpus of Historical English Registers version X. 1990–1993/2002/2007/2010/2013/2016. Originally compiled under the supervision of Douglas Biber and Edward Finegan at Northern Arizona University and University of Southern California; modified and expanded by subsequent members of a consortium of universities. Current member universities are Bamberg, Freiburg, Heidelberg, Helsinki, Lancaster, Leicester, Manchester, Michigan, Northern Arizona, Santiago de Compostela, Southern California, Trier, Uppsala, Zurich.
Blanco-Suárez, Zeltia, Francisco Gallardo del Puerto e Evelyn Gandón-Chapela. 2020. The Primary Education Learners' English Corpus (PELEC): Design and compilation. Research in Corpus Linguistics 8(1): 147-163.
BSNC = Bouso, Tamara e Pablo Ruano San Segundo. 2024, compiladores. British Sentimental Novel Corpus. ISBN 978-84-09-60357-2.
CHELAR = Corpus of Historical English Law Reports 1535–1999. 2016. Compiled by Paula Rodríguez-Puente, Teresa Fanego (Project Director), María José López-Couso, Belén Méndez-Naya, Paloma Núñez-Pertejo. Santiago de Compostela: Research Unit for Variation, Linguistic Change and Grammaticalization, University of Santiago de Compostela.
Fanego, Teresa. 2012. COLMOBAENG: A Corpus of Late Modern British and American English Prose. En Nila Vázquez (ed.), Creation and use of historical English corpora in Spain, 101-117. Newcastle upon Tyne: Cambridge Scholars Publishing.
Fanego, Teresa, Paula Rodríguez-Puente, María José López-Couso, Belén Méndez-Naya, Paloma Núñez-Pertejo, Cristina Blanco-García e Iván Tamaredo. 2017. The Corpus of Historical English Law Reports 1535-1999 (CHELAR): A resource for analysing the development of English legal discourse. ICAME Journal 41: 53-82.
Faya, Fátima e Gema Alcaraz Mármol. 2020. The Toledo Teachers Trainees (TTT) Corpus: Bridging the gap between students' narratives and corpus linguistics. Research in Corpus Linguistics 8(1): 164-177.
López-Couso, María José e Belén Méndez-Naya. 2012. Compiling British English legal texts: A contribution to ARCHER. En Nila Vázquez González (ed.), Creation and use of historical English corpora in Spain, 5-19. Newcastle upon Tyne: Cambridge Scholars Publishing.
Files
II_XEIRA_CLARIAH_GAL_Lopez_couso_et_al.pdf
Files
(6.2 MB)
| Name | Size | Download all |
|---|---|---|
|
md5:a6cb67956bbb89905898b8a8105ffddc
|
6.2 MB | Preview Download |
Additional details
Funding
- Ministerio de Ciencia, Innovación y Universidades
- PID2023-146887NB-I00
- Xunta de Galicia
- ED431B 2023/03