El Corpus Lancaster-Oslo/Bergen ( LOB ) es una colección de un millón de palabras de textos en inglés británico que se compiló en la década de 1970 en colaboración entre la Universidad de Lancaster , la Universidad de Oslo y el Centro Noruego de Computación para las Humanidades , Bergen , para proporcionar una contraparte británica al Corpus Brown compilado por Henry Kučera y W. Nelson Francis para el inglés americano en la década de 1960. [ 1 ]
Su composición fue diseñada para coincidir lo más posible con el corpus original de Brown en términos de tamaño y géneros, utilizando documentos publicados en el Reino Unido en 1961 por autores británicos. [ 2 ] Ambos corpus constan de 500 muestras, cada una con aproximadamente 2000 palabras, en los siguientes géneros:
Los principales compiladores del corpus LOB fueron Geoffrey Leech (Universidad de Lancaster) y Stig Johansson (Universidad de Oslo); véase Leech y Johansson (2009). [ 3 ]
El corpus también ha sido etiquetado , es decir, se han asignado categorías de partes de la oración a cada palabra. [ 1 ]
Referencias
Enlaces externos
- Stig, Johansson, Geoffrey N. Leech y Helen Goodluck. " Manual de información para acompañar el Corpus de inglés británico Lancaster-Oslo: Bergen, para uso con ordenadores digitales " Departamento de Inglés, Universidad de Oslo, (1978).
- Corpus LOB del Archivo de Textos de Oxford
- Establecimientos de la década de 1970 en el Reino Unido
- Establecimientos de la década de 1970 en Noruega
- obras de la década de 1970
- Universidad de Lancaster
- Universidad de Oslo
- corpus en inglés
- Investigación lingüística
- Lingüística aplicada
- Cuerpos
- esbozos de lingüística de corpus
- Esbozos de bibliotecología y ciencias de la información
- Fragmentos del idioma inglés