Pequeños grandes corpus y diacronía del español
Aspectos metodológicos y aplicaciones
Summary
Excerpt
Table Of Contents
- Cubierta
- Página de título
- Page de droits d’auteur
- Dedicación
- Índice de contenidos
- Índice de figuras
- Índice de tablas
- Presentación
- Capítulo 1 Panorama general de los corpus del español
- 1.1 La lingüística de corpus en la era digital
- 1.2 Tipos y enfoques de los corpus lingüísticos
- 1.3 Principales corpus del español contemporáneo
- 1.4 Corpus históricos: consideraciones generales
- 1.5 Corpus históricos de referencia
- 1.6 Corpus históricos especializados
- Capítulo 2 Post Scriptum y ODE aspectos metodológicos
- 2.1 Antecedentes y consideraciones generales
- 2.2 Selección de documentos
- 2.2.1 Lo oral en lo escrito: consideraciones generales
- 2.2.2 La oralidad en los corpus diacrónicos
- 2.2.3 Las cartas privadas de PS-ES
- 2.2.4 La documentación oralizante de ODE
- 2.3 Control de metadatos
- 2.3.1 Los metadatos en los corpus históricos
- 2.3.2 Metadatos y codificación del corpus PS-ES: un enfoque multidisciplinar
- 2.3.3 Metadatos y codificación del corpus ODE: una orientación dialectológica
- 2.4 Criterios de edición
- 2.4.1 El uso de ediciones modernas en los corpus históricos
- 2.4.2 Los criterios de edición en PS-ES y ODE
- 2.5 Representación del manuscrito
- 2.5.1 La importancia de la presentación visual del texto
- 2.5.2 Corpus basados en el estándar XML-TEI
- 2.6 Normalización ortográfica
- 2.6.1 La variación gráfica en los textos históricos
- 2.6.2 Beneficios de la normalización ortográfica
- 2.6.2.1 Ventajas en la legibilidad del texto
- 2.6.2.2 Ventajas en la explotación del corpus
- 2.6.2.3 Ventajas en el procesamiento automático
- 2.6.2.4 Ventajas en el análisis contrastivo
- 2.6.3 Estrategia de implementación en PS-ES y ODE
- 2.6.3.1 La plataforma web TEITOK
- 2.6.3.2 Tokenización y normalización ortográfica en TEITOK
- 2.7 Anotación lingüística
- 2.7.1 Alcance y delimitación del concepto de anotación
- 2.7.2 La lematización y la etiquetación gramatical
- 2.7.2.1 La anotación gramatical en los corpus históricos de referencia
- 2.7.2.2 La anotación gramatical en PS-ES y ODE
- 2.7.3 Otros niveles de anotación lingüística
- 2.7.3.1 Las notas lingüísticas de PS-ES
- 2.7.3.2 Las capas de anotación adicional en ODE
- 2.8 Construcción de consultas
- 2.8.1 Principios generales de la consulta en corpus
- 2.8.2 El lenguaje CQL: principios básicos
- 2.8.3 Uso del lenguaje CQL en PS-ES y ODE
- 2.8.4 Consultas con lenguaje XPath
- 2.9 Visualización de resultados
- 2.9.1 El carácter dual: edición digital y corpus lingüístico
- 2.9.2 La edición digital: opciones de visualización
- 2.9.2.1 Modo de visualización general
- 2.9.2.2 Modos de visualización complementarios
- 2.9.3 El corpus lingüístico: presentación de resultados
- 2.9.3.1 Listados de documentos
- 2.9.3.2 Listados de ejemplos
- 2.9.3.3 Listados de frecuencias
- 2.9.3.4 Visualizaciones alternativas
- Capítulo 3 Tres estudios de caso
- 3.1 Nivel gráfico-fonético: el seseo
- 3.1.1 Descripción del fenómeno y objetivos
- 3.1.2 Anotación y extracción de datos
- 3.1.3 Análisis y discusión de resultados
- 3.2 Nivel morfo-sintáctico: el laísmo
- 3.2.1 Descripción del fenómeno y objetivos
- 3.2.2 Anotación y extracción de datos
- 3.2.3 Análisis y discusión de resultados
- 3.3 Nivel léxico-semántico: telas y tejidos
- 3.3.1 Descripción del fenómeno y objetivos
- 3.3.2 Anotación y extracción de datos
- 3.3.3 Análisis y discusión de resultados
- Referencias bibliográficas
Índice de figuras
Figura 1: Principios constitutivos de PS-ES y ODE
Figura 2: Los proyectos de investigación CARDS, FLY y PS
Figura 3: Los corpus CORDEREGRA y ODE
Figura 4: Principios constitutivos y aspectos metodológicos de PS-ES y ODE
Figura 5: Ejemplo simplificado de codificación de encabezado en PS-ES
Figura 6: Ejemplo de codificación de perfil biográfico en PS-ES: MS7
Figura 7: Ejemplo de codificación de perfil biográfico en PS-ES: ACN1
Figura 8: Cobertura geográfica peninsular del corpus PS-ES
Figura 9: Ejemplo simplificado de codificación de encabezado en ODE
Figura 10: Cobertura geográfica de ODE
Figura 11: Cobertura geográfica peninsular de PS-ES + ODE
Figura 12: Facsímil de la BDH (hezistes) y edición del CORDE (heziste)
Figura 13: Facsímil de la BDH (rescatalla) y edición del CORDE (rescatarla)
Figura 14: Facsímil de la BDH (obidiente) y edición del CORDE (obediente)
Figura 15: Regularización de la frontera de palabra en PS-ES
Figura 16: Intervención escritural en la forma aconsejada
Figura 17: Intervención escritural en la expresión convencer que
Figura 18: Intervención escritural en la forma calcañarejo
Figura 19: Intervención escritural en la forma fazenerosso
Figura 20: Lectura dudosa del pronombre clítico la
Figura 21: Ejemplo de marcación en XML-TEI: cancelación
Figura 22: Ejemplo de marcación en XML-TEI: adición
Figura 23: Ejemplo de marcación en XML-TEI: sustitución
Figura 24: Ejemplo de marcación en XML-TEI: conjetura del editor
Figura 25: Ejemplo de vacilación ortográfica: forma voluntad
Figura 26: Ejemplo de vacilación ortográfica: forma salud
Figura 27: Principios constitutivos y aspectos metodológicos de PS-ES y ODE (reproducción de la Figura 4)
Figura 28: Transcripción y tokenización en TEITOK
Figura 29: Transcripción y tokenización en TEITOK: atributo @form
Figura 30: Transcripción y tokenización en TEITOK: atributo @fform
Figura 31: Normalización ortográfica en TEITOK
Figura 32: Normalización ortográfica en TEITOK: atributos @form y @nform
Figura 33: Normalización ortográfica en TEITOK: atributos @form, @fform y @nform
Figura 34: Flujo de trabajo en PS-ES y ODE: de la marcación a la anotación lingüística
Figura 35: Herencia jerárquica de atributos dentro de <tok>
Figura 36: Lematización y etiquetación gramatical en TEITOK
Figura 37: Palabra gramatical en TEITOK: elemento <dtok>
Figura 38: Ejemplo de anotación con @ltags
Figura 39: Ejemplo de doble anotación con @ltags: forma hausiencia
Figura 40: Dato de entrada no abreviado para ser anotado con el atributo @phtags
Figura 41: Dato de entrada abreviado para ser anotado con el atributo @phtags
Figura 42: Ejemplo de anotación gráfico-fonética: forma vesino
Figura 43: Fragmento del archivo dle_2014.xml usado para la creación de lemarios en ODE
Figura 44: Ejemplo de anotación con @stags
Figura 45: Ejemplo de anotación con @etags
Figura 46: Anotación de la forma alcarrasa
Figura 47: Anotación de la forma moselina
Figura 48: Anotación de la forma xolla
Figura 49: Anotación de la forma carsones
Figura 50: Anotación de la forma seaso
Figura 51: Anotación de la forma balseletes
Figura 52: Anotación del lema alepín
Figura 53: Esquema general de funcionamiento de una consulta en CQL
Figura 54: Ejemplo de cancelación (<del>) en el interior de palabra
Figura 55: Ejemplo de cancelación (<del>) de una palabra
Figura 56: Ejemplo de cancelación (<del>) de una secuencia de palabras
Figura 57: Ejemplo de presentación de la edición digital en PS-ES
Figura 58: Ejemplo de presentación de la edición digital en ODE
Figura 59: Ejemplo de visualización completa de metadatos en PS-ES
Figura 60: Fragmento con transcripción original (izquierda) y normalización (derecha) en ODE
Figura 61: Fragmento con transcripción original (izquierda) y facsímil (derecha) en PS-ES
Figura 62: Visualización de la información lingüística asociada a cada token en ODE
Figura 63: Modo de visualización Pageflow en PS-ES
Figura 64: Nube de palabras en ODE: formas transcritas
Figura 65: Nube de palabras en ODE: formas lematizadas
Figura 66: Ejemplo de listado de documentos en PS-ES
Figura 67: Ejemplo de listado de documentos en ODE
Figura 68: Ejemplo de concordancias en PS-ES
Figura 69: Ejemplo de concordancias con marcación XML-TEI en PS-ES
Figura 70: Ejemplo de concordancias con marcación XML-TEI en ODE
Figura 71: Nube de palabras a partir de las formas seseantes de ODE
Figura 72: Nube de palabras a partir de los lemas nominales en cartas de amor de PS-ES
Figura 73: Mapa de ocurrencias laístas en PS-ES
Figura 74: Mapa de ocurrencias de los diminutivos -ito e -ico en ODE
Figura 75: Concentración de casos de seseo por provincia
Figura 76: Mapa dialectal del laísmo contemporáneo
Figura 77: Mapa dialectal del laísmo según la procedencia de los autores (siglos XVI-XIX)
Figura 78: Laísmo: caso de lectura paleográfica dudosa
Figura 79: Laísmo: caso de ambigüedad interpretativa
Figura 80: Mapa de autores laístas en zona distinguidora (siglos XVI-XIX)
Figura 81: Representación gráfica de la incorporación y crecimiento acumulado del léxico textil
Índice de tablas
Tabla 1: Algunos corpus del español contemporáneo y volumen textual
Tabla 2: Número de palabras por siglo en CORDE, CdEhist y CDH
Tabla 3: Algunos corpus históricos especializados del español
Tabla 4: Número de palabras por siglo en PS-ES y ODE
Tabla 5: Tipos textuales según su relación con lo oral (Culpeper y Kytö 2010)
Tabla 6: Tipos textuales según su relación con lo oral (Schneider 2013)
Tabla 7: Archivos consultados y número de cartas localizadas para el corpus PS-ES
Tabla 8: Tasa de éxito en la localización de correspondencia privada en fondos judiciales
Tabla 9: Archivos consultados y número de documentos localizados para el corpus ODE
Tabla 10: Principales metadatos codificados en PS-ES
Tabla 11: Alcance sociodialectal de autores en PS-ES
Tabla 12: Distribución de autores y cartas según estatus social en PS-ES
Tabla 13: Tabla comparativa: metadatos principales en PS-ES y ODE
Tabla 14: Textos seleccionados para la comparación entre facsímil y edición del CORDE
Tabla 15: Comparación de criterios editoriales en la conservación de grafías
Tabla 16: Elementos XML-TEI principales usados dentro de <text> en PS-ES y ODE
Tabla 17: Variantes ortográficas de la forma vecino en ODE
Tabla 18: Variantes ortográficas de la forma muselina en ODE
Tabla 19: Variantes ortográficas de la forma diligencia en PS-ES
Tabla 20: Criterios de normalización aplicados a formas no biunívocas en PS-ES y ODE
Tabla 21: Ejemplos de etiquetación gramatical según el esquema EAGLES
Tabla 22: Las notas lingüística en PS-ES: atributo @ltags
Tabla 23: Subtipos de anotación gráfico-fonética en ODE: atributo @phtags
Tabla 24: Subtipos de anotación semántica en ODE: atributo @stags
Tabla 25: Equivalencias gráfico-fonéticas para la anotación automática de @phtags
Tabla 26: Resumen cuantitativo de la anotación adicional en ODE
Details
- Pages
- XX, 276
- Publication Year
- 2026
- ISBN (PDF)
- 9783034366939
- ISBN (ePUB)
- 9783034366946
- ISBN (Softcover)
- 9783034366922
- DOI
- 10.3726/b23814
- Language
- Spanish; Castilian
- Publication date
- 2026 (September)
- Keywords
- lingüística de corpus lingüística histórica humanidades digitales español clásico español moderno Edad Moderna patrimonio documental construcción de corpus corpus especializados
- Published
- Lausanne, Berlin, Bruxelles, Chennai, New York, Oxford, 2026. xx, 276 p., 81 il. blanco/negro, 60 tablas.
- Product Safety
- Peter Lang Group AG