Loading...

Pequeños grandes corpus y diacronía del español

Aspectos metodológicos y aplicaciones

by Gael Vaamonde (Author)
©2026 Monographs XX, 276 Pages

Summary

Este libro aborda diversos aspectos metodológicos relacionados con la construcción y explotación de corpus históricos para el estudio diacrónico del español, con especial atención al valor de los corpus de pequeño tamaño. A partir de la experiencia acumulada por el autor en los proyectos P. S. Post Scriptum y Oralia Diacrónica del Español, el volumen examina los principales retos que plantea la creación de este tipo de recursos digitales, desde la selección y edición de documentos hasta su codificación, normalización ortográfica, anotación lingüística y explotación mediante sistemas de consulta. Desde una perspectiva que integra métodos filológicos con herramientas propias de la lingüística de corpus y de las humanidades digitales, el libro pone de relieve el potencial analítico de corpus especializados para el estudio histórico de la lengua. Estas cuestiones se complementan con varios estudios de caso dedicados al análisis de fenómenos gráfico-fonéticos, morfosintácticos y léxico-semánticos en documentación no literaria de la Edad Moderna.

Table Of Contents

  • Cubierta
  • Página de título
  • Page de droits d’auteur
  • Dedicación
  • Índice de contenidos
  • Índice de figuras
  • Índice de tablas
  • Presentación
  • Capítulo 1 Panorama general de los corpus del español
  • 1.1 La lingüística de corpus en la era digital
  • 1.2 Tipos y enfoques de los corpus lingüísticos
  • 1.3 Principales corpus del español contemporáneo
  • 1.4 Corpus históricos: consideraciones generales
  • 1.5 Corpus históricos de referencia
  • 1.6 Corpus históricos especializados
  • Capítulo 2 Post Scriptum y ODE aspectos metodológicos
  • 2.1 Antecedentes y consideraciones generales
  • 2.2 Selección de documentos
  • 2.2.1 Lo oral en lo escrito: consideraciones generales
  • 2.2.2 La oralidad en los corpus diacrónicos
  • 2.2.3 Las cartas privadas de PS-ES
  • 2.2.4 La documentación oralizante de ODE
  • 2.3 Control de metadatos
  • 2.3.1 Los metadatos en los corpus históricos
  • 2.3.2 Metadatos y codificación del corpus PS-ES: un enfoque multidisciplinar
  • 2.3.3 Metadatos y codificación del corpus ODE: una orientación dialectológica
  • 2.4 Criterios de edición
  • 2.4.1 El uso de ediciones modernas en los corpus históricos
  • 2.4.2 Los criterios de edición en PS-ES y ODE
  • 2.5 Representación del manuscrito
  • 2.5.1 La importancia de la presentación visual del texto
  • 2.5.2 Corpus basados en el estándar XML-TEI
  • 2.6 Normalización ortográfica
  • 2.6.1 La variación gráfica en los textos históricos
  • 2.6.2 Beneficios de la normalización ortográfica
  • 2.6.2.1 Ventajas en la legibilidad del texto
  • 2.6.2.2 Ventajas en la explotación del corpus
  • 2.6.2.3 Ventajas en el procesamiento automático
  • 2.6.2.4 Ventajas en el análisis contrastivo
  • 2.6.3 Estrategia de implementación en PS-ES y ODE
  • 2.6.3.1 La plataforma web TEITOK
  • 2.6.3.2 Tokenización y normalización ortográfica en TEITOK
  • 2.7 Anotación lingüística
  • 2.7.1 Alcance y delimitación del concepto de anotación
  • 2.7.2 La lematización y la etiquetación gramatical
  • 2.7.2.1 La anotación gramatical en los corpus históricos de referencia
  • 2.7.2.2 La anotación gramatical en PS-ES y ODE
  • 2.7.3 Otros niveles de anotación lingüística
  • 2.7.3.1 Las notas lingüísticas de PS-ES
  • 2.7.3.2 Las capas de anotación adicional en ODE
  • 2.8 Construcción de consultas
  • 2.8.1 Principios generales de la consulta en corpus
  • 2.8.2 El lenguaje CQL: principios básicos
  • 2.8.3 Uso del lenguaje CQL en PS-ES y ODE
  • 2.8.4 Consultas con lenguaje XPath
  • 2.9 Visualización de resultados
  • 2.9.1 El carácter dual: edición digital y corpus lingüístico
  • 2.9.2 La edición digital: opciones de visualización
  • 2.9.2.1 Modo de visualización general
  • 2.9.2.2 Modos de visualización complementarios
  • 2.9.3 El corpus lingüístico: presentación de resultados
  • 2.9.3.1 Listados de documentos
  • 2.9.3.2 Listados de ejemplos
  • 2.9.3.3 Listados de frecuencias
  • 2.9.3.4 Visualizaciones alternativas
  • Capítulo 3 Tres estudios de caso
  • 3.1 Nivel gráfico-fonético: el seseo
  • 3.1.1 Descripción del fenómeno y objetivos
  • 3.1.2 Anotación y extracción de datos
  • 3.1.3 Análisis y discusión de resultados
  • 3.2 Nivel morfo-sintáctico: el laísmo
  • 3.2.1 Descripción del fenómeno y objetivos
  • 3.2.2 Anotación y extracción de datos
  • 3.2.3 Análisis y discusión de resultados
  • 3.3 Nivel léxico-semántico: telas y tejidos
  • 3.3.1 Descripción del fenómeno y objetivos
  • 3.3.2 Anotación y extracción de datos
  • 3.3.3 Análisis y discusión de resultados
  • Referencias bibliográficas

Índice de figuras

Figura 1: Principios constitutivos de PS-ES y ODE

Figura 2: Los proyectos de investigación CARDS, FLY y PS

Figura 3: Los corpus CORDEREGRA y ODE

Figura 4: Principios constitutivos y aspectos metodológicos de PS-ES y ODE

Figura 5: Ejemplo simplificado de codificación de encabezado en PS-ES

Figura 6: Ejemplo de codificación de perfil biográfico en PS-ES: MS7

Figura 7: Ejemplo de codificación de perfil biográfico en PS-ES: ACN1

Figura 8: Cobertura geográfica peninsular del corpus PS-ES

Figura 9: Ejemplo simplificado de codificación de encabezado en ODE

Figura 10: Cobertura geográfica de ODE

Figura 11: Cobertura geográfica peninsular de PS-ES + ODE

Figura 12: Facsímil de la BDH (hezistes) y edición del CORDE (heziste)

Figura 13: Facsímil de la BDH (rescatalla) y edición del CORDE (rescatarla)

Figura 14: Facsímil de la BDH (obidiente) y edición del CORDE (obediente)

Figura 15: Regularización de la frontera de palabra en PS-ES

Figura 16: Intervención escritural en la forma aconsejada

Figura 17: Intervención escritural en la expresión convencer que

Figura 18: Intervención escritural en la forma calcañarejo

Figura 19: Intervención escritural en la forma fazenerosso

Figura 20: Lectura dudosa del pronombre clítico la

Figura 21: Ejemplo de marcación en XML-TEI: cancelación

Figura 22: Ejemplo de marcación en XML-TEI: adición

Figura 23: Ejemplo de marcación en XML-TEI: sustitución

Figura 24: Ejemplo de marcación en XML-TEI: conjetura del editor

Figura 25: Ejemplo de vacilación ortográfica: forma voluntad

Figura 26: Ejemplo de vacilación ortográfica: forma salud

Figura 27: Principios constitutivos y aspectos metodológicos de PS-ES y ODE (reproducción de la Figura 4)

Figura 28: Transcripción y tokenización en TEITOK

Figura 29: Transcripción y tokenización en TEITOK: atributo @form

Figura 30: Transcripción y tokenización en TEITOK: atributo @fform

Figura 31: Normalización ortográfica en TEITOK

Figura 32: Normalización ortográfica en TEITOK: atributos @form y @nform

Figura 33: Normalización ortográfica en TEITOK: atributos @form, @fform y @nform

Figura 34: Flujo de trabajo en PS-ES y ODE: de la marcación a la anotación lingüística

Figura 35: Herencia jerárquica de atributos dentro de <tok>

Figura 36: Lematización y etiquetación gramatical en TEITOK

Figura 37: Palabra gramatical en TEITOK: elemento <dtok>

Figura 38: Ejemplo de anotación con @ltags

Figura 39: Ejemplo de doble anotación con @ltags: forma hausiencia

Figura 40: Dato de entrada no abreviado para ser anotado con el atributo @phtags

Figura 41: Dato de entrada abreviado para ser anotado con el atributo @phtags

Figura 42: Ejemplo de anotación gráfico-fonética: forma vesino

Figura 43: Fragmento del archivo dle_2014.xml usado para la creación de lemarios en ODE

Figura 44: Ejemplo de anotación con @stags

Figura 45: Ejemplo de anotación con @etags

Figura 46: Anotación de la forma alcarrasa

Figura 47: Anotación de la forma moselina

Figura 48: Anotación de la forma xolla

Figura 49: Anotación de la forma carsones

Figura 50: Anotación de la forma seaso

Figura 51: Anotación de la forma balseletes

Figura 52: Anotación del lema alepín

Figura 53: Esquema general de funcionamiento de una consulta en CQL

Figura 54: Ejemplo de cancelación (<del>) en el interior de palabra

Figura 55: Ejemplo de cancelación (<del>) de una palabra

Figura 56: Ejemplo de cancelación (<del>) de una secuencia de palabras

Figura 57: Ejemplo de presentación de la edición digital en PS-ES

Figura 58: Ejemplo de presentación de la edición digital en ODE

Figura 59: Ejemplo de visualización completa de metadatos en PS-ES

Figura 60: Fragmento con transcripción original (izquierda) y normalización (derecha) en ODE

Figura 61: Fragmento con transcripción original (izquierda) y facsímil (derecha) en PS-ES

Figura 62: Visualización de la información lingüística asociada a cada token en ODE

Figura 63: Modo de visualización Pageflow en PS-ES

Figura 64: Nube de palabras en ODE: formas transcritas

Figura 65: Nube de palabras en ODE: formas lematizadas

Figura 66: Ejemplo de listado de documentos en PS-ES

Figura 67: Ejemplo de listado de documentos en ODE

Figura 68: Ejemplo de concordancias en PS-ES

Figura 69: Ejemplo de concordancias con marcación XML-TEI en PS-ES

Figura 70: Ejemplo de concordancias con marcación XML-TEI en ODE

Figura 71: Nube de palabras a partir de las formas seseantes de ODE

Figura 72: Nube de palabras a partir de los lemas nominales en cartas de amor de PS-ES

Figura 73: Mapa de ocurrencias laístas en PS-ES

Figura 74: Mapa de ocurrencias de los diminutivos -ito e -ico en ODE

Figura 75: Concentración de casos de seseo por provincia

Figura 76: Mapa dialectal del laísmo contemporáneo

Figura 77: Mapa dialectal del laísmo según la procedencia de los autores (siglos XVI-XIX)

Figura 78: Laísmo: caso de lectura paleográfica dudosa

Figura 79: Laísmo: caso de ambigüedad interpretativa

Figura 80: Mapa de autores laístas en zona distinguidora (siglos XVI-XIX)

Figura 81: Representación gráfica de la incorporación y crecimiento acumulado del léxico textil

Índice de tablas

Tabla 1: Algunos corpus del español contemporáneo y volumen textual

Tabla 2: Número de palabras por siglo en CORDE, CdEhist y CDH

Tabla 3: Algunos corpus históricos especializados del español

Tabla 4: Número de palabras por siglo en PS-ES y ODE

Tabla 5: Tipos textuales según su relación con lo oral (Culpeper y Kytö 2010)

Tabla 6: Tipos textuales según su relación con lo oral (Schneider 2013)

Tabla 7: Archivos consultados y número de cartas localizadas para el corpus PS-ES

Tabla 8: Tasa de éxito en la localización de correspondencia privada en fondos judiciales

Tabla 9: Archivos consultados y número de documentos localizados para el corpus ODE

Tabla 10: Principales metadatos codificados en PS-ES

Tabla 11: Alcance sociodialectal de autores en PS-ES

Tabla 12: Distribución de autores y cartas según estatus social en PS-ES

Tabla 13: Tabla comparativa: metadatos principales en PS-ES y ODE

Tabla 14: Textos seleccionados para la comparación entre facsímil y edición del CORDE

Tabla 15: Comparación de criterios editoriales en la conservación de grafías

Tabla 16: Elementos XML-TEI principales usados dentro de <text> en PS-ES y ODE

Tabla 17: Variantes ortográficas de la forma vecino en ODE

Tabla 18: Variantes ortográficas de la forma muselina en ODE

Tabla 19: Variantes ortográficas de la forma diligencia en PS-ES

Tabla 20: Criterios de normalización aplicados a formas no biunívocas en PS-ES y ODE

Tabla 21: Ejemplos de etiquetación gramatical según el esquema EAGLES

Tabla 22: Las notas lingüística en PS-ES: atributo @ltags

Tabla 23: Subtipos de anotación gráfico-fonética en ODE: atributo @phtags

Tabla 24: Subtipos de anotación semántica en ODE: atributo @stags

Tabla 25: Equivalencias gráfico-fonéticas para la anotación automática de @phtags

Tabla 26: Resumen cuantitativo de la anotación adicional en ODE

Details

Pages
XX, 276
Publication Year
2026
ISBN (PDF)
9783034366939
ISBN (ePUB)
9783034366946
ISBN (Softcover)
9783034366922
DOI
10.3726/b23814
Language
Spanish; Castilian
Publication date
2026 (September)
Keywords
lingüística de corpus lingüística histórica humanidades digitales español clásico español moderno Edad Moderna patrimonio documental construcción de corpus corpus especializados
Published
Lausanne, Berlin, Bruxelles, Chennai, New York, Oxford, 2026. xx, 276 p., 81 il. blanco/negro, 60 tablas.
Product Safety
Peter Lang Group AG

Biographical notes

Gael Vaamonde (Author)

Gael Vaamonde es doctor en Lingüística por la Universidad de Vigo (2011). Actualmente es profesor en el Departamento de Lengua Española de la Universidad de Granada. Su trayectoria investigadora se centra en la lingüística de corpus, la gramática del español, la historia del español y las humanidades digitales.

Previous

Title: Pequeños grandes corpus y diacronía del español