Hacia un modelo lingüístico de resumen automático de artículos médicos en español
- Leo Wanner Director
- María Teresa Cabré Co-director
Defence university: Universitat Pompeu Fabra
Fecha de defensa: 25 April 2008
- Horacio Rodríguez Hontoria Chair
- Jaume Llopis Pérez Secretary
- Horacio Saggion Committee member
- Irene Castellón Masalles Committee member
- Juan Manuel Torres Moreno Committee member
Type: Thesis
Abstract
En esta tesis se presenta un modelo lingüístico de resumen automático de artículos médicos en español que aúna criterios basados en la estructura textual, en las unidades léxicas y la estructura discursiva y sintáctico-comunicativa de los textos. El modelo se crea partiendo de la hipótesis de que los especialistas de cada ámbito emplean estrategias específicas a la hora de resumir. La validación de esta hipótesis mediante experimentos estadísticos permite tomar los artículos médicos acompañados de sus respectivos resúmenes como material de referencia para analizar, de cara a detectar las estrategias empleadas por los profesionales médicos para resumir sus textos. Una vez detectadas, estas estrategias se formalizan en forma de reglas y se diseña un modo de integración de las mismas. Esto da lugar al modelo presentado en esta tesis, del cual se implementa una parte. Los resúmenes resultantes se evalúan obteniendo buenos resultados, lo cual confirma que el modelo simula correctamente las estrategias empleadas por los especialistas y que estas se refieren a diversos aspectos lingüísticos.