Ir directamente a la navegación principal Ir directamente a la búsqueda Ir directamente al contenido principal

Tractament automàtic de la informació en espanyol: processament lèxic, sintàctic i semàntic

  • Subirats Ruggeberg, Carlos (Investigador/a principal)
  • Torres Hernández, Maria Judit (Becario/a)
  • Colás Pasamontes, José (Colaborador/a)
  • Cristóbal de Gregorio, María (Colaborador/a)
  • Emilia Victoria Enríquez Carrasco (Colaborador/a)
  • Mairal Usón, Ricardo (Colaborador/a)
  • Bobes Soler, Eulalia De (Investigador/a contratado/a)
  • Fuentes Morán, Teresa (Investigador/a contratado/a)
  • Garcia De Quesada, Mercedes (Investigador/a contratado/a)
  • Garrido Íñigo, Paloma (Investigador/a contratado/a)
  • Moya Sariñena, Lidia (Investigador/a contratado/a)
  • Ortega Gil, Marc (Investigador/a contratado/a)
  • Pascual Dominguez, Blanca (Investigador/a contratado/a)
  • Rios Mestre, Antonio (Investigador/a)

Detalles del proyecto

Descripción

1. El primer objetivo de este proyecto es ampliar la cobertura léxica y desarrollar las aplicaciones informáticas de un sistema que procesa automáticamente la información léxica y sintáctica mediante diccionarios y sintaxis computacionales, y algoritmos de intersección de autómatas. Los algortimos de intersección de autómatas intersectan un texto convertido previamente en una autómata finito determinista (AFD), cuyas transiciones están etiquetadas con información de un diccionario electrónico, con transductores p-subsecuenciales que se generan automáticamente a partir de sintaxis computacionales que formalizan las construcciones sintácticas asociadas a los predicados del español. La intersección del AFD (texto) con los transductores (construcciones sintácticas) es un AFD transducido en el que se restituyen de forma no ambigua las relaciones de predicación. 2. El segundo objetivo de este proyecto es desarrollar un corpus con etiquetación semántica que tenga aplicaciones para el procesamiento automático de la información textual. La selección de las oraciones de este corpus se realizará automáticamente con criterios sintácticos mediante las herramientas de análisis léxico y sintáctico de 1. La etiquetación semántica se desarrollará dentro de la teoría de la semántica de marcos (frame semantics) con la colaboración del proyecto Framenet\super 1\nosuper , que cederá las siguientes herramientas para el desarrollo del proyecto: (1) la base de datos que gestionará el corpus, (2) las herramientas de etiquetación semiautomática y (3) las aplicaciones de explotación del corpus para el procesamiento semántico automático de textos.
EstadoFinalizado
Fecha de inicio/Fecha fin1/12/021/12/05

Financiación

  • Ministerio de Ciencia y Tecnología (MCYT): 160.080,00 €

Huella digital

Explore los temas de investigación que se abordan en este proyecto. Estas etiquetas se generan con base en las adjudicaciones/concesiones subyacentes. Juntos, forma una huella digital única.