Pos Taggin utilizando CRFS para el español
| dc.contributor.advisor | Gutiérrez de Piñérez Reyes, Raúl Ernesto | |
| dc.contributor.author | Cujar Rosero, Alvaro Ricardo | |
| dc.date.accessioned | 2020-05-14T13:54:17Z | |
| dc.date.available | 2020-05-14T13:54:17Z | |
| dc.date.issued | 2016 | |
| dc.description.abstract | El POS Tagging es una tarea enmarcada dentro del procesamiento del lenguaje Natulal (PLN), cuyo objetivo esencial es la categorización lingüística de las palabras dentro de un texto. El problema al cual se enfrenta el POS tagging es la ambigüedad, en cuanto a que existen algunas palabras que presentan más de una posible categoría lingüística. Existen diferentes enfoques para resolver esta tarea, entre los que se tienen, modelos estocásticos, modelos basados en reglas, entre otros. Dentro de los modelos estocásticos se encuentran los campos randómicos condicionales (Conditional Random Fields CRF) y las cadenas ocultas de markov (Hidden Markov Chain HMM). Los primeros, utilizados para el etiquetado de secuencias, representan un modelo grá¿co no dirigido, lo que permite que sean discriminativos, y que se puedan incluir características sobre las observaciones. Los segundos, igualmente utilizados para el etiquetado de secuencias, corresponden a un modelo gráfico dirigido, lo cual permite que sean generativos. La desventaja que presentan las HMMs, es que elas para determinar la clasificación del siguiente estado, no tienen en cuenta el pasado, sino el estado actual, además de no permitir incluir características sobre las observaciones. Estas dos debilidades no las presenta los CRFs. El objetivo de este trabajo es realizar un análisis comparativo del rendimiento de estos dos modelos estocásticos, para la tarea del POS Tagging, en el idioma español, bajo el corpus AnCora, teniendo en cuenta las características morfológicas de cada palabra para el modelo CRF. | spa |
| dc.description.degreelevel | Maestría | spa |
| dc.description.degreename | MAGISTER EN INGENIERÍA ÉNFASIS EN INGENIERÍA DE SISTEMAS Y COMPUTACIÓN | spa |
| dc.format.extent | 1 recurso en línea (88 páginas) | spa |
| dc.format.mimetype | application/pdf | spa |
| dc.identifier.uri | https://hdl.handle.net/10893/15276 | |
| dc.language.iso | spa | spa |
| dc.publisher | Universidad del Valle | spa |
| dc.publisher.faculty | FACULTAD DE INGENIERÍA | spa |
| dc.publisher.place | Colombia | spa |
| dc.publisher.program | MAESTRÍA EN INGENIERÍA-ÉNFASIS EN INGENIERÍA DE SISTEMAS Y COMPUTACIÓN | spa |
| dc.rights.accessrights | info:eu-repo/semantics/openAccess | spa |
| dc.subject.ddc | Ciencias de la computación | |
| dc.subject.ddc | Lingüística | |
| dc.subject.ddc | Lenguaje natural | |
| dc.subject.ddc | Sistemas estocásticos | |
| dc.subject.ddc | Análisis estocástico | |
| dc.title | Pos Taggin utilizando CRFS para el español | spa |
| dc.type | Trabajo de grado - Maestría | spa |
| dc.type.coar | http://purl.org/coar/resource_type/c_bdcc | spa |
| dc.type.content | Text | spa |
| dc.type.driver | info:eu-repo/semantics/masterThesis | spa |
| dc.type.redcol | https://purl.org/redcol/resource_type/TM | spa |
| dc.type.version | info:eu-repo/semantics/publishedVersion | spa |
| dspace.entity.type | Publication | |
| oaire.accessrights | http://purl.org/coar/access_right/c_abf2 | spa |
| oaire.version | http://purl.org/coar/version/c_970fb48d4fbd8a85 | spa |
