Recuperación semántica de la información usando la similitud distribucional

Descripción del Articulo

Recuperar información con un criterio semántico desde la Web, en donde la información almacenada no es estructurada, se requiere de mecanismos complejos y diversos que consideren el procesamiento de lenguaje natural. En esta tesis se implementó y analizó un método de recuperación semántico de la inf...

Descripción completa

Detalles Bibliográficos
Autor: Holguin Holguin, Edgar
Formato: tesis de maestría
Fecha de Publicación:2013
Institución:Universidad Nacional Del Altiplano
Repositorio:UNAP-Institucional
Lenguaje:español
OAI Identifier:oai:https://repositorio.unap.edu.pe:20.500.14082/365
Enlace del recurso:http://repositorio.unap.edu.pe/handle/20.500.14082/365
Nivel de acceso:acceso abierto
Materia:Informática
id RNAP_33e27ae8051852b931ba1dde9f3bde6f
oai_identifier_str oai:https://repositorio.unap.edu.pe:20.500.14082/365
network_acronym_str RNAP
network_name_str UNAP-Institucional
repository_id_str 9382
spelling Olazabal Guerra, Angel ManuelHolguin Holguin, Edgar2016-09-17T00:37:37Z2016-09-17T00:37:37Z2013EPG715-00715-01http://repositorio.unap.edu.pe/handle/20.500.14082/365Recuperar información con un criterio semántico desde la Web, en donde la información almacenada no es estructurada, se requiere de mecanismos complejos y diversos que consideren el procesamiento de lenguaje natural. En esta tesis se implementó y analizó un método de recuperación semántico de la información, partiendo de la premisa que si existen palabras que coocurren en un contexto determinado, éstas tienen una relación semántica. Para la implementación de un mecanismo de recuperación sobre una colección de documentos se hizo necesario un procesamiento, representación y análisis de relación de los términos. El Modelo Vectorial para la recuperación semántica de la información utilizado, permitió definir las premisas necesarias e importantes para determinar si un conjunto de palabras son relevantes a la necesidad de información, calculando la medida de similitud y establecimiento del ranking de vocablos más semejantes semánticamente. La lejanía o cercanía de dos vocablos se determinó utilizando la similitud distribucional representado por un vector de coocurrencia y se cuantificó mediante el coseno del ángulo que forman sus vectores. Al evaluar el rendimiento del sistema de recuperación de la información, se concluyó que es importante el corpus utilizado en la construcción del mismo así como el pre procesamiento, estructura y técnicas de recuperaciónTesisspaUniversidad Nacional del Altiplanoinfo:eu-repo/semantics/openAccesshttps://creativecommons.org/licenses/by/4.0/deed.esUniversidad Nacional del AltiplanoRepositorio Institucional - UNAPreponame:UNAP-Institucionalinstname:Universidad Nacional Del Altiplanoinstacron:UNAPInformáticaRecuperación semántica de la información usando la similitud distribucionalinfo:eu-repo/semantics/masterThesisSUNEDUMagíster Scientiae en InformáticaInformáticaUniversidad Nacional del Altiplano. Escuela de PosgradoMaestríaORIGINALEPG715-00715-01.pdfapplication/pdf1663565https://repositorio.unap.edu.pe/bitstream/20.500.14082/365/1/EPG715-00715-01.pdf86d61caaa6c2af974e4c9483a0414e4aMD51TEXTEPG715-00715-01.pdf.txtEPG715-00715-01.pdf.txtExtracted texttext/plain85527https://repositorio.unap.edu.pe/bitstream/20.500.14082/365/2/EPG715-00715-01.pdf.txt2d1a43093b28da9e862575d9348ab96dMD5220.500.14082/365oai:https://repositorio.unap.edu.pe:20.500.14082/3652022-10-29 18:43:06.793Repositorio institucional de la Universidad Nacional del Altiplanodspace-help@myu.edu
dc.title.es_PE.fl_str_mv Recuperación semántica de la información usando la similitud distribucional
title Recuperación semántica de la información usando la similitud distribucional
spellingShingle Recuperación semántica de la información usando la similitud distribucional
Holguin Holguin, Edgar
Informática
title_short Recuperación semántica de la información usando la similitud distribucional
title_full Recuperación semántica de la información usando la similitud distribucional
title_fullStr Recuperación semántica de la información usando la similitud distribucional
title_full_unstemmed Recuperación semántica de la información usando la similitud distribucional
title_sort Recuperación semántica de la información usando la similitud distribucional
author Holguin Holguin, Edgar
author_facet Holguin Holguin, Edgar
author_role author
dc.contributor.advisor.fl_str_mv Olazabal Guerra, Angel Manuel
dc.contributor.author.fl_str_mv Holguin Holguin, Edgar
dc.subject.es_PE.fl_str_mv Informática
topic Informática
description Recuperar información con un criterio semántico desde la Web, en donde la información almacenada no es estructurada, se requiere de mecanismos complejos y diversos que consideren el procesamiento de lenguaje natural. En esta tesis se implementó y analizó un método de recuperación semántico de la información, partiendo de la premisa que si existen palabras que coocurren en un contexto determinado, éstas tienen una relación semántica. Para la implementación de un mecanismo de recuperación sobre una colección de documentos se hizo necesario un procesamiento, representación y análisis de relación de los términos. El Modelo Vectorial para la recuperación semántica de la información utilizado, permitió definir las premisas necesarias e importantes para determinar si un conjunto de palabras son relevantes a la necesidad de información, calculando la medida de similitud y establecimiento del ranking de vocablos más semejantes semánticamente. La lejanía o cercanía de dos vocablos se determinó utilizando la similitud distribucional representado por un vector de coocurrencia y se cuantificó mediante el coseno del ángulo que forman sus vectores. Al evaluar el rendimiento del sistema de recuperación de la información, se concluyó que es importante el corpus utilizado en la construcción del mismo así como el pre procesamiento, estructura y técnicas de recuperación
publishDate 2013
dc.date.accessioned.none.fl_str_mv 2016-09-17T00:37:37Z
dc.date.available.none.fl_str_mv 2016-09-17T00:37:37Z
dc.date.issued.fl_str_mv 2013
dc.type.es_PE.fl_str_mv info:eu-repo/semantics/masterThesis
format masterThesis
dc.identifier.other.none.fl_str_mv EPG715-00715-01
dc.identifier.uri.none.fl_str_mv http://repositorio.unap.edu.pe/handle/20.500.14082/365
identifier_str_mv EPG715-00715-01
url http://repositorio.unap.edu.pe/handle/20.500.14082/365
dc.language.iso.es_PE.fl_str_mv spa
language spa
dc.relation.ispartof.fl_str_mv SUNEDU
dc.rights.es_PE.fl_str_mv info:eu-repo/semantics/openAccess
dc.rights.uri.es_PE.fl_str_mv https://creativecommons.org/licenses/by/4.0/deed.es
eu_rights_str_mv openAccess
rights_invalid_str_mv https://creativecommons.org/licenses/by/4.0/deed.es
dc.publisher.es_PE.fl_str_mv Universidad Nacional del Altiplano
dc.source.es_PE.fl_str_mv Universidad Nacional del Altiplano
Repositorio Institucional - UNAP
dc.source.none.fl_str_mv reponame:UNAP-Institucional
instname:Universidad Nacional Del Altiplano
instacron:UNAP
instname_str Universidad Nacional Del Altiplano
instacron_str UNAP
institution UNAP
reponame_str UNAP-Institucional
collection UNAP-Institucional
bitstream.url.fl_str_mv https://repositorio.unap.edu.pe/bitstream/20.500.14082/365/1/EPG715-00715-01.pdf
https://repositorio.unap.edu.pe/bitstream/20.500.14082/365/2/EPG715-00715-01.pdf.txt
bitstream.checksum.fl_str_mv 86d61caaa6c2af974e4c9483a0414e4a
2d1a43093b28da9e862575d9348ab96d
bitstream.checksumAlgorithm.fl_str_mv MD5
MD5
repository.name.fl_str_mv Repositorio institucional de la Universidad Nacional del Altiplano
repository.mail.fl_str_mv dspace-help@myu.edu
_version_ 1855051490773696512
score 13.922664
Nota importante:
La información contenida en este registro es de entera responsabilidad de la institución que gestiona el repositorio institucional donde esta contenido este documento o set de datos. El CONCYTEC no se hace responsable por los contenidos (publicaciones y/o datos) accesibles a través del Repositorio Nacional Digital de Ciencia, Tecnología e Innovación de Acceso Abierto (ALICIA).