Propuesta de un diccionario de palabras STEMMER para uso aplicaciones de procesamiento de lenguaje natural
Descripción del Articulo
El recurso más importante que posee la raza humana es conocimiento y la información. En la época actual de información, del manejo eficiente de este conocimiento depende del uso de todos los demás recursos naturales, industriales y humanos. El Procesamiento del Lenguaje Natural (PLN) es el campo que...
| Autor: | |
|---|---|
| Formato: | tesis de grado |
| Fecha de Publicación: | 2015 |
| Institución: | Universidad Andina Néstor Cáceres Velasquez |
| Repositorio: | UANCV-Institucional |
| Lenguaje: | español |
| OAI Identifier: | oai:repositorio.uancv.edu.pe:UANCV/468 |
| Enlace del recurso: | http://repositorio.uancv.edu.pe/handle/UANCV/468 |
| Nivel de acceso: | acceso abierto |
| Materia: | Propuesta Procesamiento Diccionario Palabras STEMMER para uso Aplicaciones |
| id |
UANT_e7ca8d4c526d1660109bdd8c31b8eb24 |
|---|---|
| oai_identifier_str |
oai:repositorio.uancv.edu.pe:UANCV/468 |
| network_acronym_str |
UANT |
| repository_id_str |
9395 |
| network_name_str |
UANCV-Institucional |
| dc.title.es_ES.fl_str_mv |
Propuesta de un diccionario de palabras STEMMER para uso aplicaciones de procesamiento de lenguaje natural |
| title |
Propuesta de un diccionario de palabras STEMMER para uso aplicaciones de procesamiento de lenguaje natural |
| spellingShingle |
Propuesta de un diccionario de palabras STEMMER para uso aplicaciones de procesamiento de lenguaje natural Bruna Quispe, Rieman Valentino Jean Propuesta Procesamiento Diccionario Palabras STEMMER para uso Aplicaciones |
| title_short |
Propuesta de un diccionario de palabras STEMMER para uso aplicaciones de procesamiento de lenguaje natural |
| title_full |
Propuesta de un diccionario de palabras STEMMER para uso aplicaciones de procesamiento de lenguaje natural |
| title_fullStr |
Propuesta de un diccionario de palabras STEMMER para uso aplicaciones de procesamiento de lenguaje natural |
| title_full_unstemmed |
Propuesta de un diccionario de palabras STEMMER para uso aplicaciones de procesamiento de lenguaje natural |
| title_sort |
Propuesta de un diccionario de palabras STEMMER para uso aplicaciones de procesamiento de lenguaje natural |
| author |
Bruna Quispe, Rieman Valentino Jean |
| author_facet |
Bruna Quispe, Rieman Valentino Jean |
| author_role |
author |
| dc.contributor.author.fl_str_mv |
Bruna Quispe, Rieman Valentino Jean |
| dc.subject.es_ES.fl_str_mv |
Propuesta Procesamiento Diccionario Palabras STEMMER para uso Aplicaciones |
| topic |
Propuesta Procesamiento Diccionario Palabras STEMMER para uso Aplicaciones |
| dc.description.abstract.es_ES.fl_txt_mv |
El recurso más importante que posee la raza humana es conocimiento y la información. En la época actual de información, del manejo eficiente de este conocimiento depende del uso de todos los demás recursos naturales, industriales y humanos. El Procesamiento del Lenguaje Natural (PLN) es el campo que combina las tecnologías de la ciencia computacional con la lingüística, con el objetivo de hacer posible la comprensión y el procesamiento asistidos por ordenador de información expresada en lenguaje humano para determinadas tareas, como búsquedas de información, la traducción automática, los sistemas de diálogo interactivos, el análisis de opiniones. El PLN no trata de la comunicación por medio de lenguajes naturales de una forma abstracta, sino de diseñar mecanismos para comunicarse y que sean eficaces computacionalmente que se puedan realizar por medio de programas que ejecuten o simulen la comunicación. Los modelos aplicados se enfocan no sólo a la comprensión del lenguaje de por sí, sino a aspectos generales cognitivos humanos y a la organización de la memoria. El lenguaje natural sirve sólo de medio para estudiar estos fenómenos. Hasta la década de 1980, la mayoría de los sistemas de PLN se basaban en un complejo conjunto de reglas diseñadas a mano. A partir de finales de 1980, sin embargo, hubo una revolución en PLN con la introducción de algoritmos de aprendizaje automático, para el procesamiento del lenguaje. La Lematización es un proceso de eliminación automática de partes no esenciales de las palabras para reducirlas a su parte original (lema). El lema es viii la forma que por convenio se acepta como representante de todas las formas flexionadas de una misma palabra. Es decir, el lema de una palabra es la palabra que nos encontraríamos como entrada en un diccionario tradicional. Por ejemplo, decir es el lema de dije, pero también de diré o dijéramos; guapo es el lema de guapas; mesa es el lema de mesas. |
| dc.description.uri.es_ES.fl_txt_mv |
Tesis |
| description |
El recurso más importante que posee la raza humana es conocimiento y la información. En la época actual de información, del manejo eficiente de este conocimiento depende del uso de todos los demás recursos naturales, industriales y humanos. El Procesamiento del Lenguaje Natural (PLN) es el campo que combina las tecnologías de la ciencia computacional con la lingüística, con el objetivo de hacer posible la comprensión y el procesamiento asistidos por ordenador de información expresada en lenguaje humano para determinadas tareas, como búsquedas de información, la traducción automática, los sistemas de diálogo interactivos, el análisis de opiniones. El PLN no trata de la comunicación por medio de lenguajes naturales de una forma abstracta, sino de diseñar mecanismos para comunicarse y que sean eficaces computacionalmente que se puedan realizar por medio de programas que ejecuten o simulen la comunicación. Los modelos aplicados se enfocan no sólo a la comprensión del lenguaje de por sí, sino a aspectos generales cognitivos humanos y a la organización de la memoria. El lenguaje natural sirve sólo de medio para estudiar estos fenómenos. Hasta la década de 1980, la mayoría de los sistemas de PLN se basaban en un complejo conjunto de reglas diseñadas a mano. A partir de finales de 1980, sin embargo, hubo una revolución en PLN con la introducción de algoritmos de aprendizaje automático, para el procesamiento del lenguaje. La Lematización es un proceso de eliminación automática de partes no esenciales de las palabras para reducirlas a su parte original (lema). El lema es viii la forma que por convenio se acepta como representante de todas las formas flexionadas de una misma palabra. Es decir, el lema de una palabra es la palabra que nos encontraríamos como entrada en un diccionario tradicional. Por ejemplo, decir es el lema de dije, pero también de diré o dijéramos; guapo es el lema de guapas; mesa es el lema de mesas. |
| publishDate |
2015 |
| dc.date.accessioned.none.fl_str_mv |
2016-10-27T19:55:43Z 2019-09-09T22:09:24Z |
| dc.date.available.none.fl_str_mv |
2016-10-27T19:55:43Z 2019-09-09T22:09:24Z |
| dc.date.issued.fl_str_mv |
2015-06-05 |
| dc.type.none.fl_str_mv |
info:eu-repo/semantics/bachelorThesis |
| format |
bachelorThesis |
| dc.identifier.citation.es_ES.fl_str_mv |
Vancouver |
| dc.identifier.uri.none.fl_str_mv |
http://repositorio.uancv.edu.pe/handle/UANCV/468 |
| identifier_str_mv |
Vancouver |
| url |
http://repositorio.uancv.edu.pe/handle/UANCV/468 |
| dc.language.iso.es_ES.fl_str_mv |
spa |
| language |
spa |
| dc.relation.ispartof.fl_str_mv |
SUNEDU |
| dc.rights.es_ES.fl_str_mv |
info:eu-repo/semantics/openAccess |
| dc.rights.uri.es_ES.fl_str_mv |
http://creativecommons.org/licences/by-nc-nd/2.5/pe/ |
| eu_rights_str_mv |
openAccess |
| rights_invalid_str_mv |
http://creativecommons.org/licences/by-nc-nd/2.5/pe/ |
| dc.format.es_ES.fl_str_mv |
application/pdf |
| dc.publisher.es_ES.fl_str_mv |
Universidad Andina Néstor Cáceres Velásquez |
| dc.source.es_ES.fl_str_mv |
Universidad Andina Néstor Cáceres Velásquez Repositorio Institucional - UANCV |
| dc.source.none.fl_str_mv |
reponame:UANCV-Institucional instname:Universidad Andina Néstor Cáceres Velasquez instacron:UANCV Universidad Andina Néstor Cáceres Velásquez Repositorio Institucional - UANCV |
| reponame_str |
UANCV-Institucional |
| collection |
UANCV-Institucional |
| instname_str |
Universidad Andina Néstor Cáceres Velasquez |
| instacron_str |
UANCV |
| institution |
UANCV |
| bitstream.url.fl_str_mv |
http://repositorio.uancv.edu.pe/bitstream/UANCV/468/1/DNI%20N%c2%ba%2045575540.pdf.txt http://repositorio.uancv.edu.pe/bitstream/UANCV/468/2/license.txt http://repositorio.uancv.edu.pe/bitstream/UANCV/468/3/DNI%20N%c2%ba%2045575540.pdf |
| bitstream.checksum.fl_str_mv |
691fec4fcb0c1dd527b074e022b7f35b 8a4605be74aa9ea9d79846c1fba20a33 58baaaf408cb32acd11fbe3a608b5683 |
| bitstream.checksumAlgorithm.fl_str_mv |
MD5 MD5 MD5 |
| repository.name.fl_str_mv |
Repositorio Institucional de la UANCV |
| repository.mail.fl_str_mv |
repositorio@uancv.edu.pe |
| dc.description.abstract.none.fl_txt_mv |
El recurso más importante que posee la raza humana es conocimiento y la información. En la época actual de información, del manejo eficiente de este conocimiento depende del uso de todos los demás recursos naturales, industriales y humanos. El Procesamiento del Lenguaje Natural (PLN) es el campo que combina las tecnologías de la ciencia computacional con la lingüística, con el objetivo de hacer posible la comprensión y el procesamiento asistidos por ordenador de información expresada en lenguaje humano para determinadas tareas, como búsquedas de información, la traducción automática, los sistemas de diálogo interactivos, el análisis de opiniones. El PLN no trata de la comunicación por medio de lenguajes naturales de una forma abstracta, sino de diseñar mecanismos para comunicarse y que sean eficaces computacionalmente que se puedan realizar por medio de programas que ejecuten o simulen la comunicación. Los modelos aplicados se enfocan no sólo a la comprensión del lenguaje de por sí, sino a aspectos generales cognitivos humanos y a la organización de la memoria. El lenguaje natural sirve sólo de medio para estudiar estos fenómenos. Hasta la década de 1980, la mayoría de los sistemas de PLN se basaban en un complejo conjunto de reglas diseñadas a mano. A partir de finales de 1980, sin embargo, hubo una revolución en PLN con la introducción de algoritmos de aprendizaje automático, para el procesamiento del lenguaje. La Lematización es un proceso de eliminación automática de partes no esenciales de las palabras para reducirlas a su parte original (lema). El lema es viii la forma que por convenio se acepta como representante de todas las formas flexionadas de una misma palabra. Es decir, el lema de una palabra es la palabra que nos encontraríamos como entrada en un diccionario tradicional. Por ejemplo, decir es el lema de dije, pero también de diré o dijéramos; guapo es el lema de guapas; mesa es el lema de mesas. |
| dc.contributor.none.fl_str_mv |
Bruna Quispe, Rieman Valentino Jean |
| dc.date.none.fl_str_mv |
2015-06-05 |
| dc.format.none.fl_str_mv |
application/pdf |
| dc.publisher.none.fl_str_mv |
Universidad Andina Néstor Cáceres Velásquez |
| dc.rights.none.fl_str_mv |
info:eu-repo/semantics/openAccess |
| dc.subject.none.fl_str_mv |
Propuesta Procesamiento Diccionario Palabras STEMMER para uso Aplicaciones |
| dc.title.none.fl_str_mv |
Propuesta de un diccionario de palabras STEMMER para uso aplicaciones de procesamiento de lenguaje natural |
| dc.relation.none.fl_str_mv |
SUNEDU |
| dc.identifier.citation.none.fl_str_mv |
Vancouver |
| dc.language.iso.none.fl_str_mv |
spa |
| dc.rights.uri.none.fl_str_mv |
http://creativecommons.org/licences/by-nc-nd/2.5/pe/ |
| thesis.degree.name.none.fl_str_mv |
Ingeniero de Sistemas |
| thesis.degree.grantor.none.fl_str_mv |
Universidad Andina Néstor Cáceres Velásquez - Facultad de Ingeniería de Sistemas |
| thesis.degree.level.none.fl_str_mv |
Titulo Profesional |
| thesis.degree.discipline.none.fl_str_mv |
Sistemas |
| thesis.degree.program.none.fl_str_mv |
Escuela Profesional de Ingeniería de Sistemas |
| _version_ |
1708735262904811520 |
| spelling |
Bruna Quispe, Rieman Valentino Jean2016-10-27T19:55:43Z2019-09-09T22:09:24Z2016-10-27T19:55:43Z2019-09-09T22:09:24Z2015-06-05Vancouverhttp://repositorio.uancv.edu.pe/handle/UANCV/468El recurso más importante que posee la raza humana es conocimiento y la información. En la época actual de información, del manejo eficiente de este conocimiento depende del uso de todos los demás recursos naturales, industriales y humanos. El Procesamiento del Lenguaje Natural (PLN) es el campo que combina las tecnologías de la ciencia computacional con la lingüística, con el objetivo de hacer posible la comprensión y el procesamiento asistidos por ordenador de información expresada en lenguaje humano para determinadas tareas, como búsquedas de información, la traducción automática, los sistemas de diálogo interactivos, el análisis de opiniones. El PLN no trata de la comunicación por medio de lenguajes naturales de una forma abstracta, sino de diseñar mecanismos para comunicarse y que sean eficaces computacionalmente que se puedan realizar por medio de programas que ejecuten o simulen la comunicación. Los modelos aplicados se enfocan no sólo a la comprensión del lenguaje de por sí, sino a aspectos generales cognitivos humanos y a la organización de la memoria. El lenguaje natural sirve sólo de medio para estudiar estos fenómenos. Hasta la década de 1980, la mayoría de los sistemas de PLN se basaban en un complejo conjunto de reglas diseñadas a mano. A partir de finales de 1980, sin embargo, hubo una revolución en PLN con la introducción de algoritmos de aprendizaje automático, para el procesamiento del lenguaje. La Lematización es un proceso de eliminación automática de partes no esenciales de las palabras para reducirlas a su parte original (lema). El lema es viii la forma que por convenio se acepta como representante de todas las formas flexionadas de una misma palabra. Es decir, el lema de una palabra es la palabra que nos encontraríamos como entrada en un diccionario tradicional. Por ejemplo, decir es el lema de dije, pero también de diré o dijéramos; guapo es el lema de guapas; mesa es el lema de mesas.Tesisapplication/pdfspaUniversidad Andina Néstor Cáceres Velásquezinfo:eu-repo/semantics/openAccesshttp://creativecommons.org/licences/by-nc-nd/2.5/pe/Universidad Andina Néstor Cáceres VelásquezRepositorio Institucional - UANCVreponame:UANCV-Institucionalinstname:Universidad Andina Néstor Cáceres Velasquezinstacron:UANCVPropuestaProcesamientoDiccionarioPalabras STEMMER para uso AplicacionesPropuesta de un diccionario de palabras STEMMER para uso aplicaciones de procesamiento de lenguaje naturalinfo:eu-repo/semantics/bachelorThesisSUNEDUIngeniero de SistemasUniversidad Andina Néstor Cáceres Velásquez - Facultad de Ingeniería de SistemasTitulo ProfesionalSistemasEscuela Profesional de Ingeniería de SistemasTEXTDNI Nº 45575540.pdf.txtExtracted texttext/plain95649http://repositorio.uancv.edu.pe/bitstream/UANCV/468/1/DNI%20N%c2%ba%2045575540.pdf.txt691fec4fcb0c1dd527b074e022b7f35bMD51LICENSElicense.txttext/plain1748http://repositorio.uancv.edu.pe/bitstream/UANCV/468/2/license.txt8a4605be74aa9ea9d79846c1fba20a33MD52ORIGINALDNI Nº 45575540.pdfapplication/pdf5118022http://repositorio.uancv.edu.pe/bitstream/UANCV/468/3/DNI%20N%c2%ba%2045575540.pdf58baaaf408cb32acd11fbe3a608b5683MD53UANCV/468oai:repositorio.uancv.edu.pe:UANCV/4682019-09-09 17:09:24.972Repositorio Institucional de la UANCVrepositorio@uancv.edu.peTk9URTogUExBQ0UgWU9VUiBPV04gTElDRU5TRSBIRVJFClRoaXMgc2FtcGxlIGxpY2Vuc2UgaXMgcHJvdmlkZWQgZm9yIGluZm9ybWF0aW9uYWwgcHVycG9zZXMgb25seS4KCk5PTi1FWENMVVNJVkUgRElTVFJJQlVUSU9OIExJQ0VOU0UKCkJ5IHNpZ25pbmcgYW5kIHN1Ym1pdHRpbmcgdGhpcyBsaWNlbnNlLCB5b3UgKHRoZSBhdXRob3Iocykgb3IgY29weXJpZ2h0Cm93bmVyKSBncmFudHMgdG8gRFNwYWNlIFVuaXZlcnNpdHkgKERTVSkgdGhlIG5vbi1leGNsdXNpdmUgcmlnaHQgdG8gcmVwcm9kdWNlLAp0cmFuc2xhdGUgKGFzIGRlZmluZWQgYmVsb3cpLCBhbmQvb3IgZGlzdHJpYnV0ZSB5b3VyIHN1Ym1pc3Npb24gKGluY2x1ZGluZwp0aGUgYWJzdHJhY3QpIHdvcmxkd2lkZSBpbiBwcmludCBhbmQgZWxlY3Ryb25pYyBmb3JtYXQgYW5kIGluIGFueSBtZWRpdW0sCmluY2x1ZGluZyBidXQgbm90IGxpbWl0ZWQgdG8gYXVkaW8gb3IgdmlkZW8uCgpZb3UgYWdyZWUgdGhhdCBEU1UgbWF5LCB3aXRob3V0IGNoYW5naW5nIHRoZSBjb250ZW50LCB0cmFuc2xhdGUgdGhlCnN1Ym1pc3Npb24gdG8gYW55IG1lZGl1bSBvciBmb3JtYXQgZm9yIHRoZSBwdXJwb3NlIG9mIHByZXNlcnZhdGlvbi4KCllvdSBhbHNvIGFncmVlIHRoYXQgRFNVIG1heSBrZWVwIG1vcmUgdGhhbiBvbmUgY29weSBvZiB0aGlzIHN1Ym1pc3Npb24gZm9yCnB1cnBvc2VzIG9mIHNlY3VyaXR5LCBiYWNrLXVwIGFuZCBwcmVzZXJ2YXRpb24uCgpZb3UgcmVwcmVzZW50IHRoYXQgdGhlIHN1Ym1pc3Npb24gaXMgeW91ciBvcmlnaW5hbCB3b3JrLCBhbmQgdGhhdCB5b3UgaGF2ZQp0aGUgcmlnaHQgdG8gZ3JhbnQgdGhlIHJpZ2h0cyBjb250YWluZWQgaW4gdGhpcyBsaWNlbnNlLiBZb3UgYWxzbyByZXByZXNlbnQKdGhhdCB5b3VyIHN1Ym1pc3Npb24gZG9lcyBub3QsIHRvIHRoZSBiZXN0IG9mIHlvdXIga25vd2xlZGdlLCBpbmZyaW5nZSB1cG9uCmFueW9uZSdzIGNvcHlyaWdodC4KCklmIHRoZSBzdWJtaXNzaW9uIGNvbnRhaW5zIG1hdGVyaWFsIGZvciB3aGljaCB5b3UgZG8gbm90IGhvbGQgY29weXJpZ2h0LAp5b3UgcmVwcmVzZW50IHRoYXQgeW91IGhhdmUgb2J0YWluZWQgdGhlIHVucmVzdHJpY3RlZCBwZXJtaXNzaW9uIG9mIHRoZQpjb3B5cmlnaHQgb3duZXIgdG8gZ3JhbnQgRFNVIHRoZSByaWdodHMgcmVxdWlyZWQgYnkgdGhpcyBsaWNlbnNlLCBhbmQgdGhhdApzdWNoIHRoaXJkLXBhcnR5IG93bmVkIG1hdGVyaWFsIGlzIGNsZWFybHkgaWRlbnRpZmllZCBhbmQgYWNrbm93bGVkZ2VkCndpdGhpbiB0aGUgdGV4dCBvciBjb250ZW50IG9mIHRoZSBzdWJtaXNzaW9uLgoKSUYgVEhFIFNVQk1JU1NJT04gSVMgQkFTRUQgVVBPTiBXT1JLIFRIQVQgSEFTIEJFRU4gU1BPTlNPUkVEIE9SIFNVUFBPUlRFRApCWSBBTiBBR0VOQ1kgT1IgT1JHQU5JWkFUSU9OIE9USEVSIFRIQU4gRFNVLCBZT1UgUkVQUkVTRU5UIFRIQVQgWU9VIEhBVkUKRlVMRklMTEVEIEFOWSBSSUdIVCBPRiBSRVZJRVcgT1IgT1RIRVIgT0JMSUdBVElPTlMgUkVRVUlSRUQgQlkgU1VDSApDT05UUkFDVCBPUiBBR1JFRU1FTlQuCgpEU1Ugd2lsbCBjbGVhcmx5IGlkZW50aWZ5IHlvdXIgbmFtZShzKSBhcyB0aGUgYXV0aG9yKHMpIG9yIG93bmVyKHMpIG9mIHRoZQpzdWJtaXNzaW9uLCBhbmQgd2lsbCBub3QgbWFrZSBhbnkgYWx0ZXJhdGlvbiwgb3RoZXIgdGhhbiBhcyBhbGxvd2VkIGJ5IHRoaXMKbGljZW5zZSwgdG8geW91ciBzdWJtaXNzaW9uLgo= |
| score |
13.922664 |
Nota importante:
La información contenida en este registro es de entera responsabilidad de la institución que gestiona el repositorio institucional donde esta contenido este documento o set de datos. El CONCYTEC no se hace responsable por los contenidos (publicaciones y/o datos) accesibles a través del Repositorio Nacional Digital de Ciencia, Tecnología e Innovación de Acceso Abierto (ALICIA).
La información contenida en este registro es de entera responsabilidad de la institución que gestiona el repositorio institucional donde esta contenido este documento o set de datos. El CONCYTEC no se hace responsable por los contenidos (publicaciones y/o datos) accesibles a través del Repositorio Nacional Digital de Ciencia, Tecnología e Innovación de Acceso Abierto (ALICIA).