Reconocimiento de entidades nombradas para el idioma español utilizando Conditional Random Fields con características no supervisadas
Descripción del Articulo
El reconocimiento de entidades nombradas es una tarea relevante en el a´rea de Procesamiento de Lenguaje Natural, su funci´on es identificar entidades en textos para un idioma dado. El estudio de esta tarea se ha enfocado principalmente en el idioma ingl´es. Recientes estudios en el idioma ingl´es h...
| Autor: | |
|---|---|
| Formato: | tesis de maestría |
| Fecha de Publicación: | 2017 |
| Institución: | Consejo Nacional de Ciencia Tecnología e Innovación |
| Repositorio: | CONCYTEC-Institucional |
| Lenguaje: | español |
| OAI Identifier: | oai:repositorio.concytec.gob.pe:20.500.12390/1946 |
| Enlace del recurso: | https://hdl.handle.net/20.500.12390/1946 |
| Nivel de acceso: | acceso abierto |
| Materia: | Word embeddings Procesamiento de lenguaje natural NER para español Conditional Random Fields https://purl.org/pe-repo/ocde/ford#1.02.01 |
| id |
CONC_69ad59037ec2ad42607c775348a4c7ef |
|---|---|
| oai_identifier_str |
oai:repositorio.concytec.gob.pe:20.500.12390/1946 |
| network_acronym_str |
CONC |
| network_name_str |
CONCYTEC-Institucional |
| repository_id_str |
4689 |
| dc.title.none.fl_str_mv |
Reconocimiento de entidades nombradas para el idioma español utilizando Conditional Random Fields con características no supervisadas |
| title |
Reconocimiento de entidades nombradas para el idioma español utilizando Conditional Random Fields con características no supervisadas |
| spellingShingle |
Reconocimiento de entidades nombradas para el idioma español utilizando Conditional Random Fields con características no supervisadas Copara Zea, Jenny Linet Word embeddings Procesamiento de lenguaje natural NER para español NER para español Conditional Random Fields https://purl.org/pe-repo/ocde/ford#1.02.01 |
| title_short |
Reconocimiento de entidades nombradas para el idioma español utilizando Conditional Random Fields con características no supervisadas |
| title_full |
Reconocimiento de entidades nombradas para el idioma español utilizando Conditional Random Fields con características no supervisadas |
| title_fullStr |
Reconocimiento de entidades nombradas para el idioma español utilizando Conditional Random Fields con características no supervisadas |
| title_full_unstemmed |
Reconocimiento de entidades nombradas para el idioma español utilizando Conditional Random Fields con características no supervisadas |
| title_sort |
Reconocimiento de entidades nombradas para el idioma español utilizando Conditional Random Fields con características no supervisadas |
| author |
Copara Zea, Jenny Linet |
| author_facet |
Copara Zea, Jenny Linet |
| author_role |
author |
| dc.contributor.author.fl_str_mv |
Copara Zea, Jenny Linet |
| dc.subject.none.fl_str_mv |
Word embeddings |
| topic |
Word embeddings Procesamiento de lenguaje natural NER para español NER para español Conditional Random Fields https://purl.org/pe-repo/ocde/ford#1.02.01 |
| dc.subject.es_PE.fl_str_mv |
Procesamiento de lenguaje natural NER para español NER para español Conditional Random Fields |
| dc.subject.ocde.none.fl_str_mv |
https://purl.org/pe-repo/ocde/ford#1.02.01 |
| description |
El reconocimiento de entidades nombradas es una tarea relevante en el a´rea de Procesamiento de Lenguaje Natural, su funci´on es identificar entidades en textos para un idioma dado. El estudio de esta tarea se ha enfocado principalmente en el idioma ingl´es. Recientes estudios en el idioma ingl´es han mostrado que utilizar caracter´ısticas no supervisadas tales como word embeddings mejoran el reconocimiento de entidades nombradas. En este trabajo se investiga si caracter´ısticas no supervisadas pueden mejorar la tarea de NER supervisado en el idioma espan˜ol. Para esto, se propone utilizar caracter´ısticas no supervisadas mediante word representations y colocaciones, as´ı como caracter´ısticas adicionales en un clasificador Conditional Random Field (CRF). Resultados experimentales (82.44% de F-score en el corpus CoNLL-2002) muestran que el enfoque propuesto, en particular cuando se utiliza cross-lingual word representations, es comparable a abordajes de aprendizaje profundo, actualmente el estado del arte para NER en español. |
| publishDate |
2017 |
| dc.date.accessioned.none.fl_str_mv |
2024-05-30T23:13:38Z |
| dc.date.available.none.fl_str_mv |
2024-05-30T23:13:38Z |
| dc.date.issued.fl_str_mv |
2017 |
| dc.type.none.fl_str_mv |
info:eu-repo/semantics/masterThesis |
| format |
masterThesis |
| dc.identifier.uri.none.fl_str_mv |
https://hdl.handle.net/20.500.12390/1946 |
| url |
https://hdl.handle.net/20.500.12390/1946 |
| dc.language.iso.none.fl_str_mv |
spa |
| language |
spa |
| dc.rights.none.fl_str_mv |
info:eu-repo/semantics/openAccess |
| dc.rights.uri.none.fl_str_mv |
http://creativecommons.org/licenses/by-nc/4.0/ |
| eu_rights_str_mv |
openAccess |
| rights_invalid_str_mv |
http://creativecommons.org/licenses/by-nc/4.0/ |
| dc.publisher.none.fl_str_mv |
Universidad Católica San Pablo |
| publisher.none.fl_str_mv |
Universidad Católica San Pablo |
| dc.source.none.fl_str_mv |
reponame:CONCYTEC-Institucional instname:Consejo Nacional de Ciencia Tecnología e Innovación instacron:CONCYTEC |
| instname_str |
Consejo Nacional de Ciencia Tecnología e Innovación |
| instacron_str |
CONCYTEC |
| institution |
CONCYTEC |
| reponame_str |
CONCYTEC-Institucional |
| collection |
CONCYTEC-Institucional |
| repository.name.fl_str_mv |
Repositorio Institucional CONCYTEC |
| repository.mail.fl_str_mv |
repositorio@concytec.gob.pe |
| _version_ |
1870084319306842112 |
| spelling |
Publicationrp04965600Copara Zea, Jenny Linet2024-05-30T23:13:38Z2024-05-30T23:13:38Z2017https://hdl.handle.net/20.500.12390/1946El reconocimiento de entidades nombradas es una tarea relevante en el a´rea de Procesamiento de Lenguaje Natural, su funci´on es identificar entidades en textos para un idioma dado. El estudio de esta tarea se ha enfocado principalmente en el idioma ingl´es. Recientes estudios en el idioma ingl´es han mostrado que utilizar caracter´ısticas no supervisadas tales como word embeddings mejoran el reconocimiento de entidades nombradas. En este trabajo se investiga si caracter´ısticas no supervisadas pueden mejorar la tarea de NER supervisado en el idioma espan˜ol. Para esto, se propone utilizar caracter´ısticas no supervisadas mediante word representations y colocaciones, as´ı como caracter´ısticas adicionales en un clasificador Conditional Random Field (CRF). Resultados experimentales (82.44% de F-score en el corpus CoNLL-2002) muestran que el enfoque propuesto, en particular cuando se utiliza cross-lingual word representations, es comparable a abordajes de aprendizaje profundo, actualmente el estado del arte para NER en español.Consejo Nacional de Ciencia, Tecnología e Innovación Tecnológica - ConcytecspaUniversidad Católica San Pabloinfo:eu-repo/semantics/openAccesshttp://creativecommons.org/licenses/by-nc/4.0/Word embeddingsProcesamiento de lenguaje natural-1NER para español-1NER para español-1Conditional Random Fields-1https://purl.org/pe-repo/ocde/ford#1.02.01-1Reconocimiento de entidades nombradas para el idioma español utilizando Conditional Random Fields con características no supervisadasinfo:eu-repo/semantics/masterThesisreponame:CONCYTEC-Institucionalinstname:Consejo Nacional de Ciencia Tecnología e Innovacióninstacron:CONCYTEC#PLACEHOLDER_PARENT_METADATA_VALUE#20.500.12390/1946oai:repositorio.concytec.gob.pe:20.500.12390/19462024-05-30 15:41:15.756http://creativecommons.org/licenses/by-nc/4.0/info:eu-repo/semantics/openAccesshttp://purl.org/coar/access_right/c_14cbinfo:eu-repo/semantics/closedAccessmetadata only accesshttps://repositorio.concytec.gob.peRepositorio Institucional CONCYTECrepositorio@concytec.gob.pe#PLACEHOLDER_PARENT_METADATA_VALUE#<Publication xmlns="https://www.openaire.eu/cerif-profile/1.1/" id="e654981c-6add-437a-945e-95a596159517"> <Type xmlns="https://www.openaire.eu/cerif-profile/vocab/COAR_Publication_Types">http://purl.org/coar/resource_type/c_1843</Type> <Language>spa</Language> <Title>Reconocimiento de entidades nombradas para el idioma español utilizando Conditional Random Fields con características no supervisadas</Title> <PublishedIn> <Publication> </Publication> </PublishedIn> <PublicationDate>2017</PublicationDate> <Authors> <Author> <DisplayName>Copara Zea, Jenny Linet</DisplayName> <Person id="rp04965" /> <Affiliation> <OrgUnit> </OrgUnit> </Affiliation> </Author> </Authors> <Editors> </Editors> <Publishers> <Publisher> <DisplayName>Universidad Católica San Pablo</DisplayName> <OrgUnit /> </Publisher> </Publishers> <License>http://creativecommons.org/licenses/by-nc/4.0/</License> <Keyword>Word embeddings</Keyword> <Keyword>Procesamiento de lenguaje natural</Keyword> <Keyword>NER para español</Keyword> <Keyword>NER para español</Keyword> <Keyword>Conditional Random Fields</Keyword> <Abstract>El reconocimiento de entidades nombradas es una tarea relevante en el a´rea de Procesamiento de Lenguaje Natural, su funci´on es identificar entidades en textos para un idioma dado. El estudio de esta tarea se ha enfocado principalmente en el idioma ingl´es. Recientes estudios en el idioma ingl´es han mostrado que utilizar caracter´ısticas no supervisadas tales como word embeddings mejoran el reconocimiento de entidades nombradas. En este trabajo se investiga si caracter´ısticas no supervisadas pueden mejorar la tarea de NER supervisado en el idioma espan˜ol. Para esto, se propone utilizar caracter´ısticas no supervisadas mediante word representations y colocaciones, as´ı como caracter´ısticas adicionales en un clasificador Conditional Random Field (CRF). Resultados experimentales (82.44% de F-score en el corpus CoNLL-2002) muestran que el enfoque propuesto, en particular cuando se utiliza cross-lingual word representations, es comparable a abordajes de aprendizaje profundo, actualmente el estado del arte para NER en español.</Abstract> <Access xmlns="http://purl.org/coar/access_right" > </Access> </Publication> -1 |
| score |
13.411838 |
Nota importante:
La información contenida en este registro es de entera responsabilidad de la institución que gestiona el repositorio institucional donde esta contenido este documento o set de datos. El CONCYTEC no se hace responsable por los contenidos (publicaciones y/o datos) accesibles a través del Repositorio Nacional Digital de Ciencia, Tecnología e Innovación de Acceso Abierto (ALICIA).
La información contenida en este registro es de entera responsabilidad de la institución que gestiona el repositorio institucional donde esta contenido este documento o set de datos. El CONCYTEC no se hace responsable por los contenidos (publicaciones y/o datos) accesibles a través del Repositorio Nacional Digital de Ciencia, Tecnología e Innovación de Acceso Abierto (ALICIA).