Análise lexicográfica da produção acadêmica da Fiocruz: uma proposta de metodologia

dc.contributor.advisorSouza, Renato Rocha
dc.contributor.authorLima, Jefferson da Costa
dc.contributor.memberSilva, Moacyr Alvim Horta Barbosa da
dc.contributor.memberPedroso, Marcel de Moraes
dc.contributor.unidadefgvEscolas::EMAppor
dc.date.accessioned2016-11-08T17:24:34Z
dc.date.available2016-11-08T17:24:34Z
dc.date.issued2016-09-09
dc.description.abstractWith the objective to meet the health needs of the population, a huge amount of publications are generated each year. Scientific papers, thesis and dissertations become available digitally, but make them accessible to the user requires an understanding of the indexing process, which is usually made manually. This work proposes an experiment on the feasibility of automatically identify valid descriptors for the documents in the field of health. Are extracted n-grams of the texts and, after comparison with terms of vocabulary Health Sciences Descriptors (DeCS), are identified those who can act as descriptors for the works. We believe that this process can be applied to classification of document sets with deficiencies in their indexing and, even, in supporting the re-indexing processes, improving the precision and recall of the searches, and the possibility of establishing metrics of relevance.eng
dc.description.abstractCom o objetivo de atender às demandas de saúde da população, uma quantidade enorme de publicações são geradas a cada ano. Artigos científicos, teses e dissertações tornam-se digitalmente disponíveis, mas torná-los acessíveis aos usuário exige a compreensão do processo de indexação, que em geral é feito manualmente. O presente trabalho propõe um experimento sobre a viabilidade de identificar automaticamente descritores válidos para documentos do campo da saúde. São extraídos n-grams dos textos e, após comparação com termos do vocabulário Descritores em Ciências da Saúde (DeCS), são identificados aqueles que podem atuar como descritores para as obras. Acreditamos que este processo pode ser aplicado na classificação de conjuntos de documentos com deficiências na indexação e, até mesmo, no apoio a processos de reindexação, melhorando a precisão e a revocação das buscas, além da possibilidade de estabelecer métricas de relevância.por
dc.identifier.citationLIMA, Jefferson da Costa. Análise lexicográfica da produção acadêmica da Fiocruz: uma proposta de metodologia. Dissertação (Mestrado em Matemática Aplicada) - Escola de Matemática Aplicada, Fundação Getúlio Vargas - FGV, Rio de Janeiro, 2016.
dc.identifier.urihttps://hdl.handle.net/10438/17458
dc.language.isopor
dc.subjectProcessamento de linguagem naturalpor
dc.subjectMineração de textospor
dc.subjectDescritores em ciências da saúdepor
dc.subject.areaMatemáticapor
dc.subject.bibliodataProcessamento da linguagem natural (Computação)por
dc.subject.bibliodataMineração de dados (Computação)por
dc.titleAnálise lexicográfica da produção acadêmica da Fiocruz: uma proposta de metodologiapor
dc.typeDissertationeng

Arquivos

Pacote original

Agora exibindo 1 - 1 de 1
Carregando...
Imagem de Miniatura
Nome:
JeffersonLima-Dissertação.pdf
Tamanho:
1.79 MB
Formato:
Adobe Portable Document Format
Descrição:

Licença do pacote

Agora exibindo 1 - 1 de 1
Carregando...
Imagem de Miniatura
Nome:
license.txt
Tamanho:
4.6 KB
Formato:
Item-specific license agreed upon to submission
Descrição: