• JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
  • JoomlaWorks Simple Image Rotator
 
  Bookmark and Share
 
 
Mémoire de Maîtrise
DOI
10.11606/D.55.2013.tde-03072013-145313
Document
Auteur
Nom complet
Raíza Tamae Sarkis Hanada
Adresse Mail
Unité de l'USP
Domain de Connaissance
Date de Soutenance
Editeur
São Carlos, 2013
Directeur
Jury
Pimentel, Maria da Graça Campos (Président)
Meira Junior, Wagner
Pardo, Thiago Alexandre Salgueiro
Titre en portugais
Métricas de análise de links e qualidade de conteúdo: um estudo de caso na Wikipédia
Mots-clés en portugais
Análise de links
Recuperação da informação
Wikipédia
Resumé en portugais
Muitos links entre páginas na Web podem ser vistos como indicadores de qualidade e importância para as páginas que eles apontam. A partir desta ideia, vários estudos propuseram métricas baseadas na estrutura de links para inferir qualidade de conteúdo em páginas da web. Contudo, até onde sabemos, o único trabalho que examinou a correlação entre tais métricas e qualidade de conteúdo consistiu de um estudo limitado que deixou várias questões em aberto. Embora tais métricas sejam muito bem sucedidas na tarefa de ranquear páginas que foram fornecidas como respostas para consultas submetidas para máquinas de busca, não é possível determinar a contribuição específica de fatores como qualidade, popularidade e importância para os resultados. Esta dificuldade se deve em parte ao fato de que a informação sobre qualidade, popularidade e importância é difícil de obter para páginas da web em geral. Ao contrário de páginas da web, estas informações podem ser obtidas para artigos da Wikipédia, uma vez que qualidade e importância são avaliadas por especialistas humanos, enquanto a popularidade pode ser estimada com base nas visualizações dos artigos. Isso torna possível a verificação da relação existente entre estes fatores e métricas de análise de links, nosso objetivo neste trabalho. Para fazer isto, nós implementamos vários algoritmos de análise de links e comparamos os rankings obtidos com eles com os obtidos considerando a avaliação humana feita na Wikipédia com relação aos fatores qualidade, popularidade e importância. Nós observamos que métricas de análise de links são mais relacionadas com qualidade e popularidade que com importância e a correlação é moderada
Titre en anglais
Link analysis metrics and content quality: a case of study in Wikipedia
Mots-clés en anglais
Informartion retrieval
Link analysis
Wikipedia
Resumé en anglais
Many links between Web pages can be viewed as indicative of the quality and importance of the pages pointed to. Accordingly, several studies have proposed metrics based on links to infer web page content quality. However, as far as we know, the only work that has examined the correlation between such metrics and content quality consisted of a limited study that left many open questions. In spite of these metrics having been shown successful in the task of ranking pages which were provided as answers to queries submitted to search machines, it is not possible to determine the specific contribution of factors such as quality, popularity, and importance to the results. This difficulty is partially due to the fact that such information is hard to obtain for Web pages in general. Unlike ordinary Web pages, the content quality of Wikipedia articles is evaluated by human experts, which makes it feasible to verify the relation between such link analysis metrics and the quality of Wikipedia articles, our goal in this work. To accomplish that, we implemented several link analysis algorithms and compared their resulting rankings with the ones created by human evaluators regarding factors such as quality, popularity and importance. We found that the metrics are more correlated to quality and popularity than to importance, and the correlation is moderate
 
AVERTISSEMENT - Regarde ce document est soumise à votre acceptation des conditions d'utilisation suivantes:
Ce document est uniquement à des fins privées pour la recherche et l'enseignement. Reproduction à des fins commerciales est interdite. Cette droits couvrent l'ensemble des données sur ce document ainsi que son contenu. Toute utilisation ou de copie de ce document, en totalité ou en partie, doit inclure le nom de l'auteur.
dissertacao.pdf (1.38 Mbytes)
Date de Publication
2013-07-03
 
AVERTISSEMENT: Le matériau se réfère à des documents provenant de cette thèse ou mémoire. Le contenu de ces documents est la responsabilité de l'auteur de la thèse ou mémoire.
  • HANADA, R. T. S., CRISTO, M. A. P., e PIMENTEL, Maria da Graca Campos. Métricas de Análise de Links e Qualidade de Conteúdo: um estudo de caso na Wikipédia. In WTD - Webmedia 2012, São Paulo/SP, 2012. Workshop de Teses e Dissertações do Webmedia. : SBC, 2012. Dispon?vel em: http://sws2012.ime.usp.br/download/WebMedia2012_Anais.pdf.
  • HANADA, RAÍZA, CRISTO, MARCO, and PIMENTEL, MARIA DA GRAÇA CAMPOS. How do metrics of link analysis correlate to quality, relevance and popularity in wikipedia? [doi:10.1145/2526188.2526198]. In the 19th Brazilian symposium, Salvador, 2013. Proceedings of the 19th Brazilian symposium on Multimedia and the web - WebMedia '13.New York : ACM Press, 2013. Abstract.
  • HIMORO, MARCELO YUJI, et al. An investigation of the relationship between the amount of extra-textual data and the quality of Wikipedia articles [doi:10.1145/2526188.2526218]. In the 19th Brazilian symposium, Salvador, 2013. Proceedings of the 19th Brazilian symposium on Multimedia and the web - WebMedia '13.New York : ACM Press, 2013. Resumo.
Tous droits de la thèse/dissertation appartiennent aux auteurs
Centro de Informática de São Carlos
Bibliothèque Numérique de Thèses et Mémoires de l'USP. Copyright © 2001-2020. Tous droits réservés.