TrustRank

TrustRank es una técnica de análisis de hiperenlaces descrita en un documento elaborado por la Universidad de Stanford y Yahoo!. Este sistema separa las pági…

TrustRank

TrustRank es una técnica de análisis de hiperenlaces descrita en un documento elaborado por la Universidad de Stanford y Yahoo!. Este sistema separa las páginas web útiles de las de spam de manera semiautomática.[1]

Muchas páginas web de spam son creadas sólo con la intención de engañar a los motores de búsqueda. Estas páginas, creadas principalmente por razones comerciales, usan diversas técnicas para lograr una clasificación más alta en los resultados de los buscadores. Mientras que los expertos humanos pueden identificar fácilmente el spam, es demasiado costoso evaluar un gran número de páginas manualmente.

Un método popular para mejorar la clasificación es aumentar artificialmente la importancia percibida de un documento a través de complejos sistemas de vinculación. PageRank de Google y otros métodos creados para determinar la importancia relativa de los documentos de la Web han sido objeto de manipulación.

El método TrustRank solicita que un pequeño conjunto de páginas de ejemplo sean evaluadas por un experto. Una vez que las páginas de buena reputación están identificadas manualmente, se rastrean otras páginas comparándolas con las de ejemplo. El índice de fiabilidad de una página disminuye a medida que se parece más a las páginas calificadas como spam por los expertos.

Los investigadores que propusieron la metodología TrustRank han seguido perfeccionando su labor mediante la evaluación de temas relacionados, como la medición de la masa de spam.

Referencias

  1. Garcia-Molina, Hector y Pedersen Jan (2004). «Combating Web Spam with TrustRank». Proceedings of the International Conference on Very Large Data Bases 30. 576. Archivado desde el original el 5 de abril de 2015. Consultado el 5 de octubre de 2009. 

Enlaces externos

Content Disclaimer

Informasi ini disarikan dari Wikipedia dan disajikan kembali untuk tujuan edukasi. Konten tersedia di bawah lisensi CC BY-SA 3.0. Kami tidak bertanggung jawab atas ketidakakuratan data yang bersumber dari kontribusi publik tersebut.

  1. The information displayed on this website is sourced in part or in whole from Wikipedia and has been adapted for the purpose of restating it. We strive to provide accurate and relevant information, however:
  2. There is no guarantee of absolute accuracy. Wikipedia is an open, collaborative project that can be edited by anyone, so information is subject to change.
  3. It is not intended to constitute professional advice. The content displayed is for informational and educational purposes only. For important decisions (e.g., medical, legal, or financial), please consult a professional.
  4. Content copyright. Wikipedia is licensed under the Creative Commons Attribution-ShareAlike License (CC BY-SA). This means that content may be reused with appropriate attribution and shared under a similar license.
  5. Responsible use. Any risk arising from the use of information from this website is entirely the responsibility of the user.