Skip to main content

2012 | OriginalPaper | Buchkapitel

Learning to Find Comparable Entities on the Web

verfasst von : Xiaojiang Huang, Xiaojun Wan, Jianguo Xiao

Erschienen in: Web Information Systems Engineering - WISE 2012

Verlag: Springer Berlin Heidelberg

Aktivieren Sie unsere intelligente Suche, um passende Fachinhalte oder Patente zu finden.

search-config
loading …

Comparison is a popular way for people to discover the commonality and difference between two entities (e.g. product, person, company, event, etc.). It would be very useful to automatically provide comparison results for the user. The prerequisite step of this task is to find comparable entities. In this paper, we propose a novel Web mining system to address the task of finding comparable entities for a given single entity. First, the system uses a bootstrapping method to find candidate entities for the given entity through natural language analysis in the snippets of search engine results. Then, the system uses set expansion techniques to find more candidate entities though semi-structured HTML analysis in the downloaded web pages. Finally, the system uses a supervised learning method to classify the candidate entities into either comparable or incomparable by incorporating linguistic, statistical and semantic features. Experimental results demonstrate that our proposed framework can outperform the baseline systems.

Sie haben noch keine Lizenz? Dann Informieren Sie sich jetzt über unsere Produkte:

Springer Professional "Wirtschaft+Technik"

Online-Abonnement

Mit Springer Professional "Wirtschaft+Technik" erhalten Sie Zugriff auf:

  • über 102.000 Bücher
  • über 537 Zeitschriften

aus folgenden Fachgebieten:

  • Automobil + Motoren
  • Bauwesen + Immobilien
  • Business IT + Informatik
  • Elektrotechnik + Elektronik
  • Energie + Nachhaltigkeit
  • Finance + Banking
  • Management + Führung
  • Marketing + Vertrieb
  • Maschinenbau + Werkstoffe
  • Versicherung + Risiko

Jetzt Wissensvorsprung sichern!

Springer Professional "Technik"

Online-Abonnement

Mit Springer Professional "Technik" erhalten Sie Zugriff auf:

  • über 67.000 Bücher
  • über 390 Zeitschriften

aus folgenden Fachgebieten:

  • Automobil + Motoren
  • Bauwesen + Immobilien
  • Business IT + Informatik
  • Elektrotechnik + Elektronik
  • Energie + Nachhaltigkeit
  • Maschinenbau + Werkstoffe




 

Jetzt Wissensvorsprung sichern!

Springer Professional "Wirtschaft"

Online-Abonnement

Mit Springer Professional "Wirtschaft" erhalten Sie Zugriff auf:

  • über 67.000 Bücher
  • über 340 Zeitschriften

aus folgenden Fachgebieten:

  • Bauwesen + Immobilien
  • Business IT + Informatik
  • Finance + Banking
  • Management + Führung
  • Marketing + Vertrieb
  • Versicherung + Risiko




Jetzt Wissensvorsprung sichern!

Metadaten
Titel
Learning to Find Comparable Entities on the Web
verfasst von
Xiaojiang Huang
Xiaojun Wan
Jianguo Xiao
Copyright-Jahr
2012
Verlag
Springer Berlin Heidelberg
DOI
https://doi.org/10.1007/978-3-642-35063-4_2

Premium Partner