Key points are not available for this paper at this time.
Der Inhalt des Webs ist zunehmend zum Schwerpunkt akademischer Forschung geworden. Computerprogramme sind erforderlich, um eine großflächige Verarbeitung von Webseiten durchzuführen, was zu einem gewissen Zeitpunkt die Nutzung eines Web-Crawlers erfordert, um die zu analysierenden Seiten abzurufen. Die Verarbeitung des Textes von Webseiten zur Informationsgewinnung kann in Bezug auf die Prozessorzeit kostspielig sein. Folglich wird ein verteiltes Design vorgeschlagen, um die ungenutzten Rechenressourcen effektiv zu nutzen und den Informationswissenschaftlern zu helfen, die Notwendigkeit, spezielle Geräte einzusetzen, zu vermeiden. Ein mit diesem Modell entwickeltes System wird untersucht, und die Vorteile und Einschränkungen des Ansatzes werden diskutiert.
Mike Thelwall (Mon,) hat diese Frage untersucht.