Eins A Medien
Science-Fiction- und Fantasy-Hörbücher
aus der Welt von PERRY RHODAN
und dem WARHAMMER-Universum der BLACK LIBRARY

Untersuchung der Migration einer MySQL basierten Monitoring & Data-Warehouse Lösung nach Hadoop

34,99 €
inkl. 7% MwSt. und
ggf. zzgl. Versand

Masterarbeit aus dem Jahr 2012 im Fachbereich Informatik - Angewandte Informatik, Note: 1.0, Hochschule für Technik und Wirtschaft Berlin, Sprache: Deutsch, Abstract: Die escape GmbH betreibt ein MySQL basiertes Dataware-House in das Daten ausverschiedenen Webpräsenzen fließen, um dort ausgewertet zu werden. Nach Jahren deserfolgreichen Betriebs nimmt mit der ständig steigenden Menge an gespeicherten Datendie Leistung des Systems allerdings ab. Die Laufzeiten für Auswertungen steigen unddie Agilität sinkt. Kleine Optimierungen und Veränderungen des Systems können dasUnbrauchbarwerden hinauszögern, als aber aus Gründen der Leistung auf einen Teilder Abfragen verzichtet werden muss, wird schließlich klar, dass nur eine grundlegendeVeränderung des Systems den langfristigen Betrieb sicherstellen kann. Aus diesem Grundwurde nach Technologien gesucht, deren Fähigkeiten die Leistung des bestehendenDataware-Houses verbessern können. Dies führte zu Hadoop [Fouc][Whi10a], einem OpenSource Framework, welches die Verarbeitung von riesigen Datenmengen in einem Clustererlaubt.Diese Arbeit untersucht, wie Komponenten des bisherigen Systems durch Dienste vonHadoop ersetzt werden können. Sie wertet die Möglichkeiten zur Strukturierung vonDaten in einer spaltenbasierten Datenbank aus, evaluiert in einem Benchmark, wie sichdie Zeit von Abfragen im Verhältnis zu einer stetig steigenden Datenmenge verhält undanalysiert detailliert den Ressourcenverbrauch des Clusters und dessen Knoten.Die Implementierung zeigt, dass sich die spaltenbasierten Datenbank HBase sehr gutzum Speichern von einer sehr großen Menge an semistrukturierten Daten eignet und dieDataware-House Komponente Hive durch die Unterstützung eines SQL ähnlichen Syntaxdas Erstellen von Abfragen komfortabel ermöglicht. Die Literatur beschreibt, dass HBaseautomatisch linear mit dem Hinzufügen von neuen Knoten skaliert. Der durchgeführteBenchmark zeigt, dass die Ausführungs-Zeit der getesteten Abfragen fast genau linear zurDatenmenge steigt, der Ressourcenverbrauch nur gering wächst und die Last im Clustergleichmäßig verteilt wird. Dies lässt die Schlussfolgerung zu, dass sich Hadoop gut zumBetrieb einer Dataware-House Lösung eignet.

Untersuchung der Migration einer MySQL basierten Monitoring & Data-Warehouse Lösung nach Hadoop
  • Autor: Jonas Kress
  • Seitenzahl: 98
  • Format: EPUB
  • DRM: social-drm (ohne Kopierschutz)
  • Erscheinungsdatum: 27.05.2013
  • Herausgeber: GRIN VERLAG
$( "#countryselect" ).dialog("open");