• Treffer 3 von 3
Zurück zur Trefferliste

RHEEMix in the data jungle

  • Data analytics are moving beyond the limits of a single platform. In this paper, we present the cost-based optimizer of Rheem, an open-source cross-platform system that copes with these new requirements. The optimizer allocates the subtasks of data analytic tasks to the most suitable platforms. Our main contributions are: (i) a mechanism based on graph transformations to explore alternative execution strategies; (ii) a novel graph-based approach to determine efficient data movement plans among subtasks and platforms; and (iii) an efficient plan enumeration algorithm, based on a novel enumeration algebra. We extensively evaluate our optimizer under diverse real tasks. We show that our optimizer can perform tasks more than one order of magnitude faster when using multiple platforms than when using a single platform.

Metadaten exportieren

Weitere Dienste

Suche bei Google Scholar Statistik - Anzahl der Zugriffe auf das Dokument
Metadaten
Verfasserangaben:Sebastian KruseORCiDGND, Zoi KaoudiORCiD, Bertty Contreras-Rojas, Sanjay Chawla, Felix NaumannORCiDGND, Jorge-Arnulfo Quiane-RuizORCiD
DOI:https://doi.org/10.1007/s00778-020-00612-x
ISSN:1066-8888
ISSN:0949-877X
Titel des übergeordneten Werks (Englisch):The VLDB Journal
Untertitel (Englisch):a cost-based optimizer for cross-platform systems
Verlag:Springer
Verlagsort:Berlin
Publikationstyp:Wissenschaftlicher Artikel
Sprache:Englisch
Datum der Erstveröffentlichung:18.05.2020
Erscheinungsjahr:2020
Datum der Freischaltung:16.11.2023
Freies Schlagwort / Tag:Cross-platform; Data processing; Polystore; Query optimization
Band:29
Ausgabe:6
Seitenanzahl:24
Erste Seite:1287
Letzte Seite:1310
Fördernde Institution:Projekt DEAL
Organisationseinheiten:Digital Engineering Fakultät / Hasso-Plattner-Institut für Digital Engineering GmbH
DDC-Klassifikation:0 Informatik, Informationswissenschaft, allgemeine Werke / 00 Informatik, Wissen, Systeme / 000 Informatik, Informationswissenschaft, allgemeine Werke
Peer Review:Referiert
Publikationsweg:Open Access / Hybrid Open-Access
Lizenz (Deutsch):License LogoCC-BY - Namensnennung 4.0 International
Externe Anmerkung:Zweitveröffentlichung in der Schriftenreihe Zweitveröffentlichungen der Universität Potsdam : Reihe der Digital Engineering Fakultät ; 22
Verstanden ✔
Diese Webseite verwendet technisch erforderliche Session-Cookies. Durch die weitere Nutzung der Webseite stimmen Sie diesem zu. Unsere Datenschutzerklärung finden Sie hier.