Integrated Data Analysis Pipelines for Large-Scale Data Management, HPC, and Machine Learning

Projektinformationen

DAPHNE

ID Finanzhilfevereinbarung: 957407

DOI

10.3030/957407

Projekt abgeschlossen

EK-Unterschriftsdatum 14 Juli 2020

Startdatum 1 Dezember 2020

Enddatum 30 November 2024

Finanziert unter

INDUSTRIAL LEADERSHIP - Leadership in enabling and industrial technologies - Information and Communication Technologies (ICT)

Gesamtkosten

€ 6 609 665,00

EU-Beitrag

€ 6 609 665,00

6 609 665,00

Koordiniert durch

KNOW CENTER RESEARCH GMBH
Austria

Projektbeschreibung

Neue Systeme für datengestützte Anwendungen von heute

Die Infrastruktur, die der Datenverwaltung dient, wächst rasant. Zur Erstellung exakter Prognosen nutzen moderne, datengestützte Anwendungen umfangreiche, heterogene Datenbestände, die interessante Muster enthüllen. Außerdem entstehen robuste Maschinenlernmodelle, die dabei helfen sollen, genaue Vorhersagen zu treffen. Darauf aufbauend werden neue Systeme entwickelt, die traditionelles Hochleistungsrechnen und die Architektur darunterliegender Hardwarecluster nutzen. Es ist auch ein Trend in Richtung komplexer Pipelines für die Datenanalyse, bei denen verschiedene Systeme kombiniert werden, zu beobachten. Das EU-finanzierte Projekt DAPHNE wird eine offene und erweiterbare Systeminfrastruktur festlegen, die auf integrierte Pipelines für die Datenanalyse ausgerichtet ist. Dazu erstellt das Projektteam eine Referenzimplementierung von Sprachabstraktionen (Anwendungsprogrammierschnittstellen und eine domänenspezifische Sprache) sowie eine Zwischendarstellung und gestaltet Kompilierverfahren und Laufzeitmethoden.

Ziel

Modern data-driven applications leverage large, heterogeneous data collections to find interesting patterns, and build robust machine learning (ML) models for accurate predictions. Large data sizes and advanced analytics spurred the development and adoption of data-parallel computation frameworks like Apache Spark or Flink as well as distributed ML systems like MLlib, TensorFlow, or PyTorch. A key observation is that these new systems share many techniques with traditional high-performance computing (HPC), and the architecture of underlying HW clusters converges. Yet, the programming paradigms, cluster resource management, as well as data formats and representations differ substantially across data management, HPC, and ML software stacks. There is a trend though, toward complex data analysis pipelines that combine these different systems. Examples are workflows of distributed data pre-processing, tuned HPC libraries, and dedicated ML systems, but also HPC applications that leverage ML models for more cost-effective simulation. Major obstacles are (1) limited development productivity for integrated analysis pipelines due to different programming models, and separated cluster environments, (2) unnecessary data movement overhead and underutilization due to separate, statically provisioned clusters, and (3) lack of a common system infrastructure with good interoperability. For these reasons, DAPHNE’s overall objective is the definition of an open and extensible systems infrastructure for integrated data analysis pipelines. We aim at building a reference implementation of language abstractions (i.e. APIs and a domain-specific language), an intermediate representation, as well as compilation and runtime techniques with support for integrating and scheduling heterogeneous accelerator and storage devices. A variety of real-world, high-impact use cases, datasets, and a new benchmark will be used for qualitative and quantitative analysis compared to state-of-the-art.

Wissenschaftliches Gebiet (EuroSciVoc)

CORDIS klassifiziert Projekte mit EuroSciVoc, einer mehrsprachigen Taxonomie der Wissenschaftsbereiche, durch einen halbautomatischen Prozess, der auf Verfahren der Verarbeitung natürlicher Sprache beruht. Siehe: Das European Science Vocabulary.

Schlüsselbegriffe

Schlüsselbegriffe des Projekts, wie vom Projektkoordinator angegeben. Nicht zu verwechseln mit der EuroSciVoc-Taxonomie (Wissenschaftliches Gebiet).

Programm/Programme

Mehrjährige Finanzierungsprogramme, in denen die Prioritäten der EU für Forschung und Innovation festgelegt sind.

H2020-EU.2.1.1. - INDUSTRIAL LEADERSHIP - Leadership in enabling and industrial technologies - Information and Communication Technologies (ICT) HAUPTPROGRAMM
Alle im Rahmen dieses Programms finanzierten Projekte anzeigen

Thema/Themen

Aufforderungen zur Einreichung von Vorschlägen sind nach Themen gegliedert. Ein Thema definiert einen bestimmten Bereich oder ein Gebiet, zu dem Vorschläge eingereicht werden können. Die Beschreibung eines Themas umfasst seinen spezifischen Umfang und die erwarteten Auswirkungen des finanzierten Projekts.

ICT-51-2020 - Big Data technologies and extreme-scale analytics
Alle im Rahmen dieses Themas finanzierten Projekte anzeigen

Finanzierungsplan

Finanzierungsregelung (oder „Art der Maßnahme“) innerhalb eines Programms mit gemeinsamen Merkmalen. Sieht folgendes vor: den Umfang der finanzierten Maßnahmen, den Erstattungssatz, spezifische Bewertungskriterien für die Finanzierung und die Verwendung vereinfachter Kostenformen wie Pauschalbeträge.

RIA - Research and Innovation action

Alle im Rahmen dieses Finanzierungsinstruments finanzierten Projekte anzeigen

Aufforderung zur Vorschlagseinreichung

Verfahren zur Aufforderung zur Einreichung von Projektvorschlägen mit dem Ziel, eine EU-Finanzierung zu erhalten.

(öffnet in neuem Fenster) H2020-ICT-2018-20

Alle im Rahmen dieser Aufforderung zur Einreichung von Vorschlägen finanzierten Projekte anzeigen

Koordinator

KNOW CENTER RESEARCH GMBH

Netto-EU-Beitrag

€ 737 732,50

Adresse

SANDGASSE 34
8010 Graz
Österreich

Region

Südösterreich Steiermark Graz

Aktivitätstyp

Research Organisations

Links

Die Organisation kontaktieren

Website

Teilnahme an EU-FuI-Programmen

HORIZON-Kooperationsnetzwerk

Gesamtkosten

€ 737 732,50

Beteiligte (13)

AVL LIST GMBH

Österreich

Netto-EU-Beitrag

€ 419 175,00

DEUTSCHES ZENTRUM FUR LUFT - UND RAUMFAHRT EV

Deutschland

Netto-EU-Beitrag

€ 849 830,00

EIDGENOESSISCHE TECHNISCHE HOCHSCHULE ZUERICH

Schweiz

Netto-EU-Beitrag

€ 448 032,50

HASSO-PLATTNER-INSTITUT FUR DIGITAL ENGINEERING GGMBH

Deutschland

Netto-EU-Beitrag

€ 458 750,00

EREVNITIKO PANEPISTIMIAKO INSTITOUTO SYSTIMATON EPIKOINONION KAI YPOLOGISTON

Griechenland

Netto-EU-Beitrag

€ 415 000,00

INFINEON TECHNOLOGIES AUSTRIA AG

Österreich

Netto-EU-Beitrag

€ 436 015,00

INTEL TECHNOLOGY POLAND SPOLKA Z OGRANICZONA ODPOWIEDZIALNOSCIA

Polen

Netto-EU-Beitrag

€ 271 375,00

IT-UNIVERSITETET I KOBENHAVN

Dänemark

Netto-EU-Beitrag

€ 523 100,00

KAI KOMPETENZZENTRUM AUTOMOBIL - UND INDUSTRIEELEKTRONIK GMBH

Österreich

Netto-EU-Beitrag

€ 470 875,00

TECHNISCHE UNIVERSITAET DRESDEN

Deutschland

Netto-EU-Beitrag

€ 409 500,00

UNIVERZA V MARIBORU

Slowenien

Netto-EU-Beitrag

€ 244 975,00

UNIVERSITAT BASEL

Schweiz

Netto-EU-Beitrag

€ 700 148,75

TECHNISCHE UNIVERSITAT BERLIN

Deutschland

Netto-EU-Beitrag

€ 225 156,25

Projektbeschreibung

Neue Systeme für datengestützte Anwendungen von heute

Ziel

Wissenschaftliches Gebiet (EuroSciVoc) CORDIS klassifiziert Projekte mit EuroSciVoc, einer mehrsprachigen Taxonomie der Wissenschaftsbereiche, durch einen halbautomatischen Prozess, der auf Verfahren der Verarbeitung natürlicher Sprache beruht. Siehe: Das European Science Vocabulary.

Schlüsselbegriffe Schlüsselbegriffe des Projekts, wie vom Projektkoordinator angegeben. Nicht zu verwechseln mit der EuroSciVoc-Taxonomie (Wissenschaftliches Gebiet).

Programm/Programme Mehrjährige Finanzierungsprogramme, in denen die Prioritäten der EU für Forschung und Innovation festgelegt sind.

Aufforderung zur Vorschlagseinreichung Verfahren zur Aufforderung zur Einreichung von Projektvorschlägen mit dem Ziel, eine EU-Finanzierung zu erhalten.

Koordinator

Beteiligte (13)

Herunterladen Den Inhalt der Seite herunterladen

Wissenschaftliches Gebiet (EuroSciVoc)

CORDIS klassifiziert Projekte mit EuroSciVoc, einer mehrsprachigen Taxonomie der Wissenschaftsbereiche, durch einen halbautomatischen Prozess, der auf Verfahren der Verarbeitung natürlicher Sprache beruht. Siehe: Das European Science Vocabulary.

Schlüsselbegriffe

Schlüsselbegriffe des Projekts, wie vom Projektkoordinator angegeben. Nicht zu verwechseln mit der EuroSciVoc-Taxonomie (Wissenschaftliches Gebiet).

Programm/Programme

Mehrjährige Finanzierungsprogramme, in denen die Prioritäten der EU für Forschung und Innovation festgelegt sind.

Aufforderung zur Vorschlagseinreichung

Verfahren zur Aufforderung zur Einreichung von Projektvorschlägen mit dem Ziel, eine EU-Finanzierung zu erhalten.