Integrated Data Analysis Pipelines for Large-Scale Data Management, HPC, and Machine Learning

Informacje na temat projektu

DAPHNE

Identyfikator umowy o grant: 957407

Strona internetowa projektu

DOI

10.3030/957407

Projekt został zamknięty

Data podpisania przez KE 14 Lipca 2020

Data rozpoczęcia 1 Grudnia 2020

Data zakończenia 30 Listopada 2024

Finansowanie w ramach

INDUSTRIAL LEADERSHIP - Leadership in enabling and industrial technologies - Information and Communication Technologies (ICT)

Koszt całkowity

€ 6 609 665,00

Wkład UE

€ 6 609 665,00

6 609 665,00

Koordynowany przez

KNOW CENTER RESEARCH GMBH
Austria

Opis projektu

Nowe systemy dla współczesnych rozwiązań opartych na danych

Infrastruktura do zarządzania danymi rozwija się w karkołomnym tempie. W celu uzyskiwania precyzyjnych prognoz nowoczesne rozwiązania oparte na danych wykorzystują duże i różnorodne zbiory danych, by na ich podstawie ustalać interesujące wzorce. Zajmujący się tą dziedziną eksperci budują również w tym celu zaawansowane modele uczenia maszynowego. W wyniku tych działań powstają nowe systemy oparte na tradycyjnych obliczeniach o dużej wydajności oraz architekturze klastrów sprzętowych. Ponadto coraz częściej obserwujemy trend tworzenia złożonych procesów przetwarzania i analizy danych, wykorzystujących zróżnicowane systemy. Uczestnicy finansowanego ze środków Unii Europejskiej projektu DAPHNE zamierzają opracować otwartą i możliwą do rozszerzenia infrastrukturę systemową na potrzeby zintegrowanych procesów analizy danych. Zespół zbuduje w tym celu referencyjną implementację abstrakcji językowych w postaci API oraz języka specyficznego dla danej domeny, a także techniki pośredniej reprezentacji, kompilacji i wykonywania.

Cel

Modern data-driven applications leverage large, heterogeneous data collections to find interesting patterns, and build robust machine learning (ML) models for accurate predictions. Large data sizes and advanced analytics spurred the development and adoption of data-parallel computation frameworks like Apache Spark or Flink as well as distributed ML systems like MLlib, TensorFlow, or PyTorch. A key observation is that these new systems share many techniques with traditional high-performance computing (HPC), and the architecture of underlying HW clusters converges. Yet, the programming paradigms, cluster resource management, as well as data formats and representations differ substantially across data management, HPC, and ML software stacks. There is a trend though, toward complex data analysis pipelines that combine these different systems. Examples are workflows of distributed data pre-processing, tuned HPC libraries, and dedicated ML systems, but also HPC applications that leverage ML models for more cost-effective simulation. Major obstacles are (1) limited development productivity for integrated analysis pipelines due to different programming models, and separated cluster environments, (2) unnecessary data movement overhead and underutilization due to separate, statically provisioned clusters, and (3) lack of a common system infrastructure with good interoperability. For these reasons, DAPHNE’s overall objective is the definition of an open and extensible systems infrastructure for integrated data analysis pipelines. We aim at building a reference implementation of language abstractions (i.e. APIs and a domain-specific language), an intermediate representation, as well as compilation and runtime techniques with support for integrating and scheduling heterogeneous accelerator and storage devices. A variety of real-world, high-impact use cases, datasets, and a new benchmark will be used for qualitative and quantitative analysis compared to state-of-the-art.

Dziedzina nauki (EuroSciVoc)

Klasyfikacja projektów w serwisie CORDIS opiera się na wielojęzycznej taksonomii EuroSciVoc, obejmującej wszystkie dziedziny nauki, w oparciu o półautomatyczny proces bazujący na technikach przetwarzania języka naturalnego. Więcej informacji: Europejski Słownik Naukowy.

Słowa kluczowe

Słowa kluczowe dotyczące projektu wybrane przez koordynatora projektu. Nie należy mylić ich z pojęciami z taksonomii EuroSciVoc dotyczącymi dziedzin nauki.

Program(-y)

Wieloletnie programy finansowania, które określają priorytety Unii Europejskiej w obszarach badań naukowych i innowacji.

H2020-EU.2.1.1. - INDUSTRIAL LEADERSHIP - Leadership in enabling and industrial technologies - Information and Communication Technologies (ICT) GŁÓWNY PROGRAM
Wyświetl wszystkie projekty finansowane w ramach tego programu

Temat(-y)

Zaproszenia do składania wniosków dzielą się na tematy. Każdy temat określa wybrany obszar lub wybrane zagadnienie, których powinny dotyczyć wnioski składane przez wnioskodawców. Opis tematu obejmuje jego szczegółowy zakres i oczekiwane oddziaływanie finansowanego projektu.

ICT-51-2020 - Big Data technologies and extreme-scale analytics
Wyświetl wszystkie projekty finansowane w ramach tego zagadnienia

System finansowania

Program finansowania (lub „rodzaj działania”) realizowany w ramach programu o wspólnych cechach. Określa zakres finansowania, stawkę zwrotu kosztów, szczegółowe kryteria oceny kwalifikowalności kosztów w celu ich finansowania oraz stosowanie uproszczonych form rozliczania kosztów, takich jak rozliczanie ryczałtowe.

RIA - Research and Innovation action

Wyświetl wszystkie projekty finansowane w ramach tego programu finansowania

Zaproszenie do składania wniosków

Procedura zapraszania wnioskodawców do składania wniosków projektowych w celu uzyskania finansowania ze środków Unii Europejskiej.

(odnośnik otworzy się w nowym oknie) H2020-ICT-2018-20

Wyświetl wszystkie projekty finansowane w ramach tego zaproszenia

Koordynator

KNOW CENTER RESEARCH GMBH

Wkład UE netto

€ 737 732,50

Adres

SANDGASSE 34
8010 GRAZ
Austria

Region

Südösterreich Steiermark Graz

Rodzaj działalności

Research Organisations

Linki

Kontakt z organizacją Strona internetowa

Uczestnictwo w unijnych programach w zakresie badań i innowacji

sieć współpracy HORIZON

Koszt całkowity

€ 737 732,50

Uczestnicy (13)

AVL LIST GMBH

Austria

Wkład UE netto

€ 419 175,00

DEUTSCHES ZENTRUM FUR LUFT - UND RAUMFAHRT EV

Niemcy

Wkład UE netto

€ 849 830,00

EIDGENOESSISCHE TECHNISCHE HOCHSCHULE ZUERICH

Szwajcaria

Wkład UE netto

€ 448 032,50

HASSO-PLATTNER-INSTITUT FUR DIGITAL ENGINEERING GGMBH

Niemcy

Wkład UE netto

€ 458 750,00

EREVNITIKO PANEPISTIMIAKO INSTITOUTO SYSTIMATON EPIKOINONION KAI YPOLOGISTON

Grecja

Wkład UE netto

€ 415 000,00

INFINEON TECHNOLOGIES AUSTRIA AG

Austria

Wkład UE netto

€ 436 015,00

INTEL TECHNOLOGY POLAND SPOLKA Z OGRANICZONA ODPOWIEDZIALNOSCIA

Polska

Wkład UE netto

€ 271 375,00

IT-UNIVERSITETET I KOBENHAVN

Dania

Wkład UE netto

€ 523 100,00

KAI KOMPETENZZENTRUM AUTOMOBIL - UND INDUSTRIEELEKTRONIK GMBH

Austria

Wkład UE netto

€ 470 875,00

TECHNISCHE UNIVERSITAET DRESDEN

Niemcy

Wkład UE netto

€ 409 500,00

UNIVERZA V MARIBORU

Słowenia

Wkład UE netto

€ 244 975,00

UNIVERSITAT BASEL

Szwajcaria

Wkład UE netto

€ 700 148,75

TECHNISCHE UNIVERSITAT BERLIN

Niemcy

Wkład UE netto

€ 225 156,25

Opis projektu

Nowe systemy dla współczesnych rozwiązań opartych na danych

Cel

Słowa kluczowe

Słowa kluczowe dotyczące projektu wybrane przez koordynatora projektu. Nie należy mylić ich z pojęciami z taksonomii EuroSciVoc dotyczącymi dziedzin nauki.

Program(-y)

Wieloletnie programy finansowania, które określają priorytety Unii Europejskiej w obszarach badań naukowych i innowacji.

Temat(-y)

Zaproszenia do składania wniosków dzielą się na tematy. Każdy temat określa wybrany obszar lub wybrane zagadnienie, których powinny dotyczyć wnioski składane przez wnioskodawców. Opis tematu obejmuje jego szczegółowy zakres i oczekiwane oddziaływanie finansowanego projektu.

Zaproszenie do składania wniosków

Procedura zapraszania wnioskodawców do składania wniosków projektowych w celu uzyskania finansowania ze środków Unii Europejskiej.

Koordynator

Uczestnicy (13)

Udostępnij tę stronę Udostępnij tę stronę w mediach społecznościowych

Pobierz Pobierz zawartość strony

Integrated Data Analysis Pipelines for Large-Scale Data Management, HPC, and Machine Learning

Opis projektu

Nowe systemy dla współczesnych rozwiązań opartych na danych

Cel

Słowa kluczowe Słowa kluczowe dotyczące projektu wybrane przez koordynatora projektu. Nie należy mylić ich z pojęciami z taksonomii EuroSciVoc dotyczącymi dziedzin nauki.

Program(-y) Wieloletnie programy finansowania, które określają priorytety Unii Europejskiej w obszarach badań naukowych i innowacji.

Temat(-y) Zaproszenia do składania wniosków dzielą się na tematy. Każdy temat określa wybrany obszar lub wybrane zagadnienie, których powinny dotyczyć wnioski składane przez wnioskodawców. Opis tematu obejmuje jego szczegółowy zakres i oczekiwane oddziaływanie finansowanego projektu.

Zaproszenie do składania wniosków Procedura zapraszania wnioskodawców do składania wniosków projektowych w celu uzyskania finansowania ze środków Unii Europejskiej.

Koordynator

Uczestnicy (13)

Udostępnij tę stronę Udostępnij tę stronę w mediach społecznościowych

Pobierz Pobierz zawartość strony

Słowa kluczowe

Słowa kluczowe dotyczące projektu wybrane przez koordynatora projektu. Nie należy mylić ich z pojęciami z taksonomii EuroSciVoc dotyczącymi dziedzin nauki.

Program(-y)

Wieloletnie programy finansowania, które określają priorytety Unii Europejskiej w obszarach badań naukowych i innowacji.

Temat(-y)

Zaproszenia do składania wniosków dzielą się na tematy. Każdy temat określa wybrany obszar lub wybrane zagadnienie, których powinny dotyczyć wnioski składane przez wnioskodawców. Opis tematu obejmuje jego szczegółowy zakres i oczekiwane oddziaływanie finansowanego projektu.

Zaproszenie do składania wniosków

Procedura zapraszania wnioskodawców do składania wniosków projektowych w celu uzyskania finansowania ze środków Unii Europejskiej.