Reliable Data-Driven Decision Making in Cyber-Physical Systems

Informations projet

RADDICS

N° de convention de subvention: 815943

DOI

10.3030/815943

Projet clôturé

Date de signature de la CE 18 Decembre 2018

Date de début 1 Janvier 2019

Date de fin 30 Juin 2024

Financé au titre de

EXCELLENT SCIENCE - European Research Council (ERC)

Coût total

€ 1 996 500,00

Contribution de l’UE

€ 1 996 500,00

1 996 500,00

Coordonné par

EIDGENOESSISCHE TECHNISCHE HOCHSCHULE ZUERICH
Switzerland

Description du projet

Faire passer l’apprentissage par renforcement au niveau supérieur

L’apprentissage par renforcement (AR) consiste en la formation de modèles d’apprentissage automatique pour prendre une série de décisions, et présente un fort potentiel pour contribuer à accroitre l’automatisation. Le projet RADDICS, financé par l’UE, vise à relever les principaux défis au déploiement fiable des méthodes d’AR dans des applications à enjeux élevés. Il se penche tout particulièrement sur l’utilisation de modèles probabilistes, tels que les processus gaussiens et les modèles bayésiens profonds, afin de permettre une exploration sûre. Pour ce faire, il combine les estimations de confiance provenant de ces modèles avec des techniques issues de la théorie du contrôle robuste et de la vérification formelle. La recherche tire parti des résultats de récentes découvertes dans le domaine de l’optimisation bayésienne sûre, et elle fait l’objet de démonstrations sur trois applications de systèmes cyber-physiques réels.

Objectif

This ERC project pushes the boundary of reliable data-driven decision making in cyber-physical systems (CPS), by bridging reinforcement learning (RL), nonparametric estimation and robust optimization. RL is a powerful abstraction of decision making under uncertainty and has witnessed dramatic recent breakthroughs. Most of these successes have been in games such as Go - well specified, closed environments that - given enough computing power - can be extensively simulated and explored. In real-world CPS, however, accurate simulations are rarely available, and exploration in these applications is a highly dangerous proposition.

We strive to rethink Reinforcement Learning from the perspective of reliability and robustness required by real-world applications. We build on our recent breakthrough result on safe Bayesian optimization (SAFE-OPT): The approach allows - for the first time - to identify provably near-optimal policies in episodic RL tasks, while guaranteeing under some regularity assumptions that with high probability no unsafe states are visited - even if the set of safe parameter values is a priori unknown.

While extremely promising, this result has several fundamental limitations, which we seek to overcome in this ERC project. To this end we will (1) go beyond low-dimensional Gaussian process models and towards much richer deep Bayesian models; (2) go beyond episodic tasks, by explicitly reasoning about the dynamics and employing ideas from robust control theory and (3) tackle bootstrapping of safe initial policies by bridging simulations and real-world experiments via multi-fidelity Bayesian optimization, and by pursuing safe active imitation learning.

Our research is motivated by three real-world CPS applications, which we pursue in interdisciplinary collaboration: Safe exploration of and with robotic platforms; tuning the energy efficiency of photovoltaic powerplants and safely optimizing the performance of a Free Electron Laser.

Champ scientifique (EuroSciVoc)

CORDIS classe les projets avec EuroSciVoc, une taxonomie multilingue des domaines scientifiques, grâce à un processus semi-automatique basé sur des techniques TLN. Voir: Le vocabulaire scientifique européen.

Mots‑clés

Les mots-clés du projet tels qu’indiqués par le coordinateur du projet. À ne pas confondre avec la taxonomie EuroSciVoc (champ scientifique).

Programme(s)

Programmes de financement pluriannuels qui définissent les priorités de l’UE en matière de recherche et d’innovation.

H2020-EU.1.1. - EXCELLENT SCIENCE - European Research Council (ERC) PROGRAMME PRINCIPAL
Voir tous les projets financés dans le cadre de ce programme

Thème(s)

Les appels à propositions sont divisés en thèmes. Un thème définit un sujet ou un domaine spécifique dans le cadre duquel les candidats peuvent soumettre des propositions. La description d’un thème comprend sa portée spécifique et l’impact attendu du projet financé.

ERC-2018-COG - ERC Consolidator Grant
Voir tous les projets financés dans ce domaine

Régime de financement

Régime de financement (ou «type d’action») à l’intérieur d’un programme présentant des caractéristiques communes. Le régime de financement précise le champ d’application de ce qui est financé, le taux de remboursement, les critères d’évaluation spécifiques pour bénéficier du financement et les formes simplifiées de couverture des coûts, telles que les montants forfaitaires.

ERC-COG - Consolidator Grant

Voir tous les projets financés dans le cadre de ce programme de financement

Appel à propositions

Procédure par laquelle les candidats sont invités à soumettre des propositions de projet en vue de bénéficier d’un financement de l’UE.

(s’ouvre dans une nouvelle fenêtre) ERC-2018-COG

Voir tous les projets financés au titre de cet appel

Institution d’accueil

EIDGENOESSISCHE TECHNISCHE HOCHSCHULE ZUERICH

Contribution nette de l'UE

€ 1 996 500,00

Adresse

Raemistrasse 101
8092 Zuerich
Suisse

Région

Schweiz/Suisse/Svizzera Zürich Zürich

Type d’activité

Higher or Secondary Education Establishments

Liens

Contacter l’organisation

Site web

Participation aux programmes de R&I de l'UE

Réseau de collaboration HORIZON

Coût total

€ 1 996 500,00

Bénéficiaires (1)

EIDGENOESSISCHE TECHNISCHE HOCHSCHULE ZUERICH

Suisse

Contribution nette de l'UE

€ 1 996 500,00

Description du projet

Faire passer l’apprentissage par renforcement au niveau supérieur

Objectif

Champ scientifique (EuroSciVoc) CORDIS classe les projets avec EuroSciVoc, une taxonomie multilingue des domaines scientifiques, grâce à un processus semi-automatique basé sur des techniques TLN. Voir: Le vocabulaire scientifique européen.

Mots‑clés Les mots-clés du projet tels qu’indiqués par le coordinateur du projet. À ne pas confondre avec la taxonomie EuroSciVoc (champ scientifique).

Programme(s) Programmes de financement pluriannuels qui définissent les priorités de l’UE en matière de recherche et d’innovation.

Thème(s) Les appels à propositions sont divisés en thèmes. Un thème définit un sujet ou un domaine spécifique dans le cadre duquel les candidats peuvent soumettre des propositions. La description d’un thème comprend sa portée spécifique et l’impact attendu du projet financé.

Appel à propositions Procédure par laquelle les candidats sont invités à soumettre des propositions de projet en vue de bénéficier d’un financement de l’UE.

Institution d’accueil

Bénéficiaires (1)

Télécharger Télécharger le contenu de la page

Champ scientifique (EuroSciVoc)

CORDIS classe les projets avec EuroSciVoc, une taxonomie multilingue des domaines scientifiques, grâce à un processus semi-automatique basé sur des techniques TLN. Voir: Le vocabulaire scientifique européen.

Mots‑clés

Les mots-clés du projet tels qu’indiqués par le coordinateur du projet. À ne pas confondre avec la taxonomie EuroSciVoc (champ scientifique).

Programme(s)

Programmes de financement pluriannuels qui définissent les priorités de l’UE en matière de recherche et d’innovation.

Thème(s)

Les appels à propositions sont divisés en thèmes. Un thème définit un sujet ou un domaine spécifique dans le cadre duquel les candidats peuvent soumettre des propositions. La description d’un thème comprend sa portée spécifique et l’impact attendu du projet financé.

Appel à propositions

Procédure par laquelle les candidats sont invités à soumettre des propositions de projet en vue de bénéficier d’un financement de l’UE.