Reliable Data-Driven Decision Making in Cyber-Physical Systems

Información del proyecto

RADDICS

Identificador del acuerdo de subvención: 815943

DOI

10.3030/815943

Proyecto cerrado

Fecha de la firma de la CE 18 Diciembre 2018

Fecha de inicio 1 Enero 2019

Fecha de finalización 30 Junio 2024

Financiado con arreglo a

EXCELLENT SCIENCE - European Research Council (ERC)

Coste total

€ 1 996 500,00

Aportación de la UE

€ 1 996 500,00

1 996 500,00

Coordinado por

EIDGENOESSISCHE TECHNISCHE HOCHSCHULE ZUERICH
Switzerland

Descripción del proyecto

El aprendizaje por refuerzo llega a un nuevo nivel

El aprendizaje por refuerzo (AR) consiste en el entrenamiento de modelos de aprendizaje automático para crear una secuencia de decisiones, lo que podría ayudar enormemente a aumentar la automatización. El objetivo del proyecto financiado con fondos europeos RADDICS es superar los retos principales para el despliegue fiable de métodos de AR en aplicaciones de alto riesgo. En concreto, se examinará el uso de modelos probabilísticos, como los procesos gaussianos y los modelos bayesianos profundos, para permitir una exploración segura. Para ello, se combinarán estimaciones del nivel de confianza de estos modelos con técnicas de la teoría de control robusto y la verificación formal. La investigación se basa en los grandes avances recientes en la optimización bayesiana segura y se demuestra con tres aplicaciones de sistemas ciberfísicos reales.

Objetivo

This ERC project pushes the boundary of reliable data-driven decision making in cyber-physical systems (CPS), by bridging reinforcement learning (RL), nonparametric estimation and robust optimization. RL is a powerful abstraction of decision making under uncertainty and has witnessed dramatic recent breakthroughs. Most of these successes have been in games such as Go - well specified, closed environments that - given enough computing power - can be extensively simulated and explored. In real-world CPS, however, accurate simulations are rarely available, and exploration in these applications is a highly dangerous proposition.

We strive to rethink Reinforcement Learning from the perspective of reliability and robustness required by real-world applications. We build on our recent breakthrough result on safe Bayesian optimization (SAFE-OPT): The approach allows - for the first time - to identify provably near-optimal policies in episodic RL tasks, while guaranteeing under some regularity assumptions that with high probability no unsafe states are visited - even if the set of safe parameter values is a priori unknown.

While extremely promising, this result has several fundamental limitations, which we seek to overcome in this ERC project. To this end we will (1) go beyond low-dimensional Gaussian process models and towards much richer deep Bayesian models; (2) go beyond episodic tasks, by explicitly reasoning about the dynamics and employing ideas from robust control theory and (3) tackle bootstrapping of safe initial policies by bridging simulations and real-world experiments via multi-fidelity Bayesian optimization, and by pursuing safe active imitation learning.

Our research is motivated by three real-world CPS applications, which we pursue in interdisciplinary collaboration: Safe exploration of and with robotic platforms; tuning the energy efficiency of photovoltaic powerplants and safely optimizing the performance of a Free Electron Laser.

Ámbito científico (EuroSciVoc)

CORDIS clasifica los proyectos con EuroSciVoc, una taxonomía plurilingüe de ámbitos científicos, mediante un proceso semiautomático basado en técnicas de procesamiento del lenguaje natural. Véas: El vocabulario científico europeo..

Palabras clave

Palabras clave del proyecto indicadas por el coordinador del proyecto. No confundir con la taxonomía EuroSciVoc (Ámbito científico).

Programa(s)

Programas de financiación plurianuales que definen las prioridades de la UE en materia de investigación e innovación.

H2020-EU.1.1. - EXCELLENT SCIENCE - European Research Council (ERC) PROGRAMA PRINCIPAL
Ver todos los proyectos financiados en el marco de este programa

Tema(s)

Las convocatorias de propuestas se dividen en temas. Un tema define una materia o área específica para la que los solicitantes pueden presentar propuestas. La descripción de un tema comprende su alcance específico y la repercusión prevista del proyecto financiado.

ERC-2018-COG - ERC Consolidator Grant
Ver todos los proyectos financiados en el marco de este tema

Régimen de financiación

Régimen de financiación (o «Tipo de acción») dentro de un programa con características comunes. Especifica: el alcance de lo que se financia; el porcentaje de reembolso; los criterios específicos de evaluación para optar a la financiación; y el uso de formas simplificadas de costes como los importes a tanto alzado.

ERC-COG - Consolidator Grant

Ver todos los proyectos financiados en el marco de este régimen de financiación

Convocatoria de propuestas

Procedimiento para invitar a los solicitantes a presentar propuestas de proyectos con el objetivo de obtener financiación de la UE.

(se abrirá en una nueva ventana) ERC-2018-COG

Ver todos los proyectos financiados en el marco de esta convocatoria

Institución de acogida

EIDGENOESSISCHE TECHNISCHE HOCHSCHULE ZUERICH

Aportación neta de la UEn

€ 1 996 500,00

Dirección

Raemistrasse 101
8092 Zuerich
Suiza

Región

Schweiz/Suisse/Svizzera Zürich Zürich

Tipo de actividad

Higher or Secondary Education Establishments

Enlaces

Contactar con la organización

Sitio web

Participación en los programas de I+D de la UE

Red de colaboración de HORIZON

Coste total

€ 1 996 500,00

Beneficiarios (1)

EIDGENOESSISCHE TECHNISCHE HOCHSCHULE ZUERICH

Suiza

Aportación neta de la UEn

€ 1 996 500,00

Descripción del proyecto

El aprendizaje por refuerzo llega a un nuevo nivel

Objetivo

Ámbito científico (EuroSciVoc) CORDIS clasifica los proyectos con EuroSciVoc, una taxonomía plurilingüe de ámbitos científicos, mediante un proceso semiautomático basado en técnicas de procesamiento del lenguaje natural. Véas: El vocabulario científico europeo..

Palabras clave Palabras clave del proyecto indicadas por el coordinador del proyecto. No confundir con la taxonomía EuroSciVoc (Ámbito científico).

Programa(s) Programas de financiación plurianuales que definen las prioridades de la UE en materia de investigación e innovación.

Tema(s) Las convocatorias de propuestas se dividen en temas. Un tema define una materia o área específica para la que los solicitantes pueden presentar propuestas. La descripción de un tema comprende su alcance específico y la repercusión prevista del proyecto financiado.

Convocatoria de propuestas Procedimiento para invitar a los solicitantes a presentar propuestas de proyectos con el objetivo de obtener financiación de la UE.

Institución de acogida

Beneficiarios (1)

Descargar Descargar el contenido de la página

Ámbito científico (EuroSciVoc)

CORDIS clasifica los proyectos con EuroSciVoc, una taxonomía plurilingüe de ámbitos científicos, mediante un proceso semiautomático basado en técnicas de procesamiento del lenguaje natural. Véas: El vocabulario científico europeo..

Palabras clave

Palabras clave del proyecto indicadas por el coordinador del proyecto. No confundir con la taxonomía EuroSciVoc (Ámbito científico).

Programa(s)

Programas de financiación plurianuales que definen las prioridades de la UE en materia de investigación e innovación.

Tema(s)

Las convocatorias de propuestas se dividen en temas. Un tema define una materia o área específica para la que los solicitantes pueden presentar propuestas. La descripción de un tema comprende su alcance específico y la repercusión prevista del proyecto financiado.

Convocatoria de propuestas

Procedimiento para invitar a los solicitantes a presentar propuestas de proyectos con el objetivo de obtener financiación de la UE.