Skip to main content
Aller à la page d’accueil de la Commission européenne (s’ouvre dans une nouvelle fenêtre)
français français
CORDIS - Résultats de la recherche de l’UE
CORDIS

Understanding the Language of Life: Identifying and Characterizing the Language Units in Protein Sequences

Description du projet

Comprendre les séquences des protéines

Les protéines, essentielles à la vie, peuvent être représentées textuellement comme des séquences d’acides aminés. Bien que le «langage de la vie» reste compris de manière partielle, des percées dans l’étude des protéines ont été rendues possibles grâce au traitement du langage naturel. Le projet LifeLU, financé par le CER, vise à faire progresser la recherche sur le traitement du langage et à repousser les limites de la compréhension du langage de la vie. Le projet sera à l’origine de méthodes innovantes pour identifier les unités linguistiques du langage de la vie et explorer les caractéristiques et la variabilité entre les différentes espèces. En outre, il vise à créer de nouvelles techniques d’identification et d’analyse des fonctions de ces unités linguistiques. LifeLU s’efforce de décoder le langage de la vie, dans le but ultime de développer des approches innovantes pour la prévention, le diagnostic et le traitement des maladies.

Objectif

"Proteins play a key role in biological processes that govern and maintain life. Although they are three-dimensional entities, they can be represented in textual form as sequences of amino acids that largely determine their structures and functions. By analogy with natural (human) languages, we can consider proteins as written with a language, which we refer to in this proposal as the ""language of life"". Natural languages can be read and understood by humans. However, we cannot yet understand the language of life. We do not even know what the vocabulary is, i.e. what the basic language units are (analogous to words in human languages). Textual representation of proteins has enabled the application of natural language processing (NLP) techniques to the study of proteins, and breakthrough results have been achieved in various downstream tasks such as protein structure prediction. However, these efforts remain only at the ""processing level"" of the language of life. The main goal of this project is to go beyond the level of language processing and open new research horizons for understanding the language of life. Using my expertise in NLP and bioinformatics, I will pursue the following objectives: (i) develop innovative methods to determine the language units (i.e. the vocabulary) of the language of life; (ii) identify the characteristics of this language as well as its variability among species; (iii) develop novel methods to identify and characterize the functions of the language units. This research will lay the foundation for a new field of research, molecular language understanding, which aims to develop methods for understanding the messages encoded in molecular sequences. The ultimate goal of this project is to decipher the language of life, which will lead to groundbreaking consequences for understanding life and health, and will shed light to the development of novel prevention, diagnosis, and treatment strategies for diseases."

Champ scientifique (EuroSciVoc)

CORDIS classe les projets avec EuroSciVoc, une taxonomie multilingue des domaines scientifiques, grâce à un processus semi-automatique basé sur des techniques TLN. Voir: Le vocabulaire scientifique européen.

Vous devez vous identifier ou vous inscrire pour utiliser cette fonction

Mots‑clés

Les mots-clés du projet tels qu’indiqués par le coordinateur du projet. À ne pas confondre avec la taxonomie EuroSciVoc (champ scientifique).

Programme(s)

Programmes de financement pluriannuels qui définissent les priorités de l’UE en matière de recherche et d’innovation.

Thème(s)

Les appels à propositions sont divisés en thèmes. Un thème définit un sujet ou un domaine spécifique dans le cadre duquel les candidats peuvent soumettre des propositions. La description d’un thème comprend sa portée spécifique et l’impact attendu du projet financé.

Régime de financement

Régime de financement (ou «type d’action») à l’intérieur d’un programme présentant des caractéristiques communes. Le régime de financement précise le champ d’application de ce qui est financé, le taux de remboursement, les critères d’évaluation spécifiques pour bénéficier du financement et les formes simplifiées de couverture des coûts, telles que les montants forfaitaires.

HORIZON-ERC - HORIZON ERC Grants

Voir tous les projets financés dans le cadre de ce programme de financement

Appel à propositions

Procédure par laquelle les candidats sont invités à soumettre des propositions de projet en vue de bénéficier d’un financement de l’UE.

(s’ouvre dans une nouvelle fenêtre) ERC-2022-COG

Voir tous les projets financés au titre de cet appel

Institution d’accueil

BOGAZICI UNIVERSITESI
Contribution nette de l'UE

La contribution financière nette de l’UE est la somme d’argent que le participant reçoit, déduite de la contribution de l’UE versée à son tiers lié. Elle prend en compte la répartition de la contribution financière de l’UE entre les bénéficiaires directs du projet et d’autres types de participants, tels que les participants tiers.

€ 1 982 800,00
Coût total

Les coûts totaux encourus par l’organisation concernée pour participer au projet, y compris les coûts directs et indirects. Ce montant est un sous-ensemble du budget global du projet.

€ 1 982 800,00

Bénéficiaires (1)

Mon livret 0 0