Skip to main content
Aller à la page d’accueil de la Commission européenne (s’ouvre dans une nouvelle fenêtre)
français français
CORDIS - Résultats de la recherche de l’UE
CORDIS
Contenu archivé le 2024-06-18

Multilingual Annotation of Named Entities and Terminology Resources Acquisition

Description du projet


SME initiative on Digital Content and Languages
MANTRA will provide multilingual terminologies and semantically annotated multilingual documents to improve the accessibility of scientific information from multilingual documents.

This project will provide multilingual terminologies and semantically annotated multilingual documents, e.g. patent texts, to improve the accessibility of scientific information from multilingual documents. The two SME partners will use these resources to improve the quality and functionality of their product offerings, viz. delivering multilingual search and text mining engines based on multilingual terminologies. Both SMEs will market these solutions to their customer base.The MANTRA project capitalizes on parallel document corpora from which translational correspondences will be computed by the use of different alignment methods. Fortunately, the biomedical domain, the application scenario of MANTRA, offers a rich variety of such parallel corpora. We will exploit these multilingual document sets to harvest terms and concept representations in different languages in order to augment currently available terminological resources such as the Medical Subject Headings (MeSH).The project partners will collaboratively build two types of resources: automatically enhanced multilingual terminologies and semantically annotated multilingual documents. The novelty of the latter resource derives from the fact that we solicit and orchestrate community efforts for building up these annotated resources, a procedure that has already been proven successful for the semantic enrichment of large-scale biomedical document corpora (CALBC project) which was executed by the project partners. The novelty of the first comes from a new combination of existing technologies in the area of statistical machine translation, named entity tagging and terminological resources. We start from statistically aligned, parallel documents on which named entity taggers are run to produce highly diverse semantic (named entity) annotations. These annotations signal concept mentions in the text which can then be linked to corresponding entries in relevant biomedical ontologies (from the UMLS, OBO or BioPortal umbrellas), and, in addition, provide the corresponding concept identifiers. Parallel named entity occurrences lacking links to the chosen ontologies can be considered as putative translation equivalents. Validated putative translation equivalents can then be used to enhance already given monolingual terminological resources. Both types of resources will be made available to the public for translation purposes and for search in and text mining from multilingual documents.

Champ scientifique (EuroSciVoc)

CORDIS classe les projets avec EuroSciVoc, une taxonomie multilingue des domaines scientifiques, grâce à un processus semi-automatique basé sur des techniques TLN. Voir: Le vocabulaire scientifique européen.

Vous devez vous identifier ou vous inscrire pour utiliser cette fonction

Programme(s)

Programmes de financement pluriannuels qui définissent les priorités de l’UE en matière de recherche et d’innovation.

Thème(s)

Les appels à propositions sont divisés en thèmes. Un thème définit un sujet ou un domaine spécifique dans le cadre duquel les candidats peuvent soumettre des propositions. La description d’un thème comprend sa portée spécifique et l’impact attendu du projet financé.

Appel à propositions

Procédure par laquelle les candidats sont invités à soumettre des propositions de projet en vue de bénéficier d’un financement de l’UE.

FP7-ICT-2011-SME-DCL
Voir d’autres projets de cet appel

Régime de financement

Régime de financement (ou «type d’action») à l’intérieur d’un programme présentant des caractéristiques communes. Le régime de financement précise le champ d’application de ce qui est financé, le taux de remboursement, les critères d’évaluation spécifiques pour bénéficier du financement et les formes simplifiées de couverture des coûts, telles que les montants forfaitaires.

CP - Collaborative project (generic)

Coordinateur

University of Zurich
Contribution de l’UE
€ 550 740,00
Coût total

Les coûts totaux encourus par l’organisation concernée pour participer au projet, y compris les coûts directs et indirects. Ce montant est un sous-ensemble du budget global du projet.

Aucune donnée

Participants (5)

Mon livret 0 0