Modelling Text as a Living Object in Cross-Document Context

Projektinformationen

InterText

ID Finanzhilfevereinbarung: 101054961

DOI

10.3030/101054961

EK-Unterschriftsdatum 15 September 2022

Startdatum 1 April 2023

Enddatum 31 März 2028

Finanziert unter

European Research Council (ERC)

Gesamtkosten

€ 2 499 721,00

EU-Beitrag

€ 2 499 721,00

2 499 721,00

Koordiniert durch

TECHNISCHE UNIVERSITAT DARMSTADT
Germany

Projektbeschreibung

Revolutionäres Framework zur automatischen Analyse von Beziehungen zwischen Texten

Verarbeitung natürlicher Sprache ist nicht dazu geeignet, die Analyse detaillierter Zusammenhänge zwischen Texten, der sogenannten intertextuellen Beziehungen, zu unterstützen. Eine Lösung dieses Problems als entscheidender Meilenstein für die künstliche Intelligenz (KI) würde die Analyse des Ursprungs und der Entwicklung von Texten und Ideen gestatten sowie neue KI-Anwendungen für textbasierte Zusammenarbeit, von der Bildung bis zur Wirtschaft, zulassen. Das vom Europäischen Forschungsrat finanzierte Projekt InterText erstellt nun das allererste Framework für die Erforschung der Intertextualität in der Verarbeitung natürlicher Sprache. InterText wird konzeptionelle und angewandte Modelle und Datensätze für die Untersuchung von Inline-Kommentaren, impliziten Verknüpfungen und Dokumentenversionierung erarbeiten. Die Modelle werden innerhalb von zwei Fallstudien bewertet, bei denen es um akademische Begutachtungen und die Entlarvung von Verschwörungstheorien geht.

Ziel

Interpreting text in the context of other texts is very hard: it requires understanding the fine-grained semantic relationships between documents called intertextual relationships. This is critical in many areas of human activity, including research, business, journalism, and others. However, finding and interpreting intertextual relationships and tracing information throughout heterogeneous sources remains a tedious manual task. Natural language processing (NLP) fails to adequately support it: mainstream NLP considers texts as static, isolated entities, and existing approaches to cross-document understanding focus on narrow use cases and lack a common, theoretical foundation. Data is scarce and difficult to create, and the field lacks a principled framework for modelling intertextuality.

InterText breaks new ground by proposing the first general framework for studying intertextuality in NLP. We instantiate our framework in three intertextuality types: inline commentary, implicit linking, and semantic versioning. We produce new datasets and generalizable models for each of them. Rather than treating text as a sequence of words, we introduce a new data model that naturally reflects document structure and cross-document relationships. We use this data model to create novel, intertextuality-aware neural representations of text. While prior work ignores similarities between different types of intertextuality, we target their synergies. Thus, we offer solutions that scale to a wide range of tasks and across domains. To enable modular and efficient transfer learning, we propose new document-level adapter-based architectures. We investigate integrative properties of our framework in two case studies: academic peer review and conspiracy theory debunking. InterText creates a solid research platform for intertextuality-aware NLP crucial for managing the dynamic, interconnected digital discourse of today.

Wissenschaftliches Gebiet (EuroSciVoc)

CORDIS klassifiziert Projekte mit EuroSciVoc, einer mehrsprachigen Taxonomie der Wissenschaftsbereiche, durch einen halbautomatischen Prozess, der auf Verfahren der Verarbeitung natürlicher Sprache beruht. Siehe: Das European Science Vocabulary.

Sozialwissenschaften Medien und Kommunikation Journalismus

Schlüsselbegriffe

Schlüsselbegriffe des Projekts, wie vom Projektkoordinator angegeben. Nicht zu verwechseln mit der EuroSciVoc-Taxonomie (Wissenschaftliches Gebiet).

Programm/Programme

Mehrjährige Finanzierungsprogramme, in denen die Prioritäten der EU für Forschung und Innovation festgelegt sind.

HORIZON.1.1 - European Research Council (ERC) HAUPTPROGRAMM
Alle im Rahmen dieses Programms finanzierten Projekte anzeigen

Thema/Themen

Aufforderungen zur Einreichung von Vorschlägen sind nach Themen gegliedert. Ein Thema definiert einen bestimmten Bereich oder ein Gebiet, zu dem Vorschläge eingereicht werden können. Die Beschreibung eines Themas umfasst seinen spezifischen Umfang und die erwarteten Auswirkungen des finanzierten Projekts.

ERC-2021-ADG - ERC ADVANCED GRANTS
Alle im Rahmen dieses Themas finanzierten Projekte anzeigen

Finanzierungsplan

Finanzierungsregelung (oder „Art der Maßnahme“) innerhalb eines Programms mit gemeinsamen Merkmalen. Sieht folgendes vor: den Umfang der finanzierten Maßnahmen, den Erstattungssatz, spezifische Bewertungskriterien für die Finanzierung und die Verwendung vereinfachter Kostenformen wie Pauschalbeträge.

HORIZON-ERC - HORIZON ERC Grants

Alle im Rahmen dieses Finanzierungsinstruments finanzierten Projekte anzeigen

Aufforderung zur Vorschlagseinreichung

Verfahren zur Aufforderung zur Einreichung von Projektvorschlägen mit dem Ziel, eine EU-Finanzierung zu erhalten.

(öffnet in neuem Fenster) ERC-2021-ADG

Alle im Rahmen dieser Aufforderung zur Einreichung von Vorschlägen finanzierten Projekte anzeigen

Gastgebende Einrichtung

TECHNISCHE UNIVERSITAT DARMSTADT

Netto-EU-Beitrag

€ 2 499 721,00

Adresse

KAROLINENPLATZ 5
64289 DARMSTADT
Deutschland

Region

Hessen Darmstadt Darmstadt, Kreisfreie Stadt

Aktivitätstyp

Higher or Secondary Education Establishments

Links

Die Organisation kontaktieren Website

Teilnahme an EU-FuI-Programmen

HORIZON-Kooperationsnetzwerk

Gesamtkosten

€ 2 499 721,00

Begünstigte (1)

TECHNISCHE UNIVERSITAT DARMSTADT

Deutschland

Netto-EU-Beitrag

€ 2 499 721,00

Projektbeschreibung

Revolutionäres Framework zur automatischen Analyse von Beziehungen zwischen Texten

Ziel

Wissenschaftliches Gebiet (EuroSciVoc)

CORDIS klassifiziert Projekte mit EuroSciVoc, einer mehrsprachigen Taxonomie der Wissenschaftsbereiche, durch einen halbautomatischen Prozess, der auf Verfahren der Verarbeitung natürlicher Sprache beruht. Siehe: Das European Science Vocabulary.

Schlüsselbegriffe

Schlüsselbegriffe des Projekts, wie vom Projektkoordinator angegeben. Nicht zu verwechseln mit der EuroSciVoc-Taxonomie (Wissenschaftliches Gebiet).

Programm/Programme

Mehrjährige Finanzierungsprogramme, in denen die Prioritäten der EU für Forschung und Innovation festgelegt sind.

Aufforderung zur Vorschlagseinreichung

Verfahren zur Aufforderung zur Einreichung von Projektvorschlägen mit dem Ziel, eine EU-Finanzierung zu erhalten.

Gastgebende Einrichtung

Begünstigte (1)

Diese Seite teilen Diese Seite in sozialen Netzwerken teilen

Herunterladen Den Inhalt der Seite herunterladen

Modelling Text as a Living Object in Cross-Document Context

Projektbeschreibung

Revolutionäres Framework zur automatischen Analyse von Beziehungen zwischen Texten

Ziel

Wissenschaftliches Gebiet (EuroSciVoc) CORDIS klassifiziert Projekte mit EuroSciVoc, einer mehrsprachigen Taxonomie der Wissenschaftsbereiche, durch einen halbautomatischen Prozess, der auf Verfahren der Verarbeitung natürlicher Sprache beruht. Siehe: Das European Science Vocabulary.

Schlüsselbegriffe Schlüsselbegriffe des Projekts, wie vom Projektkoordinator angegeben. Nicht zu verwechseln mit der EuroSciVoc-Taxonomie (Wissenschaftliches Gebiet).

Programm/Programme Mehrjährige Finanzierungsprogramme, in denen die Prioritäten der EU für Forschung und Innovation festgelegt sind.

Aufforderung zur Vorschlagseinreichung Verfahren zur Aufforderung zur Einreichung von Projektvorschlägen mit dem Ziel, eine EU-Finanzierung zu erhalten.

Gastgebende Einrichtung

Begünstigte (1)

Diese Seite teilen Diese Seite in sozialen Netzwerken teilen

Herunterladen Den Inhalt der Seite herunterladen

Wissenschaftliches Gebiet (EuroSciVoc)

CORDIS klassifiziert Projekte mit EuroSciVoc, einer mehrsprachigen Taxonomie der Wissenschaftsbereiche, durch einen halbautomatischen Prozess, der auf Verfahren der Verarbeitung natürlicher Sprache beruht. Siehe: Das European Science Vocabulary.

Schlüsselbegriffe

Schlüsselbegriffe des Projekts, wie vom Projektkoordinator angegeben. Nicht zu verwechseln mit der EuroSciVoc-Taxonomie (Wissenschaftliches Gebiet).

Programm/Programme

Mehrjährige Finanzierungsprogramme, in denen die Prioritäten der EU für Forschung und Innovation festgelegt sind.

Aufforderung zur Vorschlagseinreichung

Verfahren zur Aufforderung zur Einreichung von Projektvorschlägen mit dem Ziel, eine EU-Finanzierung zu erhalten.