Parsing low-resource languages and domains

Información del proyecto

LOWLANDS

Identificador del acuerdo de subvención: 313695

Proyecto cerrado

Fecha de inicio 1 Enero 2013

Fecha de finalización 31 Marzo 2018

Financiado con arreglo a

Specific programme: "Ideas" implementing the Seventh Framework Programme of the European Community for research, technological development and demonstration activities (2007 to 2013)

Coste total

€ 1 126 183,20

Aportación de la UE

€ 1 126 183,20

1 126 183,20

Coordinado por

KOBENHAVNS UNIVERSITET
Denmark

Objetivo

There are noticeable asymmetries in availability of high-quality natural language processing (NLP). We can adequately summarize English newspapers and translate them into Korean, but we cannot translate Korean newspaper articles into English, and summarizing micro-blogs is much more difficult than summarizing newspaper articles. This is a fundamental problem for modern societies, their development and democracy, as well as perhaps the most important research problem in NLP right now.

Most NLP technologies rely on highly accurate syntactic parsing. Reliable parsing models can be induced from large collections of manually annotated data, but such collections are typically limited to sampled newswire in major languages. Highly accurate parsing is therefore not available for other languages and other domains.

The NLP community is well aware of this problem, but unsupervised techniques that do not rely on manually annotated data cannot be used for real-world applications, where highly accurate parsing is needed, and sample bias correction methods that automatically correct the bias in newswire when parsing, say, micro-blogs, do not yet lead to robust improvements across the board.

The objective of this project is to develop new learning methods for parsing natural language for which no unbiased labeled data exists. In order to do so, we need to fundamentally rethink the unsupervised parsing problem, including how we evaluate unsupervised parsers, but we also need to supplement unsupervised learning techniques with robust methods for automatically correcting sample selection biases in related data. Such methods will be applicable to both cross-domain and cross-language syntactic parsing and will pave the way toward robust and scalable NLP. The societal impact of robust and scalable NLP is unforeseeable and comparable to how efficient information retrieval techniques have revolutionized modern societies.

Ámbito científico (EuroSciVoc)

CORDIS clasifica los proyectos con EuroSciVoc, una taxonomía plurilingüe de ámbitos científicos, mediante un proceso semiautomático basado en técnicas de procesamiento del lenguaje natural. Véas: El vocabulario científico europeo..

Programa(s)

Programas de financiación plurianuales que definen las prioridades de la UE en materia de investigación e innovación.

FP7-IDEAS-ERC - Specific programme: "Ideas" implementing the Seventh Framework Programme of the European Community for research, technological development and demonstration activities (2007 to 2013)

Tema(s)

Las convocatorias de propuestas se dividen en temas. Un tema define una materia o área específica para la que los solicitantes pueden presentar propuestas. La descripción de un tema comprende su alcance específico y la repercusión prevista del proyecto financiado.

ERC-SG-SH4 - ERC Starting Grant - The Human Mind and its complexity

Convocatoria de propuestas

Procedimiento para invitar a los solicitantes a presentar propuestas de proyectos con el objetivo de obtener financiación de la UE.

ERC-2012-StG_20111124
Consulte otros proyectos de esta convocatoria

Régimen de financiación

Régimen de financiación (o «Tipo de acción») dentro de un programa con características comunes. Especifica: el alcance de lo que se financia; el porcentaje de reembolso; los criterios específicos de evaluación para optar a la financiación; y el uso de formas simplificadas de costes como los importes a tanto alzado.

ERC-SG - ERC Starting Grant

Institución de acogida

KOBENHAVNS UNIVERSITET

Aportación de la UE

€ 1 126 183,20

Dirección

NORREGADE 10
1165 KOBENHAVN
Dinamarca

Región

Danmark Hovedstaden Byen København

Tipo de actividad

Higher or Secondary Education Establishments

Enlaces

Contactar con la organización Sitio web

Participación en los programas de I+D de la UE

Red de colaboración de HORIZON

Coste total

Sin datos

Beneficiarios (1)

KOBENHAVNS UNIVERSITET

Dinamarca

Aportación de la UE

€ 1 126 183,20

Objetivo

Ámbito científico (EuroSciVoc)

CORDIS clasifica los proyectos con EuroSciVoc, una taxonomía plurilingüe de ámbitos científicos, mediante un proceso semiautomático basado en técnicas de procesamiento del lenguaje natural. Véas: El vocabulario científico europeo..

Programa(s)

Programas de financiación plurianuales que definen las prioridades de la UE en materia de investigación e innovación.

Tema(s)

Las convocatorias de propuestas se dividen en temas. Un tema define una materia o área específica para la que los solicitantes pueden presentar propuestas. La descripción de un tema comprende su alcance específico y la repercusión prevista del proyecto financiado.

Convocatoria de propuestas

Procedimiento para invitar a los solicitantes a presentar propuestas de proyectos con el objetivo de obtener financiación de la UE.

Institución de acogida

Beneficiarios (1)

Compartir esta página Compartir esta página en las redes sociales

Descargar Descargar el contenido de la página

Parsing low-resource languages and domains

Objetivo

Ámbito científico (EuroSciVoc) CORDIS clasifica los proyectos con EuroSciVoc, una taxonomía plurilingüe de ámbitos científicos, mediante un proceso semiautomático basado en técnicas de procesamiento del lenguaje natural. Véas: El vocabulario científico europeo..

Programa(s) Programas de financiación plurianuales que definen las prioridades de la UE en materia de investigación e innovación.

Tema(s) Las convocatorias de propuestas se dividen en temas. Un tema define una materia o área específica para la que los solicitantes pueden presentar propuestas. La descripción de un tema comprende su alcance específico y la repercusión prevista del proyecto financiado.

Convocatoria de propuestas Procedimiento para invitar a los solicitantes a presentar propuestas de proyectos con el objetivo de obtener financiación de la UE.

Institución de acogida

Beneficiarios (1)

Compartir esta página Compartir esta página en las redes sociales

Descargar Descargar el contenido de la página

Ámbito científico (EuroSciVoc)

CORDIS clasifica los proyectos con EuroSciVoc, una taxonomía plurilingüe de ámbitos científicos, mediante un proceso semiautomático basado en técnicas de procesamiento del lenguaje natural. Véas: El vocabulario científico europeo..

Programa(s)

Programas de financiación plurianuales que definen las prioridades de la UE en materia de investigación e innovación.

Tema(s)

Las convocatorias de propuestas se dividen en temas. Un tema define una materia o área específica para la que los solicitantes pueden presentar propuestas. La descripción de un tema comprende su alcance específico y la repercusión prevista del proyecto financiado.

Convocatoria de propuestas

Procedimiento para invitar a los solicitantes a presentar propuestas de proyectos con el objetivo de obtener financiación de la UE.