Aller au contenu principal
PostePublic
FP d'État Cat. AEmploi ouvert uniquement aux contractuelsIl y a 2 jours

Ingénieur d'études en TAL dans le projet ERA-NET CHIST-ERA FAIRClinical (H/F)

CNRS (ouvre un nouvel onglet) — CNRS

Localisation
Essonne (91), France (91)
Niveau d'études
Niveau 6 Licence/diplômes équivalents
Publication
22 septembre 2026
Date limite
14 octobre 2026
Domaine
Recherche

Missions principales

Missions : Ce poste d'ingénieur d'études est dans le domaine du traitement du langage naturel. La personne recrutée rejoindra le projet international CHIST-ERA FAIRClinical. Elle mettra en œuvre des approches d'apprentissage automatique pour l'extraction d'informations à partir d'articles de recherche médicale et clinique et de leurs documents complémentaires. Activités : - Identifier les sources de données nécessaires à l'extraction et à la normalisation des entités. - Développer des pipelines d’extraction d’information à partir des textes complets et des documents complémentaires. - Évaluer les méthodes d’extraction d’information. Contexte de travail : Ce poste fait partie du projet FAIRClinical financé par CHIST-ERA, dont l'objectif est de renforcer le caractère FAIR de tous les fichiers de données complémentaires et d'améliorer de manière significative la réutilisation des formulaires de rapport de cas cliniques non structurés (CRF). Les données complémentaires sont généralement jointes à une publication scientifique, soit directement dans les bibliothèques biomédicales en ligne telles que PubMed Central, soit par l'intermédiaire de plateformes de dépôt généralistes telles que Zenodo. Les CRF recueillent les données des patients dans le cadre d'études et d'essais de recherche clinique, et représentent un sous-ensemble riche en informations de la littérature de recherche clinique et des données complémentaires non structurées des études cliniques. Ce projet propose d'enrichir spécifiquement le contenu de toutes les données supplémentaires — et donc leur interopérabilité, leur trouvabilité et leur réutilisation — en fournissant un contenu plus normalisé. Le poste est proposé au sein du Laboratoire Interdisciplinaire des Sciences du Numérique (LISN, CNRS UMR 9015), situé sur le campus de l'Université Paris-Saclay à Orsay. La personne recrutée sera rattachée à l'équipe Sémantique et Extraction d'information (SEME) du département Sciences et Technologies des Langues (STL), qui compte actuellement 27 membres.

Compétences attendues

Missions :Ce poste d'ingénieur d'études est dans le domaine du traitement du langage naturel. La personne recrutée rejoindra le projet international CHIST-ERA FAIRClinical. Elle mettra en œuvre des approches d'apprentissage automatique pour l'extraction d'informations à partir d'articles de recherche médicale et clinique et de leurs documents complémentaires.Activités :- Identifier les sources de données nécessaires à l'extraction et à la normalisation des entités.- Développer des pipelines d’extraction d’information à partir des textes complets et des documents complémentaires.- Évaluer les méthodes d’extraction d’information.Contexte de travail :Ce poste fait partie du projet FAIRClinical financé par CHIST-ERA, dont l'objectif est de renforcer le caractère FAIR de tous les fichiers de données complémentaires et d'améliorer de manière significative la réutilisation des formulaires de rapport de cas cliniques non structurés (CRF). Les données complémentaires sont généralement jointes à une publication scientifique, soit directement dans les bibliothèques biomédicales en ligne telles que PubMed Central, soit par l'intermédiaire de plateformes de dépôt généralistes telles que Zenodo.Les CRF recueillent les données des patients dans le cadre d'études et d'essais de recherche clinique, et représentent un sous-ensemble riche en informations de la littérature de recherche clinique et des données complémentaires non structurées des études cliniques. Ce projet propose d'enrichir spécifiquement le contenu de toutes les données supplémentaires — et donc leur interopérabilité, leur trouvabilité et leur réutilisation — en fournissant un contenu plus normalisé. Le poste est proposé au sein du Laboratoire Interdisciplinaire des Sciences du Numérique (LISN, CNRS UMR 9015), situé sur le campus de l'Université Paris-Saclay à Orsay. La personne recrutée sera rattachée à l'équipe Sémantique et Extraction d'information (SEME) du département Sciences et Technologies des Langues (STL), qui compte actuellement 27 membres.

Profil attendu

Competences : - Master en informatique, en traitement automatique des langues ou similaire. - Compétences en apprentissage automatique supervisé et semi-supervisé, y compris l'apprentissage profond. - Expérience en traitement automatique des langues - Bonne maîtrise de l'anglais, à l'oral comme à l'écrit - Capacité à travailler de manière indépendante et en équipe - Capacité à hiérarchiser les tâches et à prendre des initiatives. Contraintes et risques : Risques liés au travail sur écran.

Conditions d'exercice

Le Centre national de la recherche scientifique est l’une des plus importantes institutions publiques au monde : 34 000 femmes et hommes (plus de 1 000 laboratoires et 200 métiers), en partenariat avec les universités et les grandes écoles, y font progresser les connaissances en explorant le vivant, la matière, l’Univers et le fonctionnement des sociétés humaines. Depuis plus de 80 ans, y sont développées des recherches pluri et interdisciplinaires sur tout le territoire national, en Europe et à l’international. Le lien étroit que le CNRS tisse entre ses missions de recherche et le transfert vers la société fait de lui un acteur clé de l’innovation en France et dans le monde. Le partenariat qui le lie avec les entreprises est le socle de sa politique de valorisation et les start-ups issues de ses laboratoires (près de 100 chaque année) témoignent du potentiel économique de ses travaux de recherche.

Métier de référence

Experte / Expert en calcul scientifique

Réf. UMR9015-NONNAD-009-02Fonction publique d'État

Offres similaires