Mission temporaire OT-30232
Ingénieur-e de développement Python – Écosystème sémantique & IA
31326 Castanet-Tolosan
Retour à la liste des résultats
Présentation INRAE
INRAE, Institut national de recherche pour l’agriculture, l’alimentation et l’environnement, est un organisme public de recherche qui réunit 12 000 collaborateurs au sein de 272 unités réparties sur 18 centres en France. Premier organisme mondial spécialisé sur l’ensemble agriculture – alimentation – environnement, INRAE joue un rôle clé pour accompagner les transitions nécessaires face aux grands défis planétaires.
Face à l’augmentation de la population, aux enjeux de sécurité alimentaire, au changement climatique, à la raréfaction des ressources et au déclin de la biodiversité, INRAE s’engage à développer des solutions scientifiques et à accompagner l’évolution des pratiques agricoles, alimentaires et environnementales.
Environnement de travail, missions et activités
Le poste est rattaché à Direction pour la Science Ouverte (DipSO), une direction placée sous la responsabilité du Directeur général délégué Science et Innovation. La DipSO développe une offre de services, produit des études et des prototypes, conseille/forme les acteurs de la science et de la stratégie en matière de science ouverte et de numérique pour la science. Elle rassemble, pour ce faire, des compétences diverses, complémentaires (documentation, informatique, scientifique, data science) pour assurer ses services et gérer des projets sur l’ensemble de son périmètre. Elle est organisée en quatre pôles.
Son pôle Numérique pour la Science (Num4Sci) contribue à consolider la politique de l’établissement en matière de numérique scientifique, en assurant la mise à disposition d’outils et de services pour la science ouverte. Ces outils et services communs visent notamment à favoriser une pratique plus ouverte et collaborative de la science, et à permettre aux communautés scientifiques de profiter davantage des opportunités du numérique.
Vous serez accueilli(e) au sein de l’équipe Données et Sémantique (D&S) du pôle Num4Sci de la DipSO. L'équipe fonctionne en mode Agile Scrum et le poste requiert une forte capacité à collaborer à distance avec des interlocuteurs répartis sur toute la France. Au sein d’une équipe constituée d’ingénieurs en sémantique, en recherche d’information textuelle et spécialistes en IA, vous contribuerez à des projets dans le domaine en développant des workflow d’analyse de données et des outils, et en étant force de proposition sur les technologies et méthodes à utiliser. Vous évoluerez dans un environnement stimulant, à l’interface entre la recherche académique et les applications concrètes en sciences des données.
Votre mission consistera à mettre en œuvre des projets de développement de solutions applicatives visant à automatiser certaines tâches liées à l'administration des données scientifiques.
Ces applications (Python) exploiteront des algorithmes de machine learning ou de deep learning pour extraire l’information des productions scientifiques (articles, jeux de données), la structurer et la formaliser à l'aide de référentiels (structures, personnes, thématiques , mots clés...). En vous appuyant sur les connaissances métier de vos collègues, vous serez chargé de concevoir et développer des chaînes de traitement permettant par exemple :
- d’explorer le contenu d’articles scientifiques et d’en extraire de l’information,
- d’annoter et classifier ces articles selon les ontologies du domaine, ou les thésaurus
- de structurer leur contenu et leurs métadonnées pour les préparer aux requêtes des agents IA,
- d’enrichir et requêter des graphes de connaissance sémantiques,
Formations et compétences recherchées
Formation recommandée : Master/Ingénieur (Bac+5) École d’ingénieur ou Master avec spécialisation en informatique et/ou data science.
Compétences indispensables:
- Maîtrise solide du langage Python, de ses librairies et de son écosystème de développement
- Bases de données (Relationnelles, No-SQL), Graph (Neo4J, TripleStore...), Vectorielles (QDrant...) …
- Une première expérience avec Docker, Gitlab.
Connaissances souhaitées :
- Traitement des données textuelles et modèles de langue
- Sémantique, vocabulaires contrôlés et ontologies (RDF, SKOS, OWL)
- Sensibilité aux architectures de graphes de connaissances et à la manipulation d'ontologies ou de thésaurus.
- Intérêt pour l'exploitation des LLM, notamment open (frameworks d'orchestration, APIs) et les concepts de vectorisation (embeddings, reranking,...).
- Curiosité pour les protocoles modernes d'interopérabilité comme MCP (Model Context Protocol) ou le standard Croissant-ML.
- Langages documentaires (ex : thésaurus)
- Méthodes (par exemple Agile) et outils de gestion de projets
- Des connaissances dans le mise en place d’interfaces web (front)
- Connaissance de docker
- Initiation à Kubernetes.
Expérience appréciée :
- Participation à un projet de traitement de données non structurées (ex : documents PDF, images, textes bruts...).
- Mise en œuvre de modèles, NLP, ou LLM pour l’extraction d’information.
- Intégration de modèles ML/DL dans des pipelines de traitement (ETL, data pipelines).
- Déploiement de modèles sous forme d’API, idéalement dans des environnements conteneurisés (Docker, Kubernetes).
- Sensibilité aux problématiques de monitoring, versioning et dérive des modèles.
- Sensibilité à la qualité du code notamment la documentation technique
Aptitudes recherchées :
- autonomie, rigueur technique, adaptabilité et proactivité dans l'apprentissage de nouvelles technologies. De très bonnes capacités de communication (écrite et orale) sont indispensables pour la collaboration quotidienne au sein d'une équipe répartie à distance.
Le poste est basé à Toulouse. Il implique une collaboration quotidienne et essentielle avec des interlocuteurs (Product Owners, équipes partenaires, utilisateurs) situés à distance sur l'ensemble du territoire national.
Les candidats retenus seront auditionnés la semaine du 21 septembre (entretien d’une heure maximum en visio ou présentiel). Ils recevront un mail d’invitation à l’entretien 1 semaine à l’avance. Les candidats non convoqués au-delà de cette période pourront considérer leur candidature infructueuse.
Votre qualité de vie à INRAE
En rejoignant INRAE, vous bénéficiez (selon le type de contrat et sa durée) :
- jusqu'à 30 jours de congés + 15 RTT par an (pour un temps plein)
- d'un soutien à la parentalité : CESU garde d'enfants, prestations pour les loisirs ;
- de dispositifs de développement des compétences : formation, conseil en orientation professionnelle ;
- d'un accompagnement social : conseil et écoute, aides et prêts sociaux ;
- de prestations vacances et loisirs : chèque-vacances, hébergements à tarif préférentiel ;
- d'activités sportives et culturelles ;
- d'une restauration collective.
Modalités pour postuler
J'envoie mon CV et ma lettre de motivation
Les personnes accueillies à INRAE, établissement public de recherche, sont soumises aux dispositions du Code de la fonction publique notamment en ce qui concerne l’obligation de neutralité et le respect du principe de laïcité. A ce titre, dans l’exercice de leurs fonctions, qu’elles soient ou non au contact du public, elles ne doivent pas manifester leurs convictions, par leur comportement ou leur tenue, qu’elles soient religieuses, philosophiques ou politiques. > En savoir plus : site fonction publique.gouv.fr