Data Scientist Genai - Llm Rag & ai Engineering H/F

Propertyvalue
France
6 days ago
Apply on www.hellowork.com
Prepare application

Role details

Contract type
Permanent contract
Employment type
Full-time (> 32 hours)
Working hours
Regular working hours
Languages
English

Tech stack

Application Programming Interfaces (APIs) Agile Methodology Artificial Intelligence Amazon Web Services Microsoft Azure Cloud Computing Continuous Integration Data Governance Python (Programming Language) Machine Learning NoSQL Tensorflow
+18 more
SQL Databases Management of Software Versions Planning Software Google Cloud Pytorch Delivery Pipeline Large Language Models Apache Spark Deep Learning Generative AI Backend Git Pyspark Scikit Learn Information Technology Machine Learning Operations GPT Docker

Job description

· Analyser les besoins métiers et identifier les cas d’usage pertinents autour de l’IA générative. · Concevoir et développer des applications basées sur des LLM tels que GPT, Mistral, Llama ou Claude. · Développer des assistants conversationnels et des systèmes d’aide à la décision. · Concevoir et mettre en oeuvre des architectures RAG et des solutions de recherche sémantique. · Développer les pipelines documentaires : ingestion, nettoyage, chunking, embeddings, indexation, retrieval et reranking. · Concevoir des workflows agentiques et orchestrer des outils et agents IA. · Développer des APIs et services backend autour des modèles IA. · Transformer les POC en solutions industrialisées et production-ready. · Mettre en place les pratiques de tests, versioning, CI/CD, monitoring et documentation. · Définir et mettre en oeuvre des métriques et frameworks d’évaluation des solutions GenAI. · Optimiser la qualité des réponses, la pertinence du retrieval, la latence et les coûts, tout en limitant les hallucinations. · Participer au déploiement des solutions sur des environnements Cloud. · Présenter et vulgariser les solutions auprès des équipes techniques et métiers. Livrables attendus : · Analyses des besoins et identification des cas d’usage IA. · Spécifications fonctionnelles et techniques. · Prototypes et applications GenAI fonctionnelles. · Architectures RAG et pipelines documentaires documentés. · APIs, services IA et agents opérationnels. · Scripts et notebooks d’expérimentation. · Code source versionné et pipelines CI/CD. · Documentation d’architecture, de déploiement et d’exploitation. · Métriques de qualité et de performance des solutions. · Documentation des modèles, prompts et dispositifs d’évaluation.

Requirements

· Bac +5 en Data Science, Intelligence Artificielle, Informatique ou Mathématiques appliquées. · Expérience significative en Data Science / Machine Learning. · Expérience réussie sur des projets LLM / RAG / GenAI en production. · Très bonne maîtrise de Python et SQL. · Solides compétences en Machine Learning, Deep Learning et NLP. · Maîtrise de frameworks tels que PyTorch, TensorFlow et Scikit-learn. · Expertise obligatoire sur les LLM, le prompt engineering, les architectures RAG, les embeddings et la recherche vectorielle. · Maîtrise de LangChain ou d’un framework équivalent. · Expérience en industrialisation de solutions IA et bonnes pratiques MLOps. · Connaissances de Docker, Git, CI/CD et MLflow. · Expérience sur au moins un Cloud : AWS, Azure ou GCP. · Connaissances en Data Engineering : Spark/PySpark, bases SQL/NoSQL et pipelines data. · Une expérience sur LangGraph, CrewAI, AutoGen, OpenAI Agents SDK ou MCP est appréciée. · Autonomie, esprit d’initiative et capacité à prendre en charge un sujet de bout en bout. · Excellentes capacités de vulgarisation et de communication avec des interlocuteurs techniques et métiers. · Sensibilité aux enjeux de qualité, sécurité et gouvernance des données. · Anglais professionnel et capacité à évoluer dans un environnement Agile et international., SQL AWS Git Création d’une base documentaire Pro-activité Python Autonomie Gouvernance des données NoSQL Analyse des besoins Logiciels de gestion de versions TensorFlow Docker

Benefits & conditions

Taux journalier :TJM HT max 454 € (hors éventuels frais de mission, à discuter avec le client).css-11k7fwb{display:inline-block;white-space:nowrap;vertical-align:middle;-webkit-padding-start:var(–chakra-space-1-5);padding-inline-start:var(–chakra-space-1-5);-webkit-padding-end:var(–chakra-space-1-5);padding-inline-end:var(–chakra-space-1-5);text-transform:none;font-size:var(–chakra-fontSizes-xs);border-radius:var(–chakra-radii-md);font-weight:var(–chakra-fontWeights-semibold);background:var(–chakra-colors-success-200);color:var(–chakra-colors-success-700);box-shadow:var(–badge-shadow);padding:4px 6px;–badge-bg:var(–chakra-colors-success-100);–badge-color:colors.success.800;}.chakra-ui-dark .css-11k7fwb:not([data-theme]),[data-theme=dark] .css-11k7fwb:not([data-theme]),.css-11k7fwb[data-theme=dark]{–badge-bg:rgba(226, 243, 232, 0.16);–badge-color:var(–chakra-colors-success-200);}Cette offre est à 0% de commission .css-74lrwu{width:1em;height:1em;line-height:1em;-webkit-flex-shrink:0;-ms-flex-negative:0;flex-shrink:0;color:currentColor;font-size:16px;display:-webkit-box;display:-webkit-flex;display:-ms-flexbox;display:flex;-webkit-transition:.1s ease-in-out color;transition:.1s ease-in-out color;}.css-74lrwu *{-webkit-transition:.1s ease-in-out fill;transition:.1s ease-in-out fill;fill:var(–chakra-colors-rythm-600);}

About the company

Dans le cadre de l’accélération de ses initiatives en Intelligence Artificielle Générative, notre client recherche un Data Scientist GenAI / AI Engineer pour concevoir, développer et industrialiser des solutions basées sur les LLM. Le consultant interviendra sur des projets d’IA appliquée visant notamment l’automatisation de processus métiers, l’accès à la connaissance interne et le développement d’assistants intelligents, de la phase de conception jusqu’à la mise en production.

Apply for this position

This job is hosted externally. Click below to view the full posting and apply.

Apply on www.hellowork.com
Prepare application

Good distractions

Talks and stories from around this role — technically off-topic, practically not.

40 sec

Generative pre-trained transformer models powering code completions

lgonta lgonta +1 · World Congress 2024

6:21 min

Investigating push inefficiencies with upstream Git experts

Jonathan Creamer · Coffee With Developers

2:37 min

Comparing traditional SQL tables versus NoSQL non-tabular databases

Stanimira Vlaeva · JS Congress

3:14 min

Structuring career paths and localized data architectures

Ulrich Wurstbauer +1 · LIVE

51 sec

Assessing GPT-4o performance for pull request feedback

Merrill Lutsky Merrill Lutsky · World Congress 2025

1:34 min

Bringing diverse skills to industrial data science roles

Katja Träumner

Videos

See all

Related articles

See all