Description du poste
Pour le compte d'un grand groupe du secteur des transports et des infrastructures, nous recherchons un(e) Ingénieur(e) IA Générative & Back-End afin de concevoir et industrialiser une plateforme souveraine d'IA générative dédiée à l'analyse documentaire, contractuelle et juridique.
Contexte & Objectifs :
Intégré(e) au pôle innovation et digital, votre rôle consistera à bâtir un socle technique IA local robuste, sécurisé et performant, basé sur des modèles Open Source, des architectures RAG avancées et des systèmes multi-agents.
Missions principales :
- Concevoir, développer et sécuriser les API REST et microservices (Python / FastAPI) soutenant la plateforme.
- Déployer et optimiser des modèles LLM Open Source en environnement local/on-premise (vLLM, Llama.cpp) et orchestrer les flux (LangChain, LangGraph).
- Mettre en œuvre les pipelines d'ingestion, OCR, indexation sémantique, bases vectorielles et stratégies de prompt engineering pour le traitement de documents complexes (PDF, Office, images).
- Structurer les flux ETL de préparation et d'enrichissement de données, intégrer les bases SQL/NoSQL.
- Optimiser la latence, l'usage des ressources GPU/CPU, la mémoire et le cache ; mettre en place le monitoring, les logs et la CI/CD.
- Garantir la sécurisation des flux, le respect des normes cyber internes et la conformité RGPD liée aux données sensibles.
- Collaborer avec les équipes métiers pour traduire leurs besoins en spécifications techniques et animer les ateliers projet.
- Ticket restaurant
- 12 RTT
-Prime vacances
-Plan épargne entreprise et retraite
-Prime de mobilité durable
-Co-développement encouragé
Contexte & Objectifs :
Intégré(e) au pôle innovation et digital, votre rôle consistera à bâtir un socle technique IA local robuste, sécurisé et performant, basé sur des modèles Open Source, des architectures RAG avancées et des systèmes multi-agents.
Missions principales :
- Concevoir, développer et sécuriser les API REST et microservices (Python / FastAPI) soutenant la plateforme.
- Déployer et optimiser des modèles LLM Open Source en environnement local/on-premise (vLLM, Llama.cpp) et orchestrer les flux (LangChain, LangGraph).
- Mettre en œuvre les pipelines d'ingestion, OCR, indexation sémantique, bases vectorielles et stratégies de prompt engineering pour le traitement de documents complexes (PDF, Office, images).
- Structurer les flux ETL de préparation et d'enrichissement de données, intégrer les bases SQL/NoSQL.
- Optimiser la latence, l'usage des ressources GPU/CPU, la mémoire et le cache ; mettre en place le monitoring, les logs et la CI/CD.
- Garantir la sécurisation des flux, le respect des normes cyber internes et la conformité RGPD liée aux données sensibles.
- Collaborer avec les équipes métiers pour traduire leurs besoins en spécifications techniques et animer les ateliers projet.
Ce que nous offrons
-Mutuelle familiale- Ticket restaurant
- 12 RTT
-Prime vacances
-Plan épargne entreprise et retraite
-Prime de mobilité durable
-Co-développement encouragé
Profil recherché
Profil recherché
Compétences techniques clés :
Langages & Frameworks : excellente maîtrise de Python et FastAPI.
IA Générative & LLM : solides acquis sur les modèles Open Source (Mistral, Llama, Qwen…), RAG avancé, embeddings, vector stores, fine-tuning et architectures multi-agents.
Moteurs d'inférence & Déploiement : vLLM, Llama.cpp, gestion des environnements GPU, Docker, Linux (Kubernetes apprécié).
Data & Systèmes : modélisation SQL et NoSQL, pipelines ETL, files de messages/traitements asynchrones.
DevOps & Outils : GitLab CI, tests automatisés, Jira, méthodologies Agile (Scrum/Kanban).
Qualités relationnelles :
- Capacité à vulgariser et faire le pont entre enjeux métiers et contraintes techniques.
- Rigueur d'ingénierie logicielle et sens aigu de l'organisation.
- Esprit d'équipe, aisance rédactionnelle et esprit de synthèse.
Compétences techniques clés :
Langages & Frameworks : excellente maîtrise de Python et FastAPI.
IA Générative & LLM : solides acquis sur les modèles Open Source (Mistral, Llama, Qwen…), RAG avancé, embeddings, vector stores, fine-tuning et architectures multi-agents.
Moteurs d'inférence & Déploiement : vLLM, Llama.cpp, gestion des environnements GPU, Docker, Linux (Kubernetes apprécié).
Data & Systèmes : modélisation SQL et NoSQL, pipelines ETL, files de messages/traitements asynchrones.
DevOps & Outils : GitLab CI, tests automatisés, Jira, méthodologies Agile (Scrum/Kanban).
Qualités relationnelles :
- Capacité à vulgariser et faire le pont entre enjeux métiers et contraintes techniques.
- Rigueur d'ingénierie logicielle et sens aigu de l'organisation.
- Esprit d'équipe, aisance rédactionnelle et esprit de synthèse.
L'entreprise
🚀 O2MAX est une ESN en croissance : 40 collaborateurs, +10 ans d'expérience, et une expertise reconnue en Java, Angular, Cloud, Data et Modern Work.
📍 Historiquement implantés à Lyon, nous accompagnons aujourd'hui nos clients multi-sites à Paris, Rennes et Aix-en-Provence pour renforcer proximité et réactivité.
👥 Notre taille humaine favorise la convivialité, l'agilité et des parcours de carrière sur-mesure : formations, certifications, mobilité entre agences, perspectives de management.
✨ Nos valeurs : convivialité & esprit d'équipe | exigence & bienveillance | engagement & persévérance.
Avec O2MAX, chaque mission est une aventure collective où consultants et clients grandissent ensemble.
📍 Historiquement implantés à Lyon, nous accompagnons aujourd'hui nos clients multi-sites à Paris, Rennes et Aix-en-Provence pour renforcer proximité et réactivité.
👥 Notre taille humaine favorise la convivialité, l'agilité et des parcours de carrière sur-mesure : formations, certifications, mobilité entre agences, perspectives de management.
✨ Nos valeurs : convivialité & esprit d'équipe | exigence & bienveillance | engagement & persévérance.
Avec O2MAX, chaque mission est une aventure collective où consultants et clients grandissent ensemble.