📝
Description du poste

Pour le compte d'un grand groupe du secteur des transports et des infrastructures, nous recherchons un(e) Ingénieur(e) IA Générative & Back-End afin de concevoir et industrialiser une plateforme souveraine d'IA générative dédiée à l'analyse documentaire, contractuelle et juridique.

Contexte & Objectifs :
Intégré(e) au pôle innovation et digital, votre rôle consistera à bâtir un socle technique IA local robuste, sécurisé et performant, basé sur des modèles Open Source, des architectures RAG avancées et des systèmes multi-agents.

Missions principales :

- Concevoir, développer et sécuriser les API REST et microservices (Python / FastAPI) soutenant la plateforme.
- Déployer et optimiser des modèles LLM Open Source en environnement local/on-premise (vLLM, Llama.cpp) et orchestrer les flux (LangChain, LangGraph).
- Mettre en œuvre les pipelines d'ingestion, OCR, indexation sémantique, bases vectorielles et stratégies de prompt engineering pour le traitement de documents complexes (PDF, Office, images).
- Structurer les flux ETL de préparation et d'enrichissement de données, intégrer les bases SQL/NoSQL.
- Optimiser la latence, l'usage des ressources GPU/CPU, la mémoire et le cache ; mettre en place le monitoring, les logs et la CI/CD.
- Garantir la sécurisation des flux, le respect des normes cyber internes et la conformité RGPD liée aux données sensibles.
- Collaborer avec les équipes métiers pour traduire leurs besoins en spécifications techniques et animer les ateliers projet.

Ce que nous offrons

-Mutuelle familiale
- Ticket restaurant
- 12 RTT
-Prime vacances
-Plan épargne entreprise et retraite
-Prime de mobilité durable
-Co-développement encouragé

🎯
Profil recherché

Profil recherché

Compétences techniques clés :

Langages & Frameworks : excellente maîtrise de Python et FastAPI.
IA Générative & LLM : solides acquis sur les modèles Open Source (Mistral, Llama, Qwen…), RAG avancé, embeddings, vector stores, fine-tuning et architectures multi-agents.
Moteurs d'inférence & Déploiement : vLLM, Llama.cpp, gestion des environnements GPU, Docker, Linux (Kubernetes apprécié).
Data & Systèmes : modélisation SQL et NoSQL, pipelines ETL, files de messages/traitements asynchrones.
DevOps & Outils : GitLab CI, tests automatisés, Jira, méthodologies Agile (Scrum/Kanban).

Qualités relationnelles :

- Capacité à vulgariser et faire le pont entre enjeux métiers et contraintes techniques.
- Rigueur d'ingénierie logicielle et sens aigu de l'organisation.
- Esprit d'équipe, aisance rédactionnelle et esprit de synthèse.
🎓 BAC+4/5 🎯 Confirmé

🏢
L'entreprise

🚀 O2MAX est une ESN en croissance : 40 collaborateurs, +10 ans d'expérience, et une expertise reconnue en Java, Angular, Cloud, Data et Modern Work.

📍 Historiquement implantés à Lyon, nous accompagnons aujourd'hui nos clients multi-sites à Paris, Rennes et Aix-en-Provence pour renforcer proximité et réactivité.

👥 Notre taille humaine favorise la convivialité, l'agilité et des parcours de carrière sur-mesure : formations, certifications, mobilité entre agences, perspectives de management.

✨ Nos valeurs : convivialité & esprit d'équipe | exigence & bienveillance | engagement & persévérance.

Avec O2MAX, chaque mission est une aventure collective où consultants et clients grandissent ensemble.
PME