Aller au contenu
M1889 · Collective.work

Tech Lead Backend Python - AI Services / LLM - Freelance (H/F)

Description du poste

CONTEXTE

Dans le cadre de la construction d'une plateforme IA européenne destinée aux professionnels du droit, l'équipe AI Services recherche un profil senior capable de développer et d'industrialiser les services permettant aux différents produits du groupe d'exploiter des modèles de langage.

La mission porte principalement sur la couche Backend LLM : exposition des capacités IA, orchestration, streaming des réponses et mise en production de services performants et fiables.

MISSIONS PRINCIPALES

Concevoir et développer des APIs Python permettant d'exposer les capacités IA aux différents produits.

Intégrer et orchestrer plusieurs fournisseurs et modèles LLM.

Mettre en place le streaming des réponses et les traitements asynchrones.

Développer des mécanismes de function calling, tools et agents IA.

Participer à l'intégration des pipelines RAG et des services de Retrieval.

Optimiser les performances, la latence et les coûts d'utilisation des modèles.

Mettre en œuvre les mécanismes de résilience : timeouts, retries, fallbacks et circuit breakers.

Garantir la sécurité, la traçabilité et l'isolation des données.

Définir les contrats d'API, leur versioning et leur documentation.

Mettre en place l'observabilité : logs, métriques, traces, consommation de tokens et suivi des coûts.

Réaliser les revues de code et accompagner les développeurs sur les bonnes pratiques Python et IA.

Contribuer aux choix d'architecture et à l'industrialisation du socle AI Services.

ENVIRONNEMENT TECHNIQUE

Backend : Python 3.11+, FastAPI, Starlette, Pydantic, Uvicorn

Asynchrone : asyncio, httpx, Celery

Streaming : SSE, WebSockets

IA : OpenAI, Azure OpenAI, Mistral, AWS Bedrock

Orchestration : LangChain, LangGraph, function calling, agents et tools

Data & Retrieval : OpenSearch, Weaviate, PostgreSQL, pgvector, Redis

Messaging : Kafka

Cloud : AWS et/ou Azure

Industrialisation : Docker, Kubernetes, CI/CD

Tests : Pytest, pytest-asyncio

PROFIL RECHERCHÉ

Expérience confirmée en développement Backend Python sur des services en production.

Maîtrise de FastAPI et de la programmation asynchrone avec asyncio.

Expérience concrète dans l'intégration de LLM en production.

Maîtrise du streaming, de la concurrence et des traitements distribués.

Bonne compréhension des architectures RAG, des tools et des agents IA.

Capacité à gérer les contraintes de latence, de coût, de fiabilité et de sécurité.

Expérience dans la conception et l'exploitation d'APIs critiques.

Bonne culture engineering : tests, versioning, qualité du code et observabilité.

Capacité à rester très opérationnel dans le développement.

Anglais professionnel dans un contexte international.

QUALITÉS ATTENDUES

Autonomie et forte capacité d'exécution.

Leadership technique et pédagogie.

Rigueur sur la qualité, la sécurité et la fiabilité.

Sensibilité produit et compréhension des besoins des équipes consommatrices.

Capacité à vulgariser des sujets techniques complexes.

Esprit d'innovation et veille active sur l'écosystème GenAI.

POINTS INDISPENSABLES

Le profil doit pouvoir démontrer une expérience réelle sur :

des APIs Python/FastAPI en production ;

l'asynchronisme et le streaming de réponses LLM ;

l'intégration de modèles de langage dans des services critiques ;

la performance, la résilience et l'observabilité ;

une contribution directe et régulière au code.

Une expérience en Go ou Java constitue un plus.

Données marché — Ingénieur / Ingénieure en Intelligence Artificielle (IA)

Salaire net mensuel

Données non disponibles

Tension du marché

Données non disponibles

Projets de recrutement

Données non disponibles

À ne pas manquer

Offres similaires.