Aller au contenu
K1903 · Collective.work

Tech Lead LLM Python APIs RAG Web - pré embauche client final possible - Freelance (H/F)

Description du poste

CONTEXTE

PRE EMBAUCHE - 6 mois de mission maximum

Vous rejoignez l'équipe AI Service responsable d'une brique technologique stratégique de la plateforme du groupe. Mission internationale visant à fournir des capabilities IA aux produits utilisés par des professionnels du droit. En tant que Techlead, vous concevez des APIs robustes orchestrant des appels LLM, des pipelines RAG et des traitements massifs, avec contraintes de streaming, faible latence, concurrence, parallélisme, montée en charge, fiabilité et architecture multi-tenant (plusieurs pays).

MISSIONS

Conception et développement des services de consommation d'indexation et de restitution de données éditoriales :

Architecture des APIs et workers, stratégie de cache, mécanismes de résilience (retries, circuit breakers, fallback modèles).

Intégration LLM : chaînes d'inférence (prompting, function calling, RAG, embeddings, agents), industrialisation via POCs et benchmarks.

Performance et scalabilité : arbitrage débit, latence et coût (synchrone/asynchrone).

APIs Web et performance (synchrone / asynchrone) :

Définition d'APIs (FastAPI) robustes et documentées : contrats, validation (Pydantic), authentification unifiée et propagation du contexte pays.

Maîtrise asyncio, concurrence, parallélisme ; implémentation du streaming LLM, gestion des timeouts, backpressure et annulation.

Observability et sécurité : télémétrie (logs, métriques, traces), gestion des secrets, Zero Trust, isolation des tokens.

Leadership technique et gouvernance :

Gouvernance Inner Source, accompagnement des squads, promotion des pratiques Clean Code, SOLID, tests automatisés, veille et rayonnement technique.

STACK TECHNIQUE

Langages : Python 3.11+ (maîtrise requise), Go, Java / Spring Boot

Web / APIs : FastAPI, Starlette, Pydantic, Uvicorn (ASGI)

Asynchrone : asyncio, httpx, concurrence et parallélisme (threads, process, workers)

LLM : OpenAI / Azure OpenAI, LangChain, Mistral, Bedrock, etc.

Cloud : AWS, Azure

Données & infra : OpenSearch, Weaviate, PostgreSQL, Redis, Celery, Kafka, Docker, CI/CD

Tests : Pytest, pytest-asyncio

CONDITIONS DE TRAVAIL

Contrat : pré embauche, mission de 6 mois maximum

Environnement international, contexte européen quotidien

Rémunération : fourchette à définir

INFORMATIONS COMPLÉMENTAIRES

Abonnez-vous à la page NaxoTech sur LinkedIn pour découvrir nos offres régulières :

https://www.linkedin.com/company/naxotech (https://www.linkedin.com/company/naxotech)

  1. Diplôme : Master/Ingénieur/Ph.D
  2. Maîtrise requise de Python 3.11+
  3. Connaissance des langages : Go, Java / Spring Boot
  4. Expérience avec les frameworks Web / APIs : FastAPI, Starlette, Pydantic, Uvicorn (ASGI)
  5. Maîtrise de la programmation asynchrone : asyncio, httpx, gestion de la concurrence et du parallélisme (threads, process, workers)
  6. Expérience en intégration de modèles de langage (LLM) en production : OpenAI / Azure OpenAI, LangChain, Mistral, Bedrock, etc.
  7. Connaissance des environnements Cloud : AWS, Azure
  8. Compétences en données et infrastructure : OpenSearch, Weaviate, PostgreSQL, Redis, Celery, Kafka, Docker, CI/CD
  9. Maîtrise des tests : Pytest, pytest-asyncio
  10. Expérience en développement Python backend à grande échelle
  11. Maîtrise des contrats d'API, versioning, gestion des dépendances et des tokens
  12. Capacité à arbitrer entre synchrone et asynchrone tout en garantissant performance et sécurité
  13. Anglais fluide (contexte européen quotidien)

Données marché — Juriste

Salaire net mensuel
Débutant3 894 €
Moyen4 653 €
Expérimenté5 338 €
Tension du marché

Données non disponibles

Projets de recrutement
2 967

postes prévus (BMO 2025)

Se former à ce métier

À ne pas manquer

Offres similaires.