Tech Lead LLM Python APIs RAG Web - pré embauche client final possible - Freelance (H/F)
Collective.workMédiasPubliée aujourd'hui
~ 750 – 950 €/jFourchette estimée par FreelanceScope à partir du niveau d'expérience demandé : la source ne publie pas de TJM pour cette mission.
- Lieu
- Paris · Sur site
- Durée
- 6 mois
- Démarrage
- 17 octobre 2026
- Expérience
- Expert (10 ans et +)
- Langues
- Français
- Contrat
- Freelance
Situer cette mission
Repères calculés par FreelanceScope sur les missions ouvertes de son catalogue — ils ne proviennent pas de l'annonce et n'engagent pas l'entreprise.
- 134 missions ingénieur ia sont ouvertes à Paris en ce moment, sur 332 pour ce métier en France.
- 2 % des missions ingénieur ia de notre catalogue sont ouvertes en télétravail total.
- Compétences peu demandées ailleurs dans le catalogue : Zero Trust (19 missions), FastAPI (33 missions), RAG (114 missions). À séniorité égale, une compétence rare se négocie mieux.
Profil expert (10 ans et +) · Comment ces repères sont calculés
La mission
CONTEXTE
PRE EMBAUCHE - 6 mois de mission maximum Vous rejoignez l'équipe AI Service responsable d'une brique technologique stratégique de la plateforme du groupe. Mission internationale visant à fournir des capabilities IA aux produits utilisés par des professionnels du droit. En tant que Techlead, vous concevez des APIs robustes orchestrant des appels LLM, des pipelines RAG et des traitements massifs, avec contraintes de streaming, faible latence, concurrence, parallélisme, montée en charge, fiabilité et architecture multi-tenant (plusieurs pays).
MISSIONS
*
Conception et développement des services de consommation d'indexation et de restitution de données éditoriales :
*
Architecture des APIs et workers, stratégie de cache, mécanismes de résilience (retries, circuit breakers, fallback modèles).
*
Intégration LLM : chaînes d'inférence (prompting, function calling, RAG, embeddings, agents), industrialisation via POCs et benchmarks.
*
Performance et scalabilité : arbitrage débit, latence et coût (synchrone/asynchrone).
*
APIs Web et performance (synchrone / asynchrone) :
*
Définition d'APIs (FastAPI) robustes et documentées : contrats, validation (Pydantic), authentification unifiée et propagation du contexte pays.
*
Maîtrise asyncio, concurrence, parallélisme ; implémentation du streaming LLM, gestion des timeouts, backpressure et annulation.
*
Observability et sécurité : télémétrie (logs, métriques, traces), gestion des secrets, Zero Trust, isolation des tokens.
*
Leadership technique et gouvernance :
*
Gouvernance Inner Source, accompagnement des squads, promotion des pratiques Clean Code, SOLID, tests automatisés, veille et rayonnement technique.
STACK TECHNIQUE
*
Langages : Python 3.11+ (maîtrise requise), Go, Java / Spring Boot
*
Web / APIs : FastAPI, Starlette, Pydantic, Uvicorn (ASGI)
*
Asynchrone : asyncio, httpx, concurrence et parallélisme (threads, process, workers)
*
LLM : OpenAI / Azure OpenAI, LangChain, Mistral, Bedrock, etc.
*
Cloud : AWS, Azure
*
Données & infra : OpenSearch, Weaviate, PostgreSQL, Redis, Celery, Kafka, Docker, CI/CD
*
Tests : Pytest, pytest-asyncio
CONDITIONS DE TRAVAIL
*
Contrat : pré embauche, mission de 6 mois maximum
*
Environnement international, contexte européen quotidien
*
Rémunération : fourchette à définir
INFORMATIONS COMPLÉMENTAIRES
Abonnez-vous à la page NaxoTech sur LinkedIn pour découvrir nos offres régulières : https://www.linkedin.com/company/naxotech (https://www.linkedin.com/company/naxotech)
1. Diplôme : Master/Ingénieur/Ph.D 2. Maîtrise requise de Python 3.11+ 3. Connaissance des langages : Go, Java / Spring Boot 4. Expérience avec les frameworks Web / APIs : FastAPI, Starlette, Pydantic, Uvicorn (ASGI) 5. Maîtrise de la programmation asynchrone : asyncio, httpx, gestion de la concurrence et du parallélisme (threads, process, workers) 6. Expérience en intégration de modèles de langage (LLM) en production : OpenAI / Azure OpenAI, LangChain, Mistral, Bedrock, etc. 7. Connaissance des environnements Cloud : AWS, Azure 8. Compétences en données et infrastructure : OpenSearch, Weaviate, PostgreSQL, Redis, Celery, Kafka, Docker, CI/CD 9. Maîtrise des tests : Pytest, pytest-asyncio 10. Expérience en développement Python backend à grande échelle 11. Maîtrise des contrats d'API, versioning, gestion des dépendances et des tokens 12. Capacité à arbitrer entre synchrone et asynchrone tout en garantissant performance et sécurité 13. Anglais fluide (contexte européen quotidien)
Entreprise : Collective.work
Lieu de travail : 75 - Paris
Type de contrat : Profession libérale — Emploi non salarié
Expérience : Débutant accepté
Rémunération : - /
Code ROME : K1903 Juriste
Dernière mise à jour chez France Travail : 26/09/2026
Source : France Travail — offre reprise sous la Licence de réutilisation de la base de données des offres d'emploi (francetravail.io).
Compétences attendues
Indispensables
- LLM
- Python
- RAG
- FastAPI
- Zero Trust
- Tests automatisés
- Go
- Java
Appréciées
- Spring Boot
- Azure
- Azure OpenAI
- LangChain
- AWS
- Weaviate

