Aller au contenu principal

Tech lead Expert Data Retrieval RAG - Freelance (H/F)

Collective.workMédiasPubliée hier

~ 750 – 950 €/jFourchette estimée par FreelanceScope à partir du niveau d'expérience demandé : la source ne publie pas de TJM pour cette mission.

Lieu
Paris · Hybride
Durée
6 mois
Démarrage
7 octobre 2026
Expérience
Expert (10 ans et +)
Langues
Français
Contrat
Freelance

Situer cette mission

Repères calculés par FreelanceScope sur les missions ouvertes de son catalogue — ils ne proviennent pas de l'annonce et n'engagent pas l'entreprise.

  • 73 missions qa engineer sont ouvertes à Paris en ce moment, sur 267 pour ce métier en France.
  • 1 % des missions qa engineer de notre catalogue sont ouvertes en télétravail total.
  • Compétences peu demandées ailleurs dans le catalogue : NLP (26 missions), Airflow (65 missions), Spark (87 missions). À séniorité égale, une compétence rare se négocie mieux.

Profil expert (10 ans et +) · Comment ces repères sont calculés

La mission

LE CONTEXTE

Rejoignez une aventure data au cœur de la Legaltech : notre client construit le moteur de recherche et d'indexation qui donnera accès, demain, à un patrimoine juridique massif et hétérogène pour plusieurs équipes à travers l'Europe.

Votre mission n'est pas d'écrire un simple script : c'est de concevoir des pipelines de données robustes, capables d'ingérer, nettoyer et indexer d'énormes corpus juridiques, puis d'exposer une recherche rapide, pertinente et hybride (sémantique + lexicale) à grande échelle.

VOS MISSIONS AU QUOTIDIEN

1. Collecte, ingestion & indexation

*

Concevoir des pipelines d'ingestion sur des sources hétérogènes (édition, open data, bases juridiques) : parsing, nettoyage, chunking, normalisation.

*

Choisir et industrialiser les modèles d'embeddings, alimenter et maintenir les bases vectorielles.

*

Garantir la fraîcheur des index, la scalabilité sur des volumétries massives et la traçabilité (lignage, versioning).

2. Recherche & pertinence (Retrieval)

*

Combiner recherche lexicale et sémantique (BM25 + embeddings), reranking et filtrage par métadonnées.

*

Mettre en place des métriques de pertinence (recall, precision, nDCG, MRR) et les faire vivre dans le temps.

*

Structurer la phase de retrieval qui alimente les LLM (RAG : contexte, citations, dé-duplication, gestion des fenêtres de contexte).

*

Instrumenter les pipelines (logs, métriques, traces qualité) et garantir la sécurité/conformité des données (RGPD, cloisonnement par pays).

3. Leadership technique & gouvernance

*

Promouvoir une culture Clean Code, SOLID et tests automatisés.

*

Contribuer au rayonnement technique du groupe (articles, meetups, open-source).

FORMATION

Master, PhD ou équivalent.

COMPÉTENCES ATTENDUES

*

Expérience avérée en data engineering / information retrieval sur des volumes massifs en production.

*

Expertise Retrieval confirmée : indexation, embeddings, recherche hybride - et capacité à mesurer puis améliorer la pertinence.

*

Culture Data forte : pipelines reproductibles, qualité et lignage des données, versioning des datasets/index.

*

Solide culture IA / ML (embeddings, NLP, bonne compréhension des LLM, sans nécessairement en être l'expert serving).

*

Un plus : appétence pour d'autres langages (notamment Java) pour des sujets transverses.

*

Anglais fluide (contexte européen quotidien).

SOFT SKILLS

*

Vision produit : vos index et votre moteur de recherche sont gérés comme un produit ; les autres développeurs sont vos clients.

*

Leadership technique & pédagogie : capacité à évangéliser les bonnes pratiques data/retrieval/IA.

*

Obsession de la qualité : rigueur absolue sur la sécurité des données (Legaltech oblige) et la fiabilité des services.

*

Esprit d'innovation : curiosité pour les avancées IA, NLP et data.

*

Communication : savoir vulgariser des concepts complexes.

Python 3.11+ (maîtrise requise), GoIndexationBases vectorielles (pgvector, Weaviate, Qdrant, OpenSearch), recherche hybride / BM25Embeddings & NLPsentence-transformers, modèles d'embeddings, tokenisation, parsing de documentsRAG & LLMLangChain, RAG, reranking, OpenAI, Mistral, BedrockData & infraPostgreSQL, Airflow / Spark, Kafka, Redis, Docker, CI/CD, K8sTests & qualitéPytest, évaluation de pertinence (recall, nDCG, MRR)

Entreprise : Collective.work

Lieu de travail : 75 - Paris

Type de contrat : Profession libérale — Emploi non salarié

Expérience : Débutant accepté

Rémunération : - /

Code ROME : K1903 Juriste

Dernière mise à jour chez France Travail : 16/09/2026

Source : France Travail — offre reprise sous la Licence de réutilisation de la base de données des offres d'emploi (francetravail.io).

Compétences attendues

Indispensables

  • LLM
  • RGPD
  • Tests automatisés
  • NLP
  • Java
  • Python
  • Airflow
  • Spark

Appréciées

  • Kafka
  • Redis
  • Docker
  • CI/CD

L'entreprise

Collective.work

Entreprise identifiée via France Travail.

Vendin-le-VieilÉducation

Origine de l'offre

Offre agrégée depuis France Travail

Cette annonce provient d'une source partenaire autorisée. Elle est normalisée, dédupliquée et republiée avec attribution de la source ; l'annonce d'origine fait foi et la candidature se dépose sur le site source.

Source : France Travail — offre publiée le 16/09/2026, reprise sous la Licence de réutilisation de la base de données des offres d'emploi. Le contenu de l'offre est repris dans son intégralité ; l'annonce d'origine fait foi.

Voir l'annonce sur France Travail

Cette mission correspond-elle à votre profil ?

Avec un compte gratuit, FreelanceScope calcule votre compatibilité avec cette mission et la justifie critère par critère. Chaque matin, il confronte les nouvelles offres du catalogue à votre profil et vous signale celles qui en ressortent les plus proches.

Créer mon compte

Gratuit, sans carte bancaire. J'ai déjà un compte

Missions similaires