You're seeing this page as if you were . The main menu is still yours, though. Exit from immersion
François WeberFW

François Weber

IA/ML - spécialisé en moteurs de recherche

€850/day
Paris, FR
8-15 years

Average response time: 1 hour

About François

Ingénieur et PhD en ML, j'ai pris le virage LLM dès son apparition. Après 3 postes très tournés vers la recherche d'information, les moteurs de recherche (y compris web scale) et l'agentic search, je me lance en freelance pour accompagner les entreprises qui cherchent à internaliser ce type de technologie. Exemple de projet cible: RAG, agentic search, moteur de recherche pour épauler une IA, etc.
  • French

    Native or bilingual

  • English

    Fluent

  • German

    Conversational

Can work on-site
Paris (up to 50km), Chantilly (up to 20km), Vernon (up to 20km), Strasbourg (up to 20km)

Experience

  • Linkup
    Member of the Technical Staff
    TECH
    February 2026 - Today (6 months)
    Contributions à la partie "agentic retrieval" du moteur de recherche :
    • mise en place d'une stack de learning to rank apte à itérer facilement
    • challenging de la méthodologie agentique permettant de dériver une query à partir d'une demande utilisateur complexe
    • vectorisation de l'index menée de bout en bout : benchmark des modèles d'embedding sur corpus métier, rédaction de la RFC et implémentation de la stack de vectorisation
    Search Engine Agentic AI Recherche
  • Leboncoin
    Machine Learning Engineer, Team Search Engine
    May 2024 - February 2026 (1 year and 9 months)
    Paris, France
    Datascientist spécialisé en information retrieval, je fais partie de l'équipe qui maintient et améliore le moteur de recherche de la plateforme. Mes réalisations :
    • pre-processing LLM des annonces afin d'augmenter le recall global : complétion de petites annonces par mots-clés, LLM as SPLADE pour sparse vector retrieval, PoC de nettoyage de doc "anti-SEO"
    • refonte du reranking sur la verticale "auto/moto"
    • création d'une pipeline de génération de judgements lists adaptées au besoin du Bon Coin
    • participation à un benchmark de vector DB via la mise en place d'un cluster Vespa à l'échelle du trafic du Bon Coin
    • Contribution à la guilde ML avec veille technologique
  • Qwant
    Datascientist / machine-learning engineer
    September 2019 - January 2024 (4 years and 4 months)
    Paris, France
    Pilotage de la création et maintenance de QwantML, lib interne de machine learning à visée industrielle
    • - Implémentation du lifecycle data et modèles (MLFlow, DVC)
    • - Implémentation ou intégration de modèles de référence en ranking (JAX, PyTorch, LightGBM) Création, MEP et utilisation quotidienne de la principale pipeline d'information retrieval sur index Vespa:
    • - Création et nettoyage des datasets de recherche d'information (PySpark, K8S, ArgoWorkflow)
    • - Fit de modèles de ranking via QwantML et MEP sur Vespa (ONNX, LightGBM)
    • - Création d'une nouvelle méthode de rank1 , MEP et soumission papier à BerlinBuzzWord23 (JAX)
    • - Mesure de qualité, reproductibilité, interprétabilité des modèles (LLM, MLFlow, Hydra, Captum) Contribution à une pipeline ML/NLP d'attribution d'une query à un index de topic pertinent parmi 1 k index
    • - Création et nettoyage de datasets de queries associées à leurs topics (PySpark, ArgoWorkflow)
    • - Vectorisation des queries et matching vectoriel contre 1 k index (HF, Vespa)
    • - Construction de meta-index représentant le scope de queries acceptable pour chaque index (FAISS) Exploration NLP pour augmenter le recall du ranking sur un index de 10G docs via expansion de documents
    • - Encadrement d'un stage de M2 sur l'industrialisation d'un ranking NLP sparse+dense (HF, SPLADE)
    • - Catégorisation de documents et expansion de documents (HF, SPLADE) Explorations sur le RAG avec recherche hybride sparse/dense (Llama-index, Vespa, RAG, LLM) Pilotage d'un projet pour maintenir un niveau de qualité satisfaisant de l'index principal Qwant
    • - Apprentissage et MEP d'un score de suppression de 5G spams dans l'index (SKLearn, HF, Vespa)
    • - Encadrement et MEP d'un stage de M2 sur la priorisation des documents à crawler (SKLearn)
    • - Développements et MEP en environnements conteneurisés via Docker, Kubernetes et ArgoWorkflow

Recommendations

Be the first to recommend François

Help this freelancer shine by sharing your experience working together.

These freelancer profiles also match your criteria

AgathaA

Agatha Frydrych

Backend Java Software Engineer

4.7

(3)

2

BaptisteB

Baptiste Duhen

Fullstack developer

4.6

(4)

5

AmedA

Amed Hamou

Senior Lead Developer

4

(2)

7

AudreyA

Audrey Champion

Web developer

4.3

(3)

4

Education

  • Doctorat, Mathématiques et statistiques
    Telecom ParisTech
    2017
    Doctorat, Mathématiques et statistiques
  • Diplôme d'ingénieur de l'ENSAI, Génie Statistique
    Ecole nationale de la Statistique et de l'Analyse de l'Information
    2013
    Diplôme d'ingénieur de l'ENSAI, Génie Statistique

Skill set

Categories