Contractzlab Research

Faire de l'IA juridique une discipline scientifique, pas une promesse marketing.

Contractzlab Research est le laboratoire d'IA qui conçoit, entraîne et évalue les modèles au cœur de la plateforme Contractzlab. Notre mission : produire une recherche rigoureuse en droit, conformité et gestion du risque, et la transformer en systèmes fiables pour les organisations les plus exigeantes.

Voir nos publications
3
axes de recherche actifs
436
questions juridiques dans notre dernier benchmark
2
continents couverts par nos données d'évaluation
100 %
recherche conduite en interne
Notre laboratoire

Une équipe de recherche adossée à un produit utilisé en production

Contractzlab Research est né d'un constat simple : la plupart des modèles présentés comme « juridiques » sont des modèles généralistes reformulés, jamais réellement évalués sur des tâches de droit, de conformité ou de gestion du risque.

Notre laboratoire réunit chercheurs en machine learning, juristes et experts en conformité réglementaire, basés à Paris et à Tunis. Chaque modèle que nous publions est d'abord un objet de recherche : entraîné, testé, mesuré, avant d'être intégré à la plateforme Contractzlab et utilisé chaque jour par des banques, des assureurs, des cabinets d'avocats et de grandes entreprises.

  • Recherche appliquée, validée en conditions réelles de production
  • Équipe pluridisciplinaire : ML, droit, conformité réglementaire
  • Présence à Paris et à Tunis
  • Publications et benchmarks ouverts à la communauté
Notre vision

Un droit assisté par l'IA, jamais délégué à l'IA

Nous pensons que la valeur d'une IA juridique ne se mesure pas à sa capacité à produire du texte convaincant, mais à sa capacité à raisonner correctement, de façon reproductible, sous le contrôle d'un professionnel du droit. Notre horizon : des modèles dont la fiabilité est démontrée avant d'être déployée, et dont chaque amélioration est mesurable, pas seulement perçue.

Axes de recherche

Trois directions structurent nos travaux

01

Raisonnement juridique spécialisé

Spécialisation de modèles de langage par apprentissage par renforcement pour le raisonnement contractuel, réglementaire et de conformité — au-delà de la simple restitution d'information.

02

Évaluation et benchmarking

Conception de protocoles d'évaluation rigoureux — double jugement indépendant, tests statistiques de significativité — pour mesurer objectivement la qualité d'un raisonnement juridique.

03

Risque, conformité et couverture géographique

Extension de nos benchmarks et modèles aux cadres réglementaires d'Europe, d'Afrique et des marchés émergents, pour une IA juridique fiable au-delà des juridictions les mieux documentées.

Publications

Nos travaux publiés

Chaque publication documente la méthodologie, les données d'évaluation et les résultats — reproductibles et ouverts à la discussion.

Legal AI

ContractZLab Benchmark : mesurer le raisonnement juridique, réglementaire et de risque en Europe, Afrique et marchés émergents

Protocole d'évaluation multi-juridictionnel

Legal AI

GraphRAG et intelligence juridique : structurer la connaissance contractuelle en graphe

Génération augmentée par graphe appliquée à la compréhension des documents juridiques

Legal AI

Benchmark LLM & Conformité : évaluer les modèles de langage sur des tâches réglementaires

Un protocole de benchmark dédié à l'évaluation de la conformité réglementaire

Benchmarks

Mesurer avant d'affirmer

Nous construisons et utilisons des protocoles d'évaluation conçus pour résister à l'examen, pas pour flatter nos résultats.

Référence externe

LEXam

Benchmark de référence pour le raisonnement juridique, utilisé pour évaluer Mike-7B face aux modèles généralistes.

436
questions évaluées
+9,4 %
gain mesuré
Benchmark propriétaire

ContractZLab Benchmark

Protocole conçu en interne pour évaluer le raisonnement juridique, réglementaire et de risque sur des juridictions d'Europe, d'Afrique et des marchés émergents.

Multi-juridiction
couverture
Méthodologie

Double jugement indépendant

Chaque réponse est évaluée par deux modèles juges distincts (GPT-4o, DeepSeek) afin d'éliminer le biais d'un évaluateur unique, avec test de significativité statistique.

2
juges IA indépendants
Notre philosophie

Cinq principes qui encadrent nos travaux

Une recherche appliquée au droit engage une responsabilité particulière : celle de ne jamais confondre fluidité du langage et exactitude du raisonnement.

La rigueur avant l'annonce

Aucun résultat n'est communiqué sans protocole d'évaluation documenté et testé statistiquement.

Le contrôle humain reste la règle

Nos modèles assistent la décision juridique, ils ne la remplacent jamais.

La donnée client n'entraîne jamais nos modèles

L'entraînement s'effectue sur des corpus contrôlés, indépendamment des données traitées en production.

La reproductibilité comme standard

Nos méthodologies sont documentées pour être comprises, discutées et challengées.

La couverture géographique compte

Un modèle fiable en France doit l'être aussi en Afrique et sur les marchés émergents — pas seulement dans les juridictions les mieux documentées.

Collaborations

Une recherche construite avec le terrain

Nos travaux se nourrissent des retours de nos utilisateurs et de partenaires experts du droit et de la conformité.

🏦

Institutions financières

Cas d'usage réels en conformité, KYC et gestion du risque contractuel.

⚖️

Cabinets d'avocats

Validation experte de la qualité du raisonnement juridique produit.

🎓

Monde académique

Échanges méthodologiques sur l'évaluation des modèles de langage spécialisés.

🌍

Écosystème Europe–Afrique

Extension de notre couverture réglementaire aux marchés émergents.

Roadmap de recherche

Ce sur quoi nous travaillons

Une feuille de route guidée par la même exigence : ne publier que ce qui est mesuré.

En cours

Extension de la famille de modèles Mike

Élargissement des capacités de raisonnement à de nouveaux domaines contractuels et réglementaires.

Prochaine étape

Couverture réglementaire élargie

Renforcement du ContractZLab Benchmark sur de nouvelles juridictions d'Afrique et des marchés émergents.

À venir

Ouverture progressive de nos benchmarks

Partage de protocoles d'évaluation avec la communauté recherche pour renforcer la comparabilité des modèles juridiques.

Vision long terme

Standards de fiabilité pour l'IA juridique

Contribuer à définir des critères d'évaluation reconnus pour les modèles de langage appliqués au droit et à la conformité.

Chercheurs, juristes, institutions : construisons ensemble la prochaine génération d'IA juridique

Contractzlab Research échange avec des équipes académiques, des institutions financières et des cabinets d'avocats souhaitant contribuer à nos travaux d'évaluation.