• Accueil
  • Nos solutions
  • Notre technologie
  • Nos clients
  • À propos
    • L’écosystème
    • L’équipe
    • Notre blog
    • Newsletter
  • Nous contacter
  • Français
    • Français
    • English

Votre démo

Book your demo

  • Accueil
  • Nos solutions
  • Notre technologie
  • Nos clients
  • À propos
    • L’écosystème
    • L’équipe
    • Notre blog
    • Newsletter
  • Nous contacter
  • Français
    • Français
    • English


Classer les brevets selon les ODD de l’ONU : lipstip à Dataquitaine

Newsletter
Newsletter

La semaine dernière, Mohamed Cherif Sidhoum, data scientist chez lipstip, a présenté notre travail sur la classification des brevets selon les Objectifs de développement durable des Nations unies lors de la 9e édition de Dataquitaine. C’est un problème plus difficile qu’il n’y paraît.

Glossaire

  • ODD : Objectifs de développement durable définis par l’ONU.
  • Brevet : Titre de propriété industrielle protégeant une invention technique.
  • TAL / NLP : Traitement automatique du langage naturel par des systèmes informatiques.
  • BERT : Famille de modèles d’IA conçus pour comprendre des textes.
  • LLM : Grand modèle de langage capable de traiter et générer du texte à grande échelle.
  • IA frugale : Approche de l’IA privilégiant l’efficacité, la précision et une consommation de ressources réduite.

Bien sûr, sur le papier, classer des brevets selon les ODD ressemble à une tâche classique de traitement automatique du langage naturel. En pratique, les données brevets sont denses, techniques, hétérogènes et pleines de signaux qu’il est facile de surinterpréter. Tous les brevets n’entrent pas dans le cadre des ODD, et les informations pertinentes peuvent être réparties de façon très structurée dans l’ensemble du document. Ensuite, si l’on veut obtenir des résultats utiles à grande échelle, il faut plus qu’un modèle capable de produire une étiquette plausible.

Voici ce que Cherif a présenté à Dataquitaine : au lieu d’utiliser un grand modèle de langage pour traiter des documents entiers, nous avons construit un pipeline composé de plusieurs petits modèles fondés sur BERT. Chacun est focalisé sur des segments spécifiques et combiné à des règles métier explicites.

L’objectif était simple : placer le calcul là où se trouve réellement le signal, au lieu de demander à un modèle généraliste d’interpréter tout en une seule fois.

Un choix de conception central

D’abord, cette approche est bien plus rapide que les solutions génériques. Plus précisément, elle permet une inférence 50 fois plus rapide qu’une configuration standard fondée sur un LLM. Ensuite, elle est plus facile à comprendre et à vérifier. Chaque décision est traçable et compréhensible. C’est essentiel en propriété intellectuelle, où les professionnels ont besoin de savoir pourquoi une classification a été faite, et pas seulement de recevoir une réponse qui semble convaincante.

Nous avons aussi introduit dès le départ une classe dédiée Non-SDG. Cela peut paraître être un détail mineur, mais cela répond à un vrai problème pour les praticiens : les modèles généralistes ont tendance à forcer une classification même lorsque le contenu est hors du périmètre de la tâche. Cela crée du bruit, des labels fragiles et une fausse impression de précision. Donner au système une manière claire de dire « cela n’entre pas ici » rend le résultat global beaucoup plus fiable.

Notre datascientist était présent pour présenter notre solution BERT à Dataquitaine.

Le résultat est un système plus rapide que les approches standards fondées sur les LLM, plus interprétable et plus précis que les benchmarks habituels pour ce type de tâche.

Plus largement, ce travail reflète une conviction forte chez lipstip : des modèles plus grands ne sont pas automatiquement de meilleurs modèles. Dans un domaine comme la propriété intellectuelle, la performance ne se résume pas à la sortie produite. Il s’agit aussi de contrôle, de traçabilité et de la capacité de l’outil à tenir dans des conditions opérationnelles réelles. C’est aussi pour cela que nous accordons autant d’importance à l’IA frugale.

Une IA frugale dans toute la plateforme

Pour lipstip, l’IA frugale n’est pas qu’un mot à la mode. Si nous avons choisi cette voie, c’est aussi une décision d’ingénierie : lorsque la tâche est ciblée, spécifique et à forts enjeux, la meilleure réponse est souvent un système conçu autour du problème. Les modèles géants, construits pour tout couvrir, manqueront d’expertise et consommeront beaucoup plus d’énergie que notre solution.

in
LIPSTIP sur LinkedIn
Post public • Voir sur LinkedIn
Frugal AI, NLP et classification de brevets par objectifs de développement durable

LIPSTIP présente une approche de classification de brevets selon les SDGs, sans LLM dans la boucle, en s’appuyant sur une chaîne de petits modèles spécialisés de type BERT et des règles métier explicites.

Le post met en avant une inférence annoncée comme 50x plus rapide qu’un LLM, avec davantage de lisibilité et de bonnes performances sur les benchmarks standards.

Sujets
#FrugalAI #NLP #Patents #SDGs #TransferLearning #Dataquitaine
Ouvrir le post LinkedIn

Pour toutes ces raisons, la présentation de Mohamed Cherif Sidhoum à Dataquitaine, organisée à KEDGE Business School, a constitué une occasion unique de partager cette approche avec des experts de Nouvelle-Aquitaine et des territoires voisins. Elle reflète aussi le lien entre recherche académique et travail produit appliqué, un lien qui compte beaucoup pour nous. Mohamed Cherif mène ces recherches dans le cadre de son doctorat au LMAP, le laboratoire de mathématiques de l’Université de Pau et des Pays de l’Adour.

En conclusion

S’abonner à la Newsletter

Lors de Dataquitaine, lipstip a présenté une méthode de classification des brevets selon les Objectifs de développement durable de l’ONU reposant sur plusieurs modèles BERT spécialisés plutôt que sur un grand modèle unique. Cette approche est bien plus rapide, plus interprétable et plus fiable pour un domaine technique comme la propriété intellectuelle. L’ajout d’une classe Non-SDG évite les classements forcés et reflète l’engagement de lipstip en faveur d’une IA frugale.

Pour aller plus loin

Similitude des produits et services : ce que dit l’INPI

Juil 21, 2026

Rejoignez la Newsletter

Inscrivez-vous à la Newsletter lipstip pour ne rien louper de la transformation européenne de la propriété intellectuelle. Actualités, mises à jour, contenu exclusif et opportunités : abonnez-vous et restez au courant !

S'abonner
Book your Demo

lipstip

Contact

About us

Join the crew

Features

Contact

À propos

L’équipe

Nos solutions

Resources

News and statements

Lab and searches

Features updates

Our tech

Actualités

Le labo

Dernières nouveautés

Notre technologie

Book your demo
Votre démo

Legal notice

Privacy policy

Cookies notice

Careers at lipstip

Mentions légales

Politique de confidentialité

Cookies

Rejoindre lipstip

Gérer le consentement
Pour une expérience optimale, nous utilisons des technologies telles que des cookies pour enregistrer et / ou accéder à certaines informations. Accepter ces cookies nous permet de traiter certaines informations clés telles que les comportements du navigateur ou comptabiliser les visiteurs sur ce site. Refuser les cookies ou retirer le consentement peut avoir un impact sur certaines fonctionnalités de ce site.
Fonctionnel Always active
Le stockage ou l’accès technique est strictement nécessaire dans le but légitime de permettre l’utilisation d’un service spécifique explicitement demandé par l’abonné ou l’utilisateur, ou dans le seul but d’assurer la transmission d’une communication sur un réseau de communications électroniques.
Préférences
Le stockage ou l’accès technique est nécessaire dans le but légitime de stocker des préférences qui ne sont pas explicitement demandées par l’abonné ou l’utilisateur.
Statistiques
Le stockage ou l’accès technique est utilisé exclusivement à des fins statistiques. Le stockage ou l’accès technique est utilisé exclusivement à des fins statistiques anonymes.
En l’absence d’une obligation légale, du consentement volontaire de votre fournisseur d’accès à Internet ou de données supplémentaires provenant d’un tiers, les informations stockées ou récupérées à cette seule fin ne permettent généralement pas de vous identifier.
Marketing
Le stockage ou l’accès technique est utilisé pour créer des profils utilisateurs afin d’envoyer de la publicité, ou pour suivre l’utilisateur sur un site web ou sur plusieurs sites web à des fins de marketing similaires.
  • Manage options
  • Manage services
  • Manage {vendor_count} vendors
  • Read more about these purposes
Voir les options
  • {title}
  • {title}
  • {title}