Fabricants et distributeurs industriels

Recherche IA dans vos fiches techniques et notices produit

Un assistant de recherche IA branché sur vos fiches techniques et vos notices répond à une question précise (une cote, une tolérance, une norme, une compatibilité, une pièce de rechange) en citant le document et la page d'où vient la valeur. Il signale quand deux documents se contredisent ou quand la fiche consultée n'est pas la dernière révision. Tensoria le conçoit sur mesure pour les fabricants et distributeurs dont la documentation produit compte des milliers de PDF, en plusieurs langues et en plusieurs versions.

Réponse citée à la pageVersions et contradictions signaléesDocuments internes et publics séparésSur devis

Pour qui

Les fabricants et distributeurs industriels dont la documentation produit (fiches techniques, notices d'installation, catalogues, déclarations de conformité) se compte en milliers de PDF. Les utilisateurs : ADV, commerciaux itinérants, SAV, techniciens, et parfois vos clients installateurs. Nos interlocuteurs habituels : direction commerciale, direction technique, DSI.

Le constat

Pourquoi une caractéristique produit est si longue à retrouver

Chez un fabricant ou un distributeur industriel, la réponse existe presque toujours. Elle se trouve dans un tableau, page 6 d'une fiche technique, dans la bonne révision, dans la bonne langue. La personne qui pose la question cherche une valeur, et les outils lui renvoient des documents.

La recherche d'une GED ou d'un SharePoint porte sur les noms de fichiers et sur le texte brut. Elle ne sait pas qu'un tableau de cotes a une ligne par taille, que la fiche de 2021 a été remplacée par la révision D, ni que la notice allemande et la notice française décrivent le même produit.

Résultat : l'ADV appelle le bureau d'études, le commercial rappelle son client plus tard, le SAV ouvre dix PDF pour trouver la pièce de rechange d'un modèle arrêté. Et ce sont souvent les deux ou trois personnes qui connaissent la gamme par cœur qui absorbent toutes ces questions.

Les questions qui reviennent chaque semaine

  • Dimensions et tolérances : « Quelle est la tolérance sur l'alésage de la version 40 mm ? »
  • Normes et conformité : « Ce coffret est-il testé selon l'EN 60529, et avec quel indice IP ? »
  • Compatibilités : « Ce moteur fonctionne-t-il avec le variateur de la gamme précédente ? »
  • Pièces de rechange : « Quel joint pour une pompe livrée en 2019 ? »
  • Équivalences entre gammes : « Quelle référence remplace celle-ci depuis le changement de gamme ? »

Ce que couvre cette page

La recherche d'une information précise sur un produit donné. Pour retrouver une procédure de dépannage, voir RAG industrie : documentation et maintenance. Pour choisir quel produit proposer à un client, voir conseiller le bon produit dans un grand catalogue.

Ce que fait l'assistant

Comment l'assistant répond à une question sur une fiche technique

L'utilisateur pose sa question en langage courant, avec ou sans la référence exacte. L'assistant cherche dans les documents de la bonne gamme, lit la valeur à sa source et répond avec la citation : document, révision, page.

Quand deux documents ne disent pas la même chose, il ne choisit pas en silence. Il montre les deux valeurs, leurs dates, et indique laquelle est la plus récente. Quand la valeur n'est dans aucun document, il le dit.

Exemple de question

Quel est l'indice IP du coffret CX-200 en version extérieure ? Le presse-étoupe M25 passe-t-il ?
Le CX-200 version extérieure (réf. CX-200-E) est donné IP66 dans la fiche technique révision D de mars 2025, page 2. La notice de montage de 2022 indique IP65 en page 7 : elle est antérieure à la révision D, la fiche est la source la plus récente. Pour le presse-étoupe, la notice prévoit des entrées M20 et M25 (page 4) : le M25 est prévu.
Fiche technique CX-200, rév. D, p. 2 Notice de montage 2022, p. 7 (version ancienne) Notice de montage 2022, p. 4

Exemple illustratif, références et valeurs fictives. Chaque citation ouvre le PDF à la page concernée.

01

Comprendre la question

Repérer la référence, la gamme, la grandeur demandée (cote, indice, couple, norme) et la langue de l'utilisateur. Si la référence est ambiguë, l'assistant demande laquelle.

02

Chercher au bon endroit

Filtrer par gamme, révision, langue et droits de l'utilisateur, puis chercher à la fois la référence exacte et le sens de la question dans les documents restants.

03

Lire la valeur à sa source

La ligne du tableau, avec son en-tête et son unité, ou le paragraphe de la notice. La valeur est recopiée telle qu'elle figure dans le document, sans conversion ni arrondi.

04

Répondre avec ses sources

Document, révision, page, et les alertes utiles : contradiction entre deux sources, révision ancienne, référence remplacée, valeur introuvable.

Type de question Où se trouve la réponse Ce que renvoie l'assistant Point de vigilance
Dimensions, tolérances, poids Tableaux de la fiche technique, plans cotés La valeur, son unité, la ligne du tableau et la page Une ligne décalée à l'extraction donne la cote d'une autre taille
Normes et conformité Fiche technique, déclaration UE de conformité, rapports d'essai La norme citée, sa version si elle figure, le document qui l'atteste Une conformité transmise à un client est vérifiée par une personne
Compatibilités Notices, tableaux d'association, catalogues d'accessoires La compatibilité si un document l'affirme, avec la citation L'assistant ne déduit pas une compatibilité qu'aucun document n'écrit
Pièces de rechange Vues éclatées, nomenclatures, listes de pièces par millésime La référence de pièce pour le modèle et l'année demandés Le millésime du produit change souvent la réponse
Équivalences entre gammes Tables de correspondance, ERP ou PIM (statut des références) La référence de remplacement et les écarts de caractéristiques connus Sans table de correspondance tenue à jour, la réponse reste fragile

Fiabilité

Ce qui rend les réponses fiables sur des fiches techniques

Pour un dirigeant, trois règles : l'assistant ne répond qu'à partir de vos documents, il cite la page, il dit quand il ne sait pas. Pour la DSI, chaque point ci-dessous précise comment c'est mis en œuvre sur des milliers de PDF.

Tableaux et schémas

Chaque valeur garde sa ligne et sa colonne

Un PDF converti en texte brut mélange les colonnes d'un tableau. On extrait la mise en page avec un outil comme Docling (reconnaissance de structure des tableaux), un modèle de vision prend le relais sur les pages complexes, et chaque ligne est indexée avec l'en-tête de son tableau.

Références et codes

Une recherche hybride pour les termes exacts

La recherche vectorielle comprend « étanchéité du boîtier » mais confond facilement CX-200 et CX-2000. La recherche lexicale BM25 retrouve la référence exacte, la recherche vectorielle le sens. Les deux classements sont fusionnés (Reciprocal Rank Fusion) puis réordonnés par un modèle de reranking.

Gammes et versions

Des filtres avant la recherche

À l'ingestion, chaque document reçoit ses métadonnées : gamme, références couvertes, révision, date, langue, statut (en vigueur ou archivé). La recherche commence par filtrer, ce qui évite de citer une fiche de 2018 quand la révision de 2025 existe.

Contradictions

Deux valeurs, deux sources, une règle écrite

Quand deux documents donnent des valeurs différentes pour la même référence, la réponse montre les deux. La règle qui dit quelle source fait foi est fixée par votre direction technique, pas laissée au modèle.

Refus

« Valeur introuvable » plutôt qu'une estimation

L'assistant n'interpole pas entre deux tailles et ne complète pas une valeur manquante. Sans source, il le dit et propose de transmettre la question au bureau d'études.

Évaluation

Mesurée sur vos vraies questions

Un jeu de test construit avec vos équipes : la question, la valeur attendue, l'unité, le document et la page. On mesure la valeur exacte, la bonne citation et les refus justifiés, avant la mise en service et à chaque changement de modèle.

Ce que dit la mesure

Sur ses corpus de test, Anthropic a mesuré qu'associer des embeddings et un index BM25 enrichis du contexte de chaque passage faisait passer le taux d'échec de récupération (sur les 20 premiers passages) de 5,7 % à 2,9 %, puis à 1,9 % avec un reranking (Anthropic, septembre 2024). Ces chiffres ne se transposent pas tels quels à vos fiches : c'est pour cela qu'on mesure sur vos documents.

Données et intégration

Vos documents, vos droits d'accès, votre hébergement

L'assistant lit les documents là où ils sont déjà rangés et s'affiche dans les outils que vos équipes utilisent.

Sources

Où sont vos fiches aujourd'hui

Serveur de fichiers, SharePoint, GED, PIM, espace de téléchargement du site. L'ERP ou le PIM donne le statut des références (active, remplacée, arrêtée). Une nouvelle révision est réindexée, l'ancienne passe au statut archivé.

Droits d'accès

Documents internes et documents publics

Plans, tolérances de fabrication et notes du bureau d'études restent internes. Fiches publiées et notices peuvent être ouvertes à vos clients. Le filtrage se fait à la recherche, avec les groupes de l'utilisateur connecté (SSO Entra ID ou Google) : un document non autorisé n'est jamais envoyé au modèle.

Interfaces

Là où la question se pose

Application web interne ou Teams pour l'ADV et le SAV, version mobile pour les commerciaux en rendez-vous, widget sur votre espace professionnel pour les installateurs. Chaque citation ouvre le PDF à la bonne page.

Plusieurs langues

Avec des embeddings multilingues, une question posée en français retrouve un passage rédigé en allemand ou en anglais. La réponse est rédigée dans la langue de l'utilisateur et cite le passage d'origine. Pas besoin de traduire toute la documentation avant de commencer.

Hébergement

Dans votre cloud (Azure, AWS, Google Cloud), sur un cloud français (OVHcloud, Scaleway, Outscale) ou sur vos serveurs. Les modèles sont appelés en région européenne, ou auto-hébergés en open-weight quand les plans et les tolérances ne doivent pas sortir de chez vous.

Choisir le bon outil

Quand un moteur de recherche suffit, et ce que l'assistant ne fait pas

Un assistant IA n'est pas toujours la bonne réponse. Si vos caractéristiques sont déjà propres et structurées, un moteur de recherche bien paramétré fait le travail pour moins cher.

Un moteur de recherche suffit

Quand la donnée est déjà structurée

  • Les caractéristiques sont saisies comme attributs dans un PIM : une recherche à facettes répond
  • Vos équipes cherchent un document (la notice du modèle X), pas une valeur à l'intérieur
  • Quelques centaines de fiches bien nommées, une seule langue, une seule révision en vigueur

Un assistant IA est utile

Quand la réponse est enfouie dans les PDF

  • La valeur est dans un tableau au milieu d'une fiche, et n'existe nulle part ailleurs
  • La question croise deux documents : une notice et un tableau d'accessoires, par exemple
  • Plusieurs langues et plusieurs révisions coexistent pour les mêmes références

Limites et conditions de réussite

Les scans et les plans cotés

Un PDF scanné de travers ou une cote lue dans un dessin donnent des résultats moins fiables qu'un tableau natif. Sur ces documents, l'assistant renvoie vers la page plutôt que d'affirmer une valeur.

Une documentation contradictoire

L'assistant rend visibles les écarts entre documents, il ne les corrige pas. La liste des contradictions trouvées est utile à votre direction technique, mais c'est elle qui tranche.

Le statut des références

Les équivalences entre gammes supposent une source fiable sur les produits remplacés, dans l'ERP, le PIM ou une table de correspondance. Sans elle, l'assistant cite ce que disent les documents, sans pouvoir garantir qu'ils sont à jour.

Ce qui engage l'entreprise

Une valeur qui part dans une offre, une attestation de conformité ou une réponse à réclamation est vérifiée par une personne sur la page citée. L'assistant raccourcit la recherche, la validation reste humaine.

Cas proches

Références exactes et documentation technique : deux projets livrés

Nous n'avons pas encore publié de cas portant sur les fiches produit d'un fabricant. Deux projets livrés reposent sur les mêmes briques : documentation technique volumineuse, termes exacts à retrouver, réponse sourcée.

Chez Continental, plus de 15 000 documents techniques (manuels d'équipements, procédures de maintenance, historiques de pannes, normes de sécurité) étaient dispersés entre SharePoint, des PDF et des wikis. La recherche sémantique seule donnait 67 % de réponses correctes : elle ratait les références de pièces et les codes d'erreur exacts. Avec une recherche hybride sémantique et BM25, la précision est passée à 89 %, pour plus de 2 000 utilisateurs sur plusieurs sites.

Chez un éditeur toulousain de logiciel médical, la recherche sémantique ratait parfois des termes très précis : noms de tests statistiques, abréviations métier. La combinaison BM25 et recherche vectorielle, fusionnée par Reciprocal Rank Fusion puis réordonnée, a été déployée sur Qdrant en Europe, avec des LLM européens sur AWS. Le volume de tickets support a été réduit de moitié.

Ce qui se transpose aux fiches techniques : la recherche hybride pour les références, et le poids de la préparation des données, qui a représenté 40 % de l'effort total chez Continental.

89 %
Réponses correctes chez Continental, contre 67 % en sémantique seule
15 000
Documents techniques indexés
2 000+
Utilisateurs sur les lignes de production
-50 %
Tickets support chez l'éditeur médical

Temps de recherche chez Continental

De 30 à 60 minutes de recherche manuelle à moins de 10 secondes pour obtenir une réponse sourcée. Le chiffre porte sur des procédures de maintenance, pas sur des fiches produit : chez vous, il se mesure au prototype.

Lire le cas client

Éditeur médical : RAG et support utilisateur

Documentation et vidéos indexées, recherche hybride BM25, LLM hébergés en Europe sur AWS.

Méthode

Déroulé d'un projet d'assistant de recherche sur fiches techniques

On part des questions que vos équipes posent vraiment, on mesure sur une ou deux gammes, puis on élargit.

01

Cadrage sur vos questions réelles

Recueil des questions posées à l'ADV, au SAV et au bureau d'études, avec la valeur attendue et la page. Inventaire documentaire : volumes, formats, part de scans et de tableaux, langues, révisions, droits d'accès.

02

Prototype évalué sur une ou deux gammes

Extraction des tableaux, recherche hybride, citations. Mesure sur le jeu de test : valeur exacte, bonne unité, bonne page, refus justifiés, coût par question. La suite se décide sur ces chiffres.

03

Ingestion complète et intégration

Toutes les gammes, métadonnées de révision et de statut, connexion aux sources, droits d'accès via votre SSO, interface choisie (web, Teams, mobile), hébergement retenu au cadrage.

04

Mise en service progressive

ADV et SAV d'abord, puis les commerciaux. L'ouverture aux clients installateurs, sur les seuls documents publics, vient quand les résultats internes sont stables.

05

Suivi et transfert

Les questions sans réponse donnent la liste des fiches à compléter. Réindexation automatique des nouvelles révisions, évaluation rejouée à chaque changement de modèle, formation de votre équipe.

Budget, livrables, délais

Sur devis, selon le nombre de documents, la part de tableaux et de scans, les langues, les sources et l'hébergement. Livrables : rapport de mesure du prototype, pipeline d'ingestion, assistant intégré, jeu de test, documentation, code livré dans votre dépôt. Le premier échange de 30 minutes est gratuit.

Un prototype existe déjà ?

Si votre équipe a déjà monté un premier assistant sur vos fiches et que les valeurs renvoyées ne sont pas assez fiables, l'audit RAG et agents IA mesure ce qu'il vaut sur vos documents et localise les causes d'erreur : extraction, recherche ou génération.

Questions fréquentes

La recherche d'une GED retrouve un document à partir de son nom ou de mots présents dans le texte : il reste à l'ouvrir et à trouver la bonne ligne du bon tableau. Un PIM répond très bien quand la caractéristique est déjà saisie comme attribut. L'assistant IA lit le contenu des PDF, y compris les tableaux, et renvoie la valeur avec le document et la page. Si vos caractéristiques sont déjà propres dans un PIM, une recherche à facettes sur ce PIM peut suffire.
Les tableaux, oui, à condition de les extraire en gardant leur structure : chaque valeur reste rattachée à sa ligne, à sa colonne et à son en-tête. Les schémas cotés sont plus fragiles : l'assistant peut les décrire et renvoyer vers la page, mais une cote lue dans un dessin est vérifiée par une personne avant d'être transmise à un client. Les PDF scannés passent par une étape d'OCR, dont la qualité dépend du scan.
Il affiche les deux valeurs avec leur document, leur page et leur date de révision, et indique laquelle est la plus récente. La règle qui décide quelle source fait foi (fiche technique, notice, catalogue) est fixée avec votre direction technique au cadrage. Ces contradictions sont aussi remontées dans un rapport, pour que la documentation soit corrigée.
Non. Les modèles d'embeddings multilingues permettent de poser la question en français et de retrouver un passage rédigé en allemand. La réponse est rédigée dans la langue de l'utilisateur et cite le passage d'origine dans sa langue. On filtre aussi par langue quand une fiche existe dans plusieurs traductions, pour éviter de citer trois fois la même information.
Oui, sur les documents que vous publiez déjà : fiches techniques, notices, déclarations de conformité. Les documents internes (plans, tolérances de fabrication, notes du bureau d'études) sont dans un périmètre séparé. Le filtrage se fait à la recherche, selon les droits de l'utilisateur connecté : un document non autorisé n'est jamais transmis au modèle.
Là où vous le décidez : dans votre cloud (Azure, AWS, Google Cloud), sur un cloud français ou sur vos serveurs. Les modèles sont appelés en région européenne ou auto-hébergés quand les documents ne doivent pas sortir de votre infrastructure. Le choix se fait au cadrage, selon la sensibilité des documents.
Le développement est sur devis, selon le nombre de documents, la part de tableaux et de scans, les langues, les sources à connecter et l'hébergement. S'y ajoute un coût d'usage des modèles par question, mesuré pendant le prototype sur vos documents.
Un prototype évalué sur une ou deux gammes demande quelques semaines. Pour donner un ordre de grandeur réel : le projet Continental (15 000 documents, plus de 2 000 utilisateurs) comptait un proof of concept de 4 à 6 semaines et un déploiement complet de l'audit à la production en 4 à 6 mois. L'état des PDF et le nombre de sources pèsent le plus sur ce délai.

Parlons de votre documentation produit

Venez avec quatre ou cinq questions que vos équipes posent souvent et quelques fiches concernées. En 30 minutes, on regarde si un assistant IA est utile chez vous ou si un moteur de recherche bien paramétré suffit.