Passer au contenu principal

📄 Structurer mes documents pour optimiser les performances de l'IA Didask

La qualité des réponses de l'IA dépend directement de la structure de vos documents : clarté, unicité du sujet, absence de redondances et droits d'accÚs adaptés.

Écrit par OcĂ©ane

⏱ L'essentiel en 3 minutes
​
‱ Un document performant traite un seul sujet, se rĂ©sume en un titre court et prĂ©cis, et ne contient que des informations Ă  jour.
‱ Les redondances entre documents font concurrence aux informations complĂ©mentaires et dĂ©gradent la pertinence des rĂ©ponses.
‱ Les droits d'accĂšs doivent correspondre au pĂ©rimĂštre rĂ©el des utilisateurs concernĂ©s pour Ă©viter les interfĂ©rences.
‱ Quatre questions Ă  se poser avant chaque import : sujet unique ? informations valables ? pas de doublons ? accĂšs appropriĂ©s ?


🧠 Comprendre l'enjeu pĂ©dagogique de la structure documentaire

L'IA Didask ne "lit" pas un document comme un humain : elle compare chaque question Ă  l'ensemble de votre base et sĂ©lectionne les passages les plus proches du besoin de l'apprenant. Un document mal structurĂ©, trop long, trop vague, ou redondant avec d'autres sera difficile Ă  retrouver, mĂȘme s'il contient la bonne rĂ©ponse.

Soigner la structure de vos documents, c'est permettre à l'IA de localiser précisément ce dont chaque collaborateur a besoin au bon moment. C'est aussi une façon de garantir que vos connaissances métier sont transmises avec fidélité, sans bruit ni ambiguïté.


✅ Évaluer un document avant de l'ajouter à la base

Avant tout import, posez-vous ces quatre questions :

Question

Si la réponse est non...

Puis-je résumer ce document en un titre court et précis ?

Le document traite probablement de trop de sujets : le découper.

Toutes les informations sont-elles encore valables ?

Nettoyer le document ou ne pas l'inclure.

Y a-t-il d'autres documents dans la base qui disent la mĂȘme chose ?

Supprimer les parties communes ou fusionner les documents.

Ce document est-il utile Ă  tous les utilisateurs qui ont accĂšs Ă  cette base ?

Restreindre l'accÚs ou séparer en bases distinctes.


📌 Respecter la rùgle : un document, un seul sujet

Un document qui traite plusieurs sujets Ă  la fois sera difficile Ă  associer Ă  une question prĂ©cise. L'IA aura du mal Ă  l'identifier comme la source la plus pertinente, mĂȘme s'il contient la bonne information.

Le signe révélateur : vous avez du mal à lui donner un titre court et précis.

  • Bon exemple : "Processus de validation d'un devis client" qui explique uniquement les Ă©tapes de validation, les interlocuteurs et les dĂ©lais.

  • À Ă©viter : "RĂ©union Ă©quipe commerciale du 12 mars" qui aborde Ă  la fois la validation des devis, un point RH, la stratĂ©gie Q3 et un post-mortem de bug.

Que faire : découpez le document en autant de documents qu'il y a de sujets distincts. Chaque document doit avoir un titre qui résume son contenu en une phrase courte.


đŸ§č Supprimer les informations obsolĂštes

L'IA ne peut pas distinguer ce qui est encore valable de ce qui est périmé. Une information ancienne peut rendre la bonne information plus difficile à trouver, voire provoquer des réponses incorrectes.

  • Bon exemple : une politique de remboursement des frais Ă  jour, contenant uniquement les rĂšgles actuellement en vigueur.

  • À Ă©viter : le mĂȘme document auquel on a ajoutĂ© les nouvelles rĂšgles en bas, sans supprimer les anciennes. L'IA ne sait pas lesquelles sont valides.

Que faire : extraire uniquement les parties encore valables et crĂ©ez un nouveau document propre. Si un document est trop polluĂ© pour ĂȘtre nettoyĂ© facilement, mieux vaut ne pas l'inclure. Moins de documents, mais de meilleure qualitĂ©, donne de meilleures performances.


🔁 Éviter les redondances entre documents

Si plusieurs documents abordent le mĂȘme sujet avec des mots diffĂ©rents, l'IA les fera remonter simultanĂ©ment. Ces doublons occupent la place de connaissances complĂ©mentaires potentiellement plus utiles, et les parties communes masquent les spĂ©cificitĂ©s de chaque document.

  • Bon exemple : deux documents sur le mĂȘme outil, l'un intitulĂ© "Guide technique de l'outil X pour les dĂ©veloppeurs", l'autre "Utiliser l'outil X au quotidien pour les Ă©quipes mĂ©tier". Chacun va directement Ă  ce qui est spĂ©cifique Ă  sa cible, sans introduction commune.

  • À Ă©viter : trois versions d'une documentation sur la mĂȘme fonctionnalitĂ© (marketing, support, dĂ©veloppeurs) qui commencent toutes par les mĂȘmes deux paragraphes de prĂ©sentation gĂ©nĂ©rale.

Que faire : supprimez les parties communes, ou isolez-les dans un document dédié auquel vous faites référence. Distinguez clairement les documents dans leur titre ("version technique" ou "version vulgarisée").


🔒 Adapter les droits d'accùs selon les utilisateurs

Tous les apprenants n'ont pas besoin de toutes les connaissances. Des documents trÚs techniques destinés à un petit groupe peuvent parasiter les réponses des autres utilisateurs dont les questions emploient des mots proches.

  • Bon exemple : la documentation technique sur l'architecture du produit est accessible uniquement aux Ă©quipes R&D. Les Ă©quipes commerciales ont accĂšs Ă  une base sĂ©parĂ©e avec les fiches produits et les argumentaires.

  • À Ă©viter : une base accessible Ă  tous qui mĂ©lange des transcripts de calls clients, des spĂ©cifications techniques internes et des guides d'onboarding.

Que faire : définissez des groupes d'utilisateurs et attribuez les documents en conséquence. Construisez la base progressivement : ajoutez un document quand un groupe exprime un besoin réel, pas par anticipation.


đŸ–Œïž Structurer le format pour faciliter la lecture par l'IA

📝 DĂ©crire les tableaux, images et schĂ©mas en texte

L'IA s'appuie sur le texte : un tableau, une image ou un schĂ©ma sans description Ă©crite est en grande partie invisible pour elle, mĂȘme si l'information y est clairement prĂ©sentĂ©e pour un humain.

Que faire : sous chaque tableau, image ou schĂ©ma, ajoutez une ou deux phrases qui en rĂ©sument le contenu et la conclusion Ă  retenir. Cette description doit pouvoir se suffire Ă  elle-mĂȘme, sans que le lecteur ait besoin de regarder le visuel.

📊 Garder chaque tableau complet sur une seule page

Un tableau coupĂ© entre deux pages, ou dont une partie dĂ©borde hors champ, peut ĂȘtre lu de façon incomplĂšte par l'IA : certaines lignes ou colonnes risquent d'ĂȘtre ignorĂ©es.

Que faire : si un tableau est trop long ou trop large pour tenir sur une seule page, réduisez son contenu aux colonnes essentielles, ou transformez-le en liste de puces. Un tableau court et complet vaut mieux qu'un tableau exhaustif mais tronqué.

🔗 Écrire les liens en toutes lettres

Un lien cachĂ© derriĂšre "cliquez ici" ou "en savoir plus", ou affichĂ© uniquement sous forme d'hyperlien cliquable, ne donne Ă  l'IA aucune information exploitable sur sa destination. Si un lien mĂ©rite d'ĂȘtre inclus, il doit prĂ©ciser vers quoi il renvoie et afficher son adresse complĂšte en texte, pas seulement en hyperlien.

Que faire : indiquez le titre de la page ou du document visé, puis écrivez l'adresse complÚte du lien.

🔠 HiĂ©rarchiser titres et sous-titres avec les styles natifs de votre Ă©diteur

L'IA s'appuie sur les titres structurés nativement dans l'éditeur de texte (styles Titre 1, Titre 2, etc.), pas seulement sur la présentation visuelle. Sans ce balisage, elle doit deviner la structure du contenu.

Que faire : utilisez les styles de titres natifs de votre éditeur, avec un titre principal (H1) unique, puis des sous-titres (H2, H3) qui reflÚtent le découpage réel du contenu. Chaque section doit pouvoir se comprendre à partir de son titre seul.


Mots-clés : structure documentaire, base de connaissances, IA Didask, qualité des documents, performance, redondances, droits d'accÚs

Avez-vous trouvé la réponse à votre question ?