Tous les articles
Actualités Produit3 min de lecture

Comment nous avons dotĂ© notre moteur de recherche de super pouvoirs avec ChatGPT đŸ’Ș

Par Gregory Culpin

Découvrez l'utilisation révolutionnaire de GPT par Elium pour décupler les capacités de notre moteur de recherche interne. Lisez notre blog!

À la fin de l’annĂ©e 2022, ChatGPT, le modĂšle de langage d’OpenAI, a surpris tout le monde par ses capacitĂ©s Ă©tonnantes. Sa gĂ©nĂ©ration de texte semblable Ă  celle d’un ĂȘtre humain et sa comprĂ©hension approfondie de sujets divers ont laissĂ© tout le monde stupĂ©fait, dĂ©montrant son potentiel pour rĂ©volutionner diverses industries et remodeler l’interaction entre l’homme et la technologie.

En tant qu’entreprise centrĂ©e sur la connaissance, il est devenu Ă©vident qu’une Ă©valuation approfondie Ă©tait nĂ©cessaire pour imaginer comment il pouvait amĂ©liorer la façon dont nous gĂ©rons le contenu. Nous avons dĂ©cidĂ© d’explorer des moyens d’utiliser sa puissance pour multiplier les capacitĂ©s de nos utilisateurs et leur offrir une expĂ©rience amĂ©liorĂ©e.

Hackathon

Pour mieux saisir l’intĂ©gration potentielle de ce nouvel outil, nous avons adoptĂ© une approche proactive en organisant un hackathon de deux jours impliquant toute l’entreprise. L’objectif Ă©tait clair : dĂ©velopper des preuves de concept (POC) liĂ©s Ă  notre produit, en intĂ©grant l’intelligence artificielle.

Au cours du hackathon, nous avons gĂ©nĂ©rĂ© plus de 30 idĂ©es de POC, examinant soigneusement leur faisabilitĂ© et leurs avantages potentiels pour nos utilisateurs finaux. Nous avons concentrĂ© nos efforts sur deux idĂ©es qui se sont dĂ©marquĂ©es comme Ă  la fois rĂ©alisables et impactantes. Le premier concept impliquait la crĂ©ation automatique d’un podcast qui condensait et prĂ©sentait les contenus clĂ©s, tandis que le deuxiĂšme concept Ă©tait centrĂ© sur une fonction de questions-rĂ©ponses.

hackathon | Elium

La création de Answer

Munis des POCs et des idĂ©es, l’équipe produit a sollicitĂ© les retours des utilisateurs pour Ă©valuer l’intĂ©rĂȘt et l’impact potentiel. Il est devenu Ă©vident que la fonction de questions-rĂ©ponses avait le potentiel de rĂ©volutionner vraiment notre produit. Les commentaires reçus des utilisateurs ont rĂ©sonnĂ© fortement, indiquant que la fonction de questions-rĂ©ponses pouvait grandement amĂ©liorer leur expĂ©rience avec le produit.

Cette prise de conscience a poussĂ© l’équipe Ă  donner la prioritĂ© au dĂ©veloppement et Ă  la perfectionnement de la fonction de questions-rĂ©ponses, reconnaissant qu’elle changerait la maniĂšre dont les gens travaillent avec la base de connaissances, non seulement en obtenant des rĂ©ponses plus rapides et de meilleure qualitĂ© en utilisant un langage naturel, mais aussi en changeant l’interaction entre le producteur et le consommateur du contenu, ce qui conduirait Ă  une base de connaissances meilleure, plus correcte et plus prĂ©cise.

Comment fonctionne Answer sous le capot

Cela reprĂ©sente l’ensemble du cycle de vie de Answer. Explorons-le en deux parties : le temps d’indexation et le temps de requĂȘte.

Temps d’indexation

Lorsqu’un contenu est sauvegardĂ©e dans l’application Elium, nous l’indexons sĂ©mantiquement pour capturer sa signification, plutĂŽt que simplement les mots.

Pour ce faire, nous divisons le contenu en petits extraits d’environ 300 mots, tout en essayant de maintenir les limites des phrases. Pour chaque extrait, nous demandons à un modùle de langage de grande envergure (LLM) d’extraire l’embedding du passage.

Un embedding est un vecteur qui reprĂ©sente le sens de l’extrait.

Elle peut ĂȘtre visualisĂ©e comme la disposition des mots sur un graphique, comme s’il y avait un axe pour le formel contre informel, positif contre nĂ©gatif, et plus encore, en utilisant le contexte pour capturer le sens.

Nous stockons l’embedding, le texte du passage et des mĂ©tadonnĂ©es telles que l’ID du contenu, le titre, l’ID de l’espace, 
 dans l’index.

Temps de requĂȘte

Pendant le temps de requĂȘte, nous utilisons le mĂȘme LLM pour calculer l’embedding de la requĂȘte. À partir de lĂ , nous pouvons dĂ©terminer le document le plus proche de la requĂȘte grĂące Ă  des calculs mathĂ©matiques simples, en particulier la similaritĂ© cosinus entre l’embedding de la requĂȘte et l’embedding du document.

Nous pouvons trouver quelques documents les plus similaires Ă  la requĂȘte Ă  partir d’une ou de plusieurs contenus.

À ce stade, nous avons la possibilitĂ© de renvoyer ces documents, ce qui serait rentable, mais nous pouvons amĂ©liorer cela en fournissant Ă  ChatGPT les documents que nous avons trouvĂ©s et en lui demandant de rĂ©pondre Ă  la question de l’utilisateur.

Voici un exemple simplifié de la prompte que nous utilisons.

Prompt used with ChatGPT | Elium

Enfin, nous renvoyons la réponse de ChatGPT et la liste des contenus à partir desquelles les documents sont issus.

Chat GPT and Elium

À lire aussi

Retour au blog

PrĂȘt Ă  libĂ©rer les connaissances de votre Ă©quipe ?

Voyons ce que ça donne sur vos connaissances.

Découvrez comment Elium aide votre organisation à centraliser les connaissances, donner de l'autonomie à vos équipes et prendre de meilleures décisions.