- Ce sujet contient 10 réponses, 2 participants et a été mis à jour pour la dernière fois par David Ascher, le il y a 2 années et 9 mois.
-
AuteurMessages
-
-
décembre 20, 2023 à 4:51 pm #801084SpiilMaître des clés
J’aimerais utiliser l’IA pour faire des recherches dans nos archives, créer des résumés sur cette base, avoir le contexte et l’historique qui apparaissent automatiquement quand nous faisons un article sur le sujet etc.
Tout avec, j’imagine, un outil sur mesure dont les résultats seront incontestables puisque basés sur nos propres contenus.
Certains d’entre vous sont ils déjà avancés sur le sujet et pouvez vous partager vos réflexions, voire vos réalisations avec recommandation de prestataire ?
-
décembre 20, 2023 à 4:56 pm #853319David AscherParticipant
Publié par David Ascher
Bonjour Joël,
J'ai exactement la même réflexion, mais ai quelques doutes sur le fait que nos données puissent à elles seules constituer un dataset suffisant pour faire tourner une IA.
Si quelqu'un à une info qui dément se postulat, je suis bien sûr preneur d'infos au même titre que Joël 🙂
David
-
décembre 20, 2023 à 5:24 pm #853317SpiilMaître des clés
Publié par Joël Wirsztel
J’imagine que « notre » IA sera capable de donner tout type de réponse et aura les capacités générales de résumé, rédaction etc de toute IA, mais qu’on pourra la restreindre à ne réfléchir sur nos sujets qu’à partir de nos données…
-
décembre 20, 2023 à 5:34 pm #853318SpiilMaître des clés
Publié par Yann Dubois
Les données internes peuvent fournir un "contexte" à la question posée à l'IA, qui permet de cadrer un minimum ses réponses, mais attention, comme on part d'un modèle de langage déjà constitué, cela ne l'empêche pas "d'halluciner", et donc de fournir des réponses fausses, ou d'inventer des références, y compris quand on lui demande de puiser dans le contexte qu'on lui donne. C'est ce que j'ai compris jusqu'ici de mes propres recherches sur le sujet. A noter que ce ne serait pas très difficile à tester "en vrai" avec la fonctionnalité "My GPTs" de GPT-4 d'OpenAI qui est à nouveau ouverte au public ($20/mois), et annoncée comme très facile à utiliser (sans faire appel à un prestataire) pour faire un chatbot "personnalisé" donc justement doté d'un "contexte" sur-mesure. Nous n'avons pas encore eu le temps de le tester mais comptons bien le faire prochainement: à savoir donner comme "contexte" à un "GPTs" le corpus des articles existants sur un site web en lui demandant de se référer à ce contexte pour donner sa réponse.
Mais encore une fois, le mode de fonctionnement des LLMs actuel fait que même si on lui demande de se référer à un contexte, il peut "improviser" des réponses fausses ou tirées de sources extérieures au contexte (puisque par ailleurs il a été préalablement entraîné sur des millions d'autres documents pour constituer son modèle de langage, qu'il est connecté au web, etc), ou encore "inventer" de toute pièce avec un grand aplomb une référence qui n'existe pas dans le contexte donné. D'après ce que j'ai compris il n'y a pas pour le moment de moyen 100% fiable de forcer un LLM type ChatGPT à se contraindre à n'utiliser que des informations tirées d'une source pour construire ses réponses. Il semble que GPT4 soit quand même de plus en plus convaincant pour faire quelque chose d'approchant. A confirmer !
-
décembre 20, 2023 à 5:42 pm #853316David AscherParticipant
Publié par David Ascher
Merci Yann 🙂
-
décembre 20, 2023 à 5:44 pm #853315SpiilMaître des clés
Publié par Yann Dubois
PS: pour résumer un ou plusieurs textes en revanche, ça nous l'avons déjà testé et GPT4 est très bon dans cet exercice. Mais ça n'empêche que même dans un résumé il peut théoriquement commettre des erreurs (un humain aussi…), donc tout va dépendre de l'usage.
NB: Le mot "incontestable" dans la demande de @Joël Wirsztel reste techniquement inatteignable pour l'heure, car le fonctionnement d'une IA de type LLM n'est basé que sur un procédé statistique qui ne permet en aucune façon "l'incontestable"… ça reste la principale limitation de ces IA. Elles ne "comprennent" rien, elles n'ont aucune logique propre, et sont donc incapables de fournir de "l'incontestable" au sens rigoureux, logique, ou juridique, du terme. Elles fournissent juste au plus du "très vraisemblable". Il faut faire avec ça, ou s'en passer.
-
décembre 20, 2023 à 5:51 pm #853313SpiilMaître des clés
Publié par Yann Dubois
On ne peut pas restreindre un LLM à n'utiliser qu'une source, car le modèle lui-même est construit sur des millions d'autres sources, et désormais enrichi en temps réel par son accès au web. Et il ne "réfléchit" absolument pas, il ne fait que fournir une suite de mots statistiquement vraisemblables. Il peut donc "halluciner", c'est à dire inventer de toutes pièces une référence qui semble vraisemblable, même si elle n'existe pas dans le corpus fourni en contexte. Il faut bien comprendre ce fonctionnement pour ne pas essayer de lui faire faire ce qu'il ne pourra pas faire.
C'est assez facile à tester: demander à ChatGPT de résumer un film qui n'est pas encore sorti en citant ses sources par exemple (je ne l'ai pas testé avec GPT4, mais avec GPT3 c'était assez cocasse… il inventait de toutes pièces des sources et références avec un aplomb formidable) Il pourrait donc faire pareil avec le contexte que vous lui fournissez: il pourra "halluciner" des choses qui n'y figurent pas. Même si c'est rare, ça arrive.
-
décembre 20, 2023 à 5:55 pm #853312SpiilMaître des clés
Publié par Joël Wirsztel
Merci Yann
J'ai déjà souscrit depuis quelques mois à la version à 20 $ et j'apprécie l'aide que cela peut m'apporter ponctuellement, y compris dans ma vie personnelle comme inventer des histoires sur mesure à destination de mes petits enfants. Mais je ne vois pas comment le nourrir avec nos archives, et le contraindre à les utiliser prioritairement, et c'est cela que j'imagine, peut être à tort, d'un prestataire
-
décembre 20, 2023 à 6:05 pm #853314SpiilMaître des clés
Publié par Yann Dubois
Essaye les "My GPTs", c'est fait pour ça (j'ai pas testé mais de ce que j'ai compris…) : créer un chatbot "sur mesure". C'est peut-être le meilleur compromis actuellement pour un coût dérisoire.
Sinon un prestataire pourrait en théorie te créer ton propre modèle de langage exercé sur ton propre corpus, mais comme l'a indiqué à juste titre @David Ascher , malheureusement, il faudrait des millions de document pour créer un modèle de langage de toutes pièces. Donc il me semble (mais je ne suis pas un spécialiste), qu'il faudra de toute façon "injecter" beaucoup plus de données qu'uniquement tes propres archives, pour obtenir quelque chose d'utilisable. En quelque sorte, avant d'apprendre "par cœur" tes archives, le robot doit d'abord apprendre à lire et à parler… et c'est pour ça qu'on est plus ou moins contraint de partir d'un modèle déjà existant, qui embarque donc déjà toute une "vision du monde" qui nous échappe.
Bon je suis à ma limite de compétence, n'étant pas moi-même spécialiste, mais c'est ce que j'en comprends jusqu'ici (et à la lumière de quelques essais dont j'ai eu connaissance). Si quelqu'un a d'autres expériences ou références, qu'il s'exprime, car ça m'intéresse aussi 🙂
-
décembre 20, 2023 à 6:31 pm #853311SpiilMaître des clés
Publié par Joël Wirsztel
Chat GPT m'explique effectivement ce que c'est mais dit que cela ne permet pas d'injecter ses propres données
Les "My GPTs" sont une fonctionnalité qui permet aux utilisateurs de personnaliser leur expérience avec les modèles GPT d'OpenAI. Cela signifie que vous pouvez créer des versions personnalisées du modèle GPT pour répondre à des besoins spécifiques ou à des préférences personnelles. Par exemple, si vous avez une passion particulière pour un sujet ou un domaine spécifique, vous pouvez configurer un My GPT pour qu'il se spécialise dans ce domaine, offrant des réponses plus ciblées et pertinentes à vos questions.
Les utilisateurs peuvent ajuster divers paramètres pour affiner les réponses de leur My GPT, comme le ton, le style, la profondeur des connaissances dans certains domaines, ou même des préférences linguistiques. Cela rend l'interaction avec le modèle GPT plus personnalisée et adaptée aux besoins uniques de chaque utilisateur.
You
Je peux lui injecter mes propres données ?
ChatGPT
ChatGPT
Non, vous ne pouvez pas injecter directement vos propres données dans un modèle My GPT. Ces modèles, bien qu'ils soient personnalisables en termes de style de réponse, de ton et de domaines d'intérêt spécifiques, sont toujours basés sur les données avec lesquelles ils ont été entraînés initialement par OpenAI. Ils ne peuvent pas être personnalisés avec des ensembles de données externes ou privés.
Cependant, vous pouvez guider le modèle en lui fournissant des informations contextuelles spécifiques lors de vos interactions. Par exemple, en posant des questions détaillées ou en fournissant des précisions dans vos requêtes, vous pouvez orienter les réponses du modèle pour qu'elles soient plus alignées avec les connaissances ou les informations que vous souhaitez explorer.
-
décembre 20, 2023 à 6:38 pm #853310SpiilMaître des clés
Publié par Yann Dubois
"vous pouvez guider le modèle en lui fournissant des informations contextuelles spécifiques lors de vos interactions." : c'est bien de cela qu'il s'agit, lui fournir un "contexte" comme je l'ai indiqué plus haut. Sachant qu'avec GPT4 le "contexte" peut désormais (en théorie) contenir des centaines de pages (128000 "tokens" c'est à dire théoriquement à peu près autant de mots). C'est cette voie qui devrait permettre de faire quelque chose… Je n'ai pas testé mais impatient de voir ce que ça donne / si ça donne quelque chose 🙂
-
-
AuteurMessages
- Vous devez être connecté pour répondre à ce sujet.