machine learning https://ertim.inalco.fr/ fr Comparaison entre la méthode symbolique et la méthode par apprentissage dans l'efficacité de la détection thématique d'articles de presse https://ertim.inalco.fr/node/621 <span class="field field--name-title field--type-string field--label-hidden">Comparaison entre la méthode symbolique et la méthode par apprentissage dans l&#039;efficacité de la détection thématique d&#039;articles de presse</span> <span class="field field--name-uid field--type-entity-reference field--label-hidden"><span>Anonyme (non vérifié)</span></span> <span class="field field--name-created field--type-created field--label-hidden">ven 06/11/2020 - 00:00</span> <div class="field field--name-field-auteur field--type-string field--label-above"> <div class="field__label">Auteur</div> <div class="field__item">Nicolas Scarcella</div> </div> <div class="field field--name-field-annee field--type-integer field--label-above"> <div class="field__label">Année</div> <div class="field__item">2018</div> </div> <div class="field field--name-field-abstract field--type-string-long field--label-above"> <div class="field__label">Résumé</div> <div class="field__item">Ce mémoire porte sur l’étude de la détection thématique d’articles de presse pour une recherche sur la néologie. L’objet du travail réside dans la confrontation de la méthode symbolique, appuyée sur des listes et un vocabulaire contrôlé, avec la méthode d’apprentissage automatique, basée sur des algorithmes et calculs mathématiques. Ces deux procédures offrent l’analyse binaire visant à doter la machine d’une intelligence artificielle capable de détecter correctement les sujets abordés dans un texte dans le but de localiser les contextes qui aideront, dans un projet de détection de néologismes, à s’approcher de leur sens sémantique. Dans un premier temps, le travail consiste en une réflexion sur le moteur de détection déjà existant puis, dans un second temps, en l’exploration de nouvelles techniques permettant d’optimiser la détection thématique.</div> </div> <div class="field field--name-field-tags field--type-entity-reference field--label-above"> <div class="field__label">Mots-clés</div> <div class="field__items"> <div class="field__item"><a href="/taxonomy/term/2334" hreflang="fr">machine learning</a></div> <div class="field__item"><a href="/taxonomy/term/2497" hreflang="fr">clusterisation</a></div> <div class="field__item"><a href="/taxonomy/term/1804" hreflang="fr">classification</a></div> <div class="field__item"><a href="/taxonomy/term/2498" hreflang="fr">etiquetage</a></div> <div class="field__item"><a href="/taxonomy/term/2499" hreflang="fr">ngrams</a></div> <div class="field__item"><a href="/taxonomy/term/2500" hreflang="fr">matching</a></div> </div> </div> <div class="field field--name-field-document field--type-file field--label-above"> <div class="field__label">Fichier</div> <div class="field__item"> <span class="file file--mime-application-pdf file--application-pdf"> <a href="/sites/default/files/Scarcella_memoireTAL-IM_2018.pdf" type="application/pdf">Scarcella_memoireTAL-IM_2018.pdf</a></span> </div> </div> Thu, 05 Nov 2020 23:00:00 +0000 Anonyme 621 at https://ertim.inalco.fr L’intégration du thésaurus dans le traitement de la catégorisation automatique https://ertim.inalco.fr/node/574 <span class="field field--name-title field--type-string field--label-hidden">L’intégration du thésaurus dans le traitement de la catégorisation automatique</span> <span class="field field--name-uid field--type-entity-reference field--label-hidden"><span>Anonyme (non vérifié)</span></span> <span class="field field--name-created field--type-created field--label-hidden">ven 06/11/2020 - 00:00</span> <div class="field field--name-field-annee field--type-integer field--label-above"> <div class="field__label">Année</div> <div class="field__item">2014</div> </div> <div class="field field--name-field-abstract field--type-string-long field--label-above"> <div class="field__label">Résumé</div> <div class="field__item">Ce mémoire étudie le projet « catégorisation automatique » sur la plateforme LEOnard du département Etudes économiques de BNP Paribas. Ainsi il étudie le schéma du site LEOnard afin de comprendre les caractéristiques du corpus à catégoriser et afin de trouver la meilleure stratégie. Cependant, la richesse et la variété d’information rendent la catégorisation automatique plus complexe. Après avoir examiné l’approche de l’apprentissage automatique, nous nous rendons compte que cette approche n’est plus suffisante. Nous avons introduit le thésaurus dans la chaîne de traitement afin d’affiner l’extraction de termes dans le corpus. En calculant le score de termes dans le thésaurus, nous avons réussi à obtenir un résultat très satisfaisant.</div> </div> <div class="field field--name-field-tags field--type-entity-reference field--label-above"> <div class="field__label">Mots-clés</div> <div class="field__items"> <div class="field__item"><a href="/taxonomy/term/2334" hreflang="fr">machine learning</a></div> <div class="field__item"><a href="/taxonomy/term/2335" hreflang="fr">clustering</a></div> <div class="field__item"><a href="/taxonomy/term/2336" hreflang="fr">catégorisation automatique</a></div> <div class="field__item"><a href="/taxonomy/term/2337" hreflang="fr">thésaurus</a></div> </div> </div> <div class="field field--name-field-document field--type-file field--label-above"> <div class="field__label">Fichier</div> <div class="field__item"> <span class="file file--mime-application-pdf file--application-pdf"> <a href="/sites/default/files/Yingying%20MA-Memoire%20du%20Master%202.pdf" type="application/pdf">Yingying MA-Memoire du Master 2.pdf</a></span> </div> </div> Thu, 05 Nov 2020 23:00:00 +0000 Anonyme 574 at https://ertim.inalco.fr