reconnaissance automatique de la parole https://ertim.inalco.fr/ en De la parole aux transcriptions : optimiser la transcription de l’arménien occidental avec des ressources limitées https://ertim.inalco.fr/en/node/759 <span class="field field--name-title field--type-string field--label-hidden">De la parole aux transcriptions : optimiser la transcription de l’arménien occidental avec des ressources limitées</span> <span class="field field--name-uid field--type-entity-reference field--label-hidden"><span>iwang</span></span> <span class="field field--name-created field--type-created field--label-hidden">Thu, 07/10/2025 - 11:06</span> <div class="field field--name-field-auteur field--type-string field--label-above"> <div class="field__label">Auteur</div> <div class="field__item">Agathe Wallet</div> </div> <div class="field field--name-field-annee field--type-integer field--label-above"> <div class="field__label">Année</div> <div class="field__item">2024</div> </div> <div class="field field--name-field-abstract field--type-string-long field--label-above"> <div class="field__label">Résumé</div> <div class="field__item">La transcription automatique de langues peu dotées en ressources est un défi, autant pour l’exploitation des données disponibles que pour le choix des algorithmes et l’évaluation des résultats. Dans ce mémoire, nous présentons nos travaux pour développer un modèle de transcription de l’arménien occidental vers une écriture phonologique (API). Ils ont été réalisés dans le cadre du projet de recherche DALiH (Digitizing Armenian Linguistic Heritage) qui apporte un volume de données<br /> transcrites limitées pour l’arménien occidental. Plusieurs stratégies d’optimisation de l’apprentissage ont été explorées, qui comparent plusieurs modes de sélection des données d’entraînement. Ces recherches ont montré qu’un choix judicieux de modèle et de données améliore significativement l’apprentissage automatique, tout en montrant la sensibilité des résultats aux choix des jeux de données et des paramètres des modèles de transcription automatique.</div> </div> <div class="field field--name-field-tags field--type-entity-reference field--label-above"> <div class="field__label">Mots-clés</div> <div class="field__items"> <div class="field__item"><a href="/en/taxonomy/term/2702" hreflang="en">alphabet phonétique international</a></div> <div class="field__item"><a href="/en/taxonomy/term/2703" hreflang="en">arménien occidental standard</a></div> <div class="field__item"><a href="/taxonomy/term/887" hreflang="fr">langues peu dotées</a></div> <div class="field__item"><a href="/en/taxonomy/term/2704" hreflang="en">optimisation d&#039;apprentissage de modèles</a></div> <div class="field__item"><a href="/taxonomy/term/2267" hreflang="fr">reconnaissance automatique de la parole</a></div> </div> </div> <div class="field field--name-field-document field--type-file field--label-above"> <div class="field__label">Fichier</div> <div class="field__item"> <span class="file file--mime-application-pdf file--application-pdf"> <a href="/sites/default/files/WALLET_AGATHE_2024_Transcription_armenien.pdf" type="application/pdf">WALLET_AGATHE_2024_Transcription_armenien.pdf</a></span> </div> </div> Thu, 10 Jul 2025 09:06:38 +0000 iwang 759 at https://ertim.inalco.fr