Séminaire sur les technologies de collecte des données linguistiques au Laboratoire Techno2LAP de l’Université de Dschang

Dans le cadre du partenariat Université de Dschang et Sil Cameroun, un séminaire sur les technologies linguistiques et digitalisation des services de langues a été organisé du 27 au 30 avril 2026 au sein du Laboratoire Techno2LAP de l’université de Dschang. L’objectif principal était de maîtriser la collecte des données linguistiques et les logiciels essentiels de traitement audio et textuel pour l’accès au marché linguistique.

Les acteurs de la collecte des données linguistique

            La formation a intéressé trois acteurs principaux

    • Les étudiants : issus de différents départements, de diverses filières et de tous les niveaux. Ces derniers ont de par leur régularité et leur ponctualité, témoigné d’un grand intérêt pour les technologies linguistiques.

    • Les enseignants de langues et de cultures nationales : pris à part le 29 avril pour une formation plus approfondie et intense, les maîtres de la craie ont été initiés à utiliser les technologies linguistiques pour la bonne préparation des leçons.

    • Les enseignants d’Université : venus par curiosité, ces derniers sont restés jusqu’à la fin du séminaire. Ils étaient doublement motivés par les enjeux des technologies linguistiques pour les langues et cultures camerounaises et par leur appropriation.

Les technologies d’appui à la collecte des données linguistiques

            Pendant le séminaire, quatre logiciels utilisés pour la collecte des données linguistiques ont été mises à contribution par Louis Pascal Ngono:

    • Le logiciel Saymore exploité en vue de la transcription des histoires

    • Le logiciel Zotéro exploité pour l’élaboration de la bibliographie)

    • Le logiciel Bloom employé pour la création des petits livres dans les langues camerounaises

Le rôle de l’intelligence artificielle dans la collecte des données linguistiques

Monsieur Jonathan Abouem, expert à la SIL, a enseigné les participants sur l’utilisation efficace de l’Intelligence artificielle. L’enseignant a mis un accent particulier sur la formulation des Pompts ou question à poser à l’IA. Celles-ci doivent être formulées en respectant cinq éléments fondamentaux :

    • Le rôle du modèle : le chercheur doit définir un rôle pour l’IA, exemple : enseignant

    • La tâche : il faut spécifier ce qu’on attend d’elle, exemple : proposer un exercice

    • Le contexte : cette étape consiste à délimiter le champ de recherche de l’IA

    • Le format souhaité : ceci revient à définir le format sous lequel on voudrait que l’information recherchée par l’IA nous soit donnée, exemple : schéma textuel

    • La notion d’andragogie : l’internaute doit trouver des moyens d’autonomie face à l’IA

La faible numérisation des données linguistiques

Au sortir de cette formation, les participants ont été sensibilisés sur le fossé entre les données liées aux langues et cultures africaines et celles liées aux langues et cultures étrangères dans les ChartBoost. Ceci étant une interpellation forte pour tous les séminaristes. Ces derniers ont été invités à se servir des technologies linguistiques pour documenter sa propre langue.

Laisser un commentaire

Retour en haut