|
KivuLingua AI est une initiative scientifique ouverte créant des corpus multilingues vocaux et textuels de haute qualité pour les langues bantoues de l’Est de la RDC. Nous développons des modèles avancés de reconnaissance vocale (ASR) et synthèse vocale (TTS) tout en renforçant la souveraineté linguistique, l’inclusion numérique et la préservation du patrimoine culturel par la collaboration communautaire.
20M+
Locuteurs natifs des langues bantoues ciblées en RDC orientale impliqués dans la collecte participative, validation et préservation linguistique.
9
Langues bantoues du Nord-Kivu, Sud-Kivu et Maniema prioritaires pour ASR, TTS et infrastructure IA multilingue.
500h+
Corpus audio multilingue planifié avec parole contrôlée, conversations spontanées, traditions orales et dialogues communautaires.
Science Ouverte
Jeux de données, modèles et références entièrement ouverts suivant les standards Mozilla Common Voice et l’éthique de la recherche.
Aperçu du Projet
Explorez Notre Travail
KivuLingua AI construit une infrastructure ouverte pour les langues bantoues de l'Est du Congo. Cliquez ci-dessous pour en savoir plus sur chaque domaine.
Impact Éducatif
Programmes d'alphabétisation Teaching at the Right Level (TaRL) en langue maternelle Mashi pour 500+ étudiants à travers les écoles rurales de Bushi.
Santé Communautaire
Application mobile basée sur la voix pour 30+ agents de santé livrant des messages de prévention et enregistrant les données des patients hors ligne en Mashi.
Modèles IA
Modèles ASR et TTS optimisés pour les appareils mobiles pour le Mashi (CPU uniquement, déploiement hors ligne sur Android et appareils bas de gamme).
Équipe Communautaire
Équipe interdisciplinaire d'ingénieurs IA, de linguistes et de leaders communautaires. Consortium avec African STEM Resources Hub & Kwetu Best.
8 Langues Bantoues
Approche évolutive: Pilot avec Mashi, document kinande/kihunde/kifuliru en Phase 1, expansion à 8 langues en Phase 2.
Chronologie de 12 Mois
Implémentation structurée de juillet 2026 à juin 2027: Fondation → Collecte → Traitement → Déploiement & Publication.
Éthique D'Abord
Souveraineté communautaire avant ouverture. Consentement informé, équilibre des genres, protocoles sensibles aux conflits, gouvernance des données.
Science Ouverte
Toutes les ressources (corpus, modèles, outils) publiées sous Apache 2.0 sur Hugging Face, GitHub et Zenodo en tant que biens publics numériques africains.
Prêt à S'impliquer?
Nous accueillons les linguistes, ingénieurs ML, éducateurs, agents de santé et défenseurs communautaires. Que vous souhaitiez contribuer des données, collaborer à la recherche ou soutenir notre mission, rejoignez-nous.
Partenaires du Projet
Travailler ensemble pour construire une infrastructure durable pour les technologies linguistiques africaines

