Construire le premier dataset ouvert, massif et communautaire pour la langue Kirundi.
Ikirundi cacu, Ijwi ryacu ! (Notre langue, notre voix !)
Ijwi ry'Ikirundi AI est une initiative 100% communautaire dédiée à faire entrer la langue Kirundi dans l’univers de l’intelligence artificielle moderne.
Nous développons les données essentielles pour créer des modèles de :
- 🎙️ Speech-to-Text (Reconnaissance vocale)
- 🗣️ Text-to-Speech (Synthèse vocale)
- 🌐 Traduction automatique
🔗 Repo : Ijwi-ry-Ikirundi-AI/Kirundi_Dataset
Ce dépôt contient :
- Le fichier
metadata.csv - Les clips audio
- Les scripts de collecte
- Le dataset officiel (GitHub + Hugging Face)
C’est ici que vit la mémoire du projet.
🔗 Repo : sama-ndari/kirundi-contribution-app
C’est l’outil web que notre communauté utilise pour :
- Ajouter des phrases
- Traduire
- Vérifier les données
- Contribuer en quelques clics
La manière la plus simple : utiliser notre application en ligne.
Aucune compétence technique requise — juste votre temps et votre cœur ❤️.
👉 Commencer à contribuer :
https://sama-ndari.github.io/kirundi-contribution-app/
Vous pourrez :
- ✅ Niveau Facile : Kirundi ➝ Français
- ✍🏾 Niveau Moyen : Français ➝ Kirundi
- 💡 Niveau Difficile : Ajouter vos propres phrases (création de dataset)