Acte I · Le contexte
Quatre cultures qui nourrissent l’Afrique de l’Ouest : le maïs, le riz, le sorgho et le mil. Et une question de régression : peut-on prédire leurs rendements à partir de données multi-sources, climatiques, socio-économiques et agronomiques ? Le tout en R.
Acte II · Le problème
Section en préparation
Acte III · La démarche
Le dépôt suit un pipeline en sept étapes, chacune un script R :
- Intégration des sources de données.
- Nettoyage.
- Exploration des données brutes.
- Exploration des données nettoyées.
- Modélisation sur données brutes.
- Modélisation sur données nettoyées.
- Comparaison des deux approches.
ce découpage brut / nettoyé est le geste intéressant du projet : mesurer ce que le nettoyage change réellement, au lieu de le supposer
Section en préparation
Acte IV · Les résultats
Section en préparation
Acte V · Ce que j’ai appris
Section en préparation
