cassionAnalyse de données

Parcours

Gestionnaire de l'information humanitaire

Pour le chargé de gestion de l'information qui détient les données partagées d'un cluster — analyse des évaluations, rapportage interagences, et les questions de responsabilité qui accompagnent la détention de données sur des personnes en crise.

Intermédiaire19 cours342 h

Compétences

Avant de commencer

L'itinéraire

  1. Étape 1

    Asseoir les chiffres

    Définir les indicateurs sur lesquels un cluster rapporte, et dire ce que la contribution d'un partenaire établit — et n'établit pas — avant qu'elle n'atteigne un tableau de bord.

  2. Étape 2

    Rendre les données fiables

    Transformer un export brut en un tableau défendable ligne à ligne, et transmettre un journal de nettoyage qui répond à la question de l'auditeur avant qu'elle soit posée.

  3. Étape 3

    Assembler les fichiers

    Réunir plusieurs exports en une table d'analyse défendable colonne par colonne, avec chaque jointure prouvée, chaque granularité énoncée et chaque dénominateur sourcé.

  4. Étape 4

    Contrôler comme un auditeur

    Évaluer vos propres données avant qu'un bailleur ne le fasse — cinq dimensions mesurées, un recomptage face à la source, et un rapport où chaque constat a un responsable et une date.

  5. Étape 5

    Définir ce que vous rapportez

    Rédiger des définitions d'indicateurs que deux analystes calculent de la même façon, défendre le dénominateur, et fixer une référence et une cible qui survivent à une revue à mi-parcours.

  6. Étape 6

    Mettre un intervalle dessus

    Analyser une enquête en grappes comme son plan l'exige — pondérations issues de la base, effet de plan mesuré, et un intervalle qui dit ce que l'échantillon peut trancher et ce qu'il ne peut pas.

  7. Étape 7

    Savoir d'où cela vient

    Lire un système de rapportage de routine comme la base de données qu'il est, tirer une extraction que l'on peut désigner des mois plus tard, et répondre à ce qui a été compté pour tout chiffre qu'il produit.

  8. Étape 8

    L'appliquer à la nutrition

    Porter les méthodes dans un secteur — normes de croissance de l'OMS, plausibilité SMART, phases IPC et seuils de performance Sphere, sur une enquête et un registre de traitement.

  9. Étape 9

    Appliquer à la santé publique

    Des taux à dénominateur en personnes-temps, des cascades de traitement, la couverture de trois façons, et une liste linéaire d'épidémie transformée en courbe, en taux d'attaque et en létalité défendable.

  10. Étape 10

    Appliquer à l'EAH

    Les échelles de service du JMP et les minimums Sphère sur une enquête ménage, puis un registre de suivi à visites répétées qui transforme un taux de fonctionnalité en trois et encadre chacun face aux tournées que personne n'a conduites.

  11. Étape 11

    Appliquer à la sécurité alimentaire

    SCA, ÉFM, ICSR et module d'adaptation construits depuis les composantes brutes et divergeant d'un facteur sept, puis une série de prix dont la saisonnalité éclipse l'effet de programme et le tableau de preuves qui rapporte les deux.

  12. Étape 12

    Appliquer à la protection

    Les analyses qu'il faut refuser de publier, à côté de celles qui comptent — un circuit de référencement conditionné par le consentement, un écart d'équité de dix-neuf points localisé à une porte précise, et une charge de dossiers qui explique deux autres tableaux.

  13. Étape 13

    Appliquer à l'éducation

    Taux brut contre taux net sur un dénominateur projeté, deux chiffres de présence distants de vingt-six points, une cohorte à travers passage et redoublement, et deux passations aux instruments différents.

  14. Étape 14

    Dire votre degré de certitude

    Un intervalle sur chaque proportion, le bon test pour une comparaison, une taille d'effet à côté de chaque valeur p, et le nombre de comparaisons qui ramène deux écoles frappantes au rang de bruit.

  15. Étape 15

    Modéliser plusieurs choses à la fois

    Un coefficient est une comparaison — laquelle, entre quelles unités, ajustée sur quoi. Un rapport de cotes que votre lecteur interprétera de travers, une covariable qui retire 42 % de l'effet, et un modèle qui explique trois pour cent et tranche une décision de ciblage.

  16. Étape 16

    Dire ce qui l'a causé

    Un gain de sept points qui est entièrement l'année scolaire, un groupe de comparaison déséquilibré sur chaque caractéristique mesurée, et l'effet minimal détectable qui a décidé de la réponse avant l'existence de la moindre donnée.

  17. Étape 17

    Le mettre sous leurs yeux

    La marque qu'implique la comparaison, un intervalle qui arrête un classement, une palette qui signifie déjà quelque chose pour ce public, et une figure produite depuis le jeu de données pour que le graphique et la phrase ne puissent pas dériver.

  18. Étape 18

    La rendre réexécutable

    Des données brutes en lecture seule et le code seul édité, un environnement figé pour que l'ordinateur d'un collègue donne vos nombres, des vérifications qui arrêtent la chaîne au lieu d'en produire une fausse et plausible, et une passation sur laquelle un successeur peut agir.

  19. Étape 19

    Le mettre devant la décision

    Une page qui répond à une question plutôt qu'à vingt, le panneau de définitions qui met fin à la dispute mensuelle, et le rapport dont constats, limites et recommandation survivent à une lecture séparée.

Projets recommandés

Modalités d'évaluation

Un gestionnaire de l’information se voit confier des données dont dépendent plusieurs organisations et qu’une seule a collectées. C’est à la fois un métier technique et un rôle de dépositaire, et c’est cette seconde moitié que ce parcours prend au sérieux.

Le projet protection mène ici par ce qui n’est pas collecté — pas de noms, pas de texte libre, pas de date d’incident, pas de localisation sous l’admin2 — et traite cette retenue comme le livrable plutôt que comme de la paperasse. Le seuil de suppression des petites cellules qu’il utilise est consigné comme une décision de protection prise avec l’agence de gestion de cas, non comme une préférence de mise en forme, précisément pour que la prochaine personne qui éditera l’analyse ne puisse pas le modifier discrètement.

Ce qu’il manque encore à ce parcours

Trois cours sont publiés : Fondamentaux de l’analyse de données, Python pour les données de programme et R et le tidyverse pour les données de programme. Le travail d’évaluation et de classification relève du module Analyses sectorielles de la feuille de route, et la conception d’enquête du module Indicateurs et mesure ; aucun des deux n’est encore écrit. Voir le programme.