# Justification des seuils — Classification de la sécurité alimentaire et ciblage de l'assistance

Documentation technique du projet *Classification de la sécurité alimentaire et
ciblage de l'assistance*. Son sujet est la seule décision dont tout le projet
dépend : **où la ligne est tracée, et pourquoi là plutôt qu'ailleurs.**

Qui mange change avec cette ligne. Ce document existe pour que la réponse à
« pourquoi ce seuil » soit un argument écrit plutôt qu'un souvenir.

- **Jeu de données source :** `food-security-survey-2024.v1.csv` (2 112 ménages,
  4 districts)
- **Analyse :** `notebooks/composite-indicators.python.fr.ipynb`
- **Décision éclairée :** quels ménages entrent dans la charge de cas de la
  prochaine distribution monétaire
- **Normes appliquées :** IPC, Sphère, CHS, GAR
- **Charge de cas :** 422 ménages — **20 % des ménages enquêtés, fixé par le
  budget**

Tous les jeux de données de cette plateforme sont synthétiques. Aucun ménage réel
n'y est décrit.

---

## 1. Les indicateurs, tels que calculés

### 1.1 Score de consommation alimentaire (SCA / FCS)

Somme pondérée des jours (0 à 7) où chaque groupe alimentaire a été consommé au
cours des sept derniers jours :

| Groupe | Poids |
| --- | ---: |
| Céréales et tubercules | 2 |
| Légumineuses | 3 |
| Légumes | 1 |
| Fruits | 1 |
| Viande, poisson et œufs | 4 |
| Produits laitiers | 4 |
| Huiles et matières grasses | 0,5 |
| Sucre | 0,5 |

**Plus le score est élevé, meilleure est la situation.** Plage 0 à 112.

Une valeur supérieure à 7 jours est impossible et est mise à manquant **avant**
la somme, non ramenée à 7. Le plafonnement conserverait un ménage dont le
formulaire est connu pour être erroné ; la mise à manquant se propage, et le
ménage est exclu des règles fondées sur le SCA. **145 ménages** ont un SCA
incomplet à ce titre.

### 1.2 Échelle de la faim des ménages (EFM / HHS)

Somme de trois items codés en sévérité (pas de nourriture dans la maison, se
coucher en ayant faim, un jour et une nuit sans manger), 0 à 6.

**Une EFM partielle est exclue, jamais remplie par zéro.** Remplir par zéro
classe un ménage affamé comme sécurisé sur le plan alimentaire et le fait sortir
de la charge de cas — c'est le mode de défaillance que cette règle existe pour
prévenir. **37 ménages** sont exclus à ce titre.

### 1.3 Indice réduit des stratégies de survie (rCSI)

| Stratégie | Poids |
| --- | ---: |
| Recourir à des aliments moins préférés | 1 |
| Emprunter de la nourriture | 2 |
| Réduire la taille des portions | 1 |
| Restreindre la consommation des adultes | 3 |
| Réduire le nombre de repas | 1 |

**Plus l'indice est élevé, pire est la situation.**

---

## 2. Pourquoi aucun seuil unique ne donne la charge de cas

L'approche évidente est un indicateur et un seuil. Appliquée à cette enquête :

| Règle | Ménages | Part | vs charge de 422 |
| --- | ---: | ---: | ---: |
| SCA pauvre (≤ 21) | 17 | 0,8 % | −405 |
| SCA pauvre ou limite (≤ 35) | 465 | 22,0 % | +43 |
| EFM modérée ou pire (≥ 2) | 889 | 42,1 % | +467 |
| EFM sévère (≥ 4) | 325 | 15,4 % | −97 |
| rCSI au-dessus ou égal à la médiane | 1 074 | 50,9 % | +652 |

`SCA ≤ 21` sélectionne 17 ménages et ne peut pas dépenser le budget. `EFM ≥ 2`
sélectionne plus du double de la charge de cas. `rCSI ≥ médiane` sélectionne la
moitié de l'enquête par construction et n'est pas un seuil.

`SCA ≤ 35` tombe à 43 ménages de la charge de cas. **Le choisir parce qu'il tombe
proche revient à ajuster le critère au budget plutôt qu'au besoin** — et c'est
exactement ce qu'une revue de cluster interrogera. Il est écarté pour cette
raison, et ce paragraphe est la trace qu'il a été envisagé.

Le problème de fond : les trois indicateurs divergent à dessein. Le SCA mesure la
diversité alimentaire, l'EFM mesure si les gens se sont privés, le rCSI mesure ce
qu'ils ont fait pour tenir. Un ménage peut être médiocre sur l'un et correct sur
un autre. Tout seuil à indicateur unique jette deux mesures sur trois.

---

## 3. Le composite

### 3.1 Définition

```
score_besoin = ( -z(SCA) + z(rCSI) + z(EFM) ) / 3
```

`z(·)` standardise à moyenne 0 et écart-type 1 sur les 2 112 ménages enquêtés. Le
SCA entre **négativement** parce qu'un SCA plus élevé traduit une meilleure
consommation alimentaire.

Distribution observée : moyenne 0,000, écart-type 0,813, plage −2,336 à 2,664.

### 3.2 Les trois hypothèses, énoncées

**Poids égaux.** La formule affirme que les trois indicateurs comptent également.
C'est une hypothèse, non un constat, et aucune donnée de cette enquête ne la
soutient ni ne la réfute. Elle est retenue parce que toute autre pondération
exigerait une justification que ce jeu de données ne peut fournir, et qu'une
pondération arbitraire d'apparence précise vaut moins qu'une pondération
explicite et simple.

**La standardisation est relative à l'échantillon.** Un score Z est relatif à
*ces* 2 112 ménages. Le score est donc un dispositif de classement interne à cette
enquête et **n'a aucun sens d'une enquête à l'autre**. Ne pas comparer un score de
besoin de 0,7 ici à un 0,7 calculé ailleurs.

**Les remplissages de données manquantes sont conservateurs en sens opposés.** Un
SCA incomplet est rempli par la médiane de l'échantillon ; une EFM partielle est
remplie par zéro. La médiane du SCA est neutre ; une EFM à zéro est la valeur *la
moins sévère*. Un ménage aux données incomplètes n'est donc ni poussé dans la
charge de cas ni exclu par la lacune elle-même — les remplissages ne peuvent pas
se combiner pour fabriquer un score élevé.

Noter l'asymétrie avec le §1.2 : une EFM partielle est exclue des **règles
fondées sur l'EFM** du §2, et remplie par zéro uniquement à l'intérieur du
composite, où l'exclure ferait sortir le ménage du classement entier. Être exclu
d'une règle et être exclu de l'assistance sont deux choses différentes.

### 3.3 Ce que le composite sélectionne

| | Ménages |
| --- | ---: |
| Charge de cas | 422 |
| dont SCA pauvre (≤ 21) | 16 |
| dont SCA pauvre ou limite (≤ 35) | 242 |
| dont EFM sévère (≥ 4) | 284 |

16 des 17 ménages à SCA pauvre sont sélectionnés. Le composite n'écarte pas le
signal à indicateur unique ; il l'empêche d'être le seul.

---

## 4. Le seuil n'est pas un constat

La charge de cas est de 422 parce que le budget en couvre 422. Le score au seuil
est de **0,663**. Les quarante ménages de part et d'autre s'étalent de **0,630 à
0,697** — moins d'un dixième de point — et les paires adjacentes diffèrent de
quelques millièmes.

**Rien dans les données ne distingue le dernier ménage inclus du premier exclu.**
Le rapport doit le dire. Deux conséquences :

1. Ne pas décrire la charge de cas comme « les ménages en insécurité
   alimentaire ». Ce sont les 422 ménages les mieux classés selon une règle
   énoncée.
2. Si le programme peut étendre à la marge, la liste de frontière du notebook est
   celle avec laquelle l'étendre — dans l'ordre du score, sans relancer l'analyse.

---

## 5. Qui la règle inclut, et qui elle laisse de côté

La partie qu'un groupe de travail monétaire interrogera réellement. Composition
de la charge de cas comparée à la population enquêtée :

**Statut de déplacement**

| Statut | Population | Charge de cas | Différence |
| --- | ---: | ---: | ---: |
| Déplacé interne | 19,2 % | 33,4 % | +14,2 pts |
| Retourné | 7,2 % | 12,3 % | +5,1 pts |
| Hôte | 3,7 % | 3,1 % | −0,6 pt |
| Résident | 69,9 % | 51,2 % | −18,7 pts |

**Moyen de subsistance** — travail journalier +8,6 pts, agriculture de subsistance
−7,2 pts ; tous les autres à ±2 pts près.

**Sexe du chef de ménage** — ménages dirigés par une femme : 35,6 % de la
population, 38,9 % de la charge de cas (+3,3 pts).

**District**

| District | Enquêtés | Sélectionnés | Part sélectionnée |
| --- | ---: | ---: | ---: |
| Nord-Ouest | 528 | 219 | 41,5 % |
| Centre | 530 | 131 | 24,7 % |
| Artibonite | 528 | 61 | 11,6 % |
| Sud | 526 | 11 | 2,1 % |

**Ce sont des sorties des indicateurs, non des choix de ciblage.** Aucun terme de
déplacement, de moyen de subsistance, de sexe ou de district n'entre dans le
score. Mais ce sont les phrases qui doivent figurer au rapport, car une autorité
de district lira la charge de cas comme une affirmation sur qui mérite
l'assistance — et un rapport de vingt contre un entre le Nord-Ouest et le Sud sera
contesté que le rapport l'explique ou non.

---

## 6. Qualité des données signalée, non corrigée

**12 énumérations dupliquées** (identiques sur tous les champs sauf
`household_id`). Elles sont signalées et laissées en place : un doublon exact peut
être une revisite authentique saisie deux fois ou deux ménages semblables, et ce
jeu de données ne permet pas de trancher. À 12 sur 2 112, elles ne peuvent pas
déplacer le seuil. Si le décompte augmente, les résoudre avant le ciblage, non
après.

---

## 7. Limites

1. **La base de sondage n'est pas la population.** La charge de cas est tirée des
   ménages que l'énumération a atteints. Les personnes déplacées hors sites et les
   ménages absents le jour de l'enquête ne figurent pas dans ce classement et ne
   peuvent pas en être ciblés.
2. **La taille de la charge de cas est une décision budgétaire.** Cette analyse
   classe le besoin ; elle ne dit pas qu'un cinquième des ménages est le bon
   nombre à assister. Le rapport ne doit pas laisser confondre les deux.
3. **Les trois indicateurs sont déclaratifs**, sur un rappel de sept jours, et
   tous trois sont sujets au biais de rappel dans le même sens là où un ménage
   croit que sa déclaration conditionne son éligibilité.
4. **Aucune saisonnalité.** Un passage unique ne sépare pas un ménage en soudure
   d'un ménage en insécurité alimentaire chronique, et une aide monétaire ciblée
   sur le premier ne doit pas être présentée comme traitant le second.
5. **Le score n'est pas une classification IPC.** Les phases IPC reposent sur une
   convergence de preuves entre indicateurs de résultat et indicateurs
   contributifs, avec un atelier d'analyse. Ne pas étiqueter un ménage
   « Phase 3 » à partir de ce score.

---

## 8. Reproduire cette analyse

```bash
pnpm examples:build
```

Puis exécuter `notebooks/composite-indicators.python.fr.ipynb` — dans Colab via le
badge, ou localement avec pandas et numpy. Le notebook lit le CSV en HTTPS.

Le jeu de données est versionné par nom de fichier et immuable ; une correction
est publiée en `.v2.csv` avec ce document révisé en même temps.

---

## 9. Journal des versions

| Date | Modification |
| --- | --- |
| 27/07/2026 | Première émission, sur le jeu de données v1. |
