docs(r5): amender l'écran Voix — la transcription alimente aussi le corpus

L'écran 6 (dictée, jamais construite — option « si budget temps ») dit
maintenant explicitement que la description relue et jointe à l'OT
rejoint le corpus de l'assistant à la clôture, anonymisée comme les
bilans codés. Idée discutée avec le référent (transcription locale via
faster-whisper envisagée, moteur/calibrage tranchés dans le détail),
maquette amendée et validée — implémentation non demandée pour
l'instant.

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
This commit is contained in:
pr-daaif
2026-07-22 10:44:03 +01:00
parent 189e8e8162
commit 0730bf9dad
2 changed files with 38 additions and 1 deletions

View File

@@ -4,6 +4,37 @@ Trace chronologique des sessions (la plus récente en premier). Le **playbook**
---
## 2026-07-22 — Pr. Daaif (+ Claude) — Idée backlog : transcription audio → corpus (maquette amendée, pas codée)
**Actions**
- Discussion de conception (aucun code) : étendre l'écran « Voix » de R5 (dictée, jamais construite — option
« si budget temps ») pour que la transcription relue, une fois jointe à l'OT, **alimente aussi le corpus** de
l'assistant à la clôture — pas seulement la description libre ponctuelle de la suggestion.
- Écarté : Ollama local pour les embeddings du corpus (déjà 100 % locaux via `fastembed`, aucun gain — pertinent
plutôt pour remplacer l'API Claude opt-in de génération, piste non creusée).
- Moteur retenu pour une future transcription locale : `faster-whisper` (CTranslate2, MIT, CPU) — même
philosophie que les embeddings. Point de vigilance identifié : Whisper transcrit mal le darija, probable en
mélange avec le français sur le terrain.
- Point d'accroche trouvé dans le schéma existant : `InterventionReport.note` (texte libre) existe déjà en base
et en UI mais n'est **pas encore indexé** dans le corpus (`indexer_bilans` ne reprend que les libellés codés).
- Gap identifié dans `anonymisation.py` : reconnaît seulement les noms CONNUS de la base, pas de NER générale —
risque de fuite plus élevé sur de la parole libre que sur des libellés codés.
- **Maquette amendée et validée** (`maquette-r5.html`, écran 6 « Voix ») : bandeau d'intention et carte
« Et ensuite » disent maintenant explicitement que le texte (anonymisé) rejoint le corpus à la clôture de l'OT.
**Décisions**
- Pas de prototype de mesure préalable (contrairement au calibrage des embeddings R5) — le calibrage
français/darija se fera plus tard si besoin.
- **Implémentation non demandée pour l'instant** — la maquette est validée, le code attend un prochain feu vert.
**Prochaine étape** : reprendre sur demande du référent — implémentation cohérente avec le flux esquissé (audio
jamais persisté, transcription → `InterventionReport.note` → corpus à la clôture), moteur et calibrage déjà
tranchés, pas à rediscuter.
---
## 2026-07-19 — Pr. Daaif (+ Claude) — Recette terrain mobile sur iPhone 15 Pro : les 7 points validés (ADR-005)
**Actions**