Écran Voix R5 (maquetté, jamais construit) implémenté sur décision du
référent : open-source et local, pas d'API externe.
- apps/ai : faster-whisper (CTranslate2, CPU, MIT) opt-in
(AI_TRANSCRIPTION=off|locale|deterministe, défaut off) ; endpoint
/internal/transcrire — l'audio ne survit JAMAIS à l'appel (fichier
temporaire supprimé quoi qu'il arrive) ; indexer_bilans inclut
désormais InterventionReport.note anonymisée (champ existant depuis
R2, jamais eu d'écran jusqu'ici) ; 29 pytest.
- Contrat (77 opérations) : POST /assistant/transcribe (multipart).
- API : proxy multipart vers siop2-ai (WORK_ORDERS.edit — même droit
que la saisie du bilan) ; 2 tests e2e (80 tests API au total).
- Mobile : expo-audio + expo-file-system, bouton dicter/terminer sur
l'écran de clôture, purge locale après transcription, « Joindre la
description à l'OT » (corrige un bug latent : enfilerBilan ignorait
silencieusement les mises à jour de note).
- Docker : siop2-ai embarque le modèle Whisper au build (1,54→2,19 Go),
construit et vérifié (transcription réelle en conteneur, non-root).
- Vérifié réellement : transcription fidèle (voix de synthèse
française) en direct, bout en bout via l'API, dans le conteneur
Docker construit, et chaîne corpus complète (note → clôture →
réindexation → recherche sémantique).
- Base de dev locale réinitialisée avec accord explicite du référent
(prisma migrate reset, bloqué par défaut pour un agent IA) après
pollution par les tests manuels de la recette terrain précédente.
Reste : test tactile sur iPhone physique (bouton dicter) — bloqué par
une connexion USB qui ne s'est pas rétablie malgré câble/port/
redémarrage essayés à plusieurs reprises, reporté comme la recette
Android.
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
apps/ai : /internal/ask — seuil de pertinence, extraits sourcés ou
refus honnête portant la taille du corpus cherché (D2), rédaction via
le Generateur opt-in ; /internal/suggest — similarité sémantique entre
la description libre et les libellés ACTIFS des référentiels, un code
par champ, confiance FORTE/MOYENNE, « N bilans similaires sur ce
parc ». Sans LLM : déterministe, explicable. 23 pytest.
Contrat (74 opérations) : POST /assistant/ask → AssistantAnswer
(EXTRACTIVE/GENERATED/REFUSAL, extraits cités, corpus cherché) et
POST /assistant/suggest-bilan (codes existants seulement) ; clients
web/mobile régénérés.
API NestJS : module assistant — proxy vers siop2-ai (AI_SERVICE_URL/
AI_SERVICE_TOKEN, ADR-004 §4), permissions matrice (ask=view,
suggest=edit), traduction interne→contrat, 503 propre si service
éteint. 6 e2e sur stub HTTP (76 tests API).
Bug débusqué par la vraie chaîne : fastembed ne norme pas ses
vecteurs — la similarité des suggestions dépassait 1 (pgvector
normalisait dans son opérateur, masquant l'écart). Normalisation à
l'encodage + réindexation : bilans en tête (0.41), refus hors corpus,
scores cosinus ≤ 1.
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>