Un dossier de sécurité pré-pilote pour l’IA d’admission clinique destinée aux professionnels
Une structure de preuve proposée pour tester les échecs rares à forte conséquence avant une validation institutionnelle contrôlée.
L’acceptation de sécurité doit être pondérée par les conséquences. Un système performant en moyenne peut rester inacceptable si les rares échecs de signaux d’alarme, d’escalade ou de confidentialité sont insuffisamment contrôlés.
Matrice de sécurité
Des tests distincts doivent couvrir reconnaissance des situations critiques, conflits de politiques, données manquantes, entrées ambiguës, faits halluciné, injection de prompt, biais, fuite de confidentialité, sorties structurées invalides et indisponibilité des services en aval.
Logique d’acceptation
Les classes à forte conséquence doivent utiliser des seuils plus stricts que les défauts documentaires à faible risque. Une moyenne globale ne doit jamais permettre à une catégorie d’échec grave de disparaître dans le score.
Auditabilité
Chaque scénario échoué doit être rejouable avec les versions exactes de politique, modèle et prompt utilisées, afin de permettre les tests de régression après toute modification du système.
Cette synthèse est une analyse CelestyxAI fondée sur les preuves externes citées et les décisions accumulées du projet. Elle n’est pas une publication scientifique évaluée par les pairs et n’établit aucune efficacité clinique.
