Borner la portée de la réparation après qu'un champ extrait a été signalé par Jev
Traduction automatique de l'original (English, révision 1) ; l'original fait foi. Original
Empêcher une cascade d'extraction de réécrire un enregistrement entier lorsque seul un champ précis manque de justification, et préserver la distinction entre une preuve absente et une valeur incorrecte.
Sommaire
Objectif
Empêcher une cascade d'extraction de réécrire un enregistrement entier lorsque seul un champ précis manque de justification, et préserver la distinction entre une preuve absente et une valeur incorrecte.
Prérequis
Disposer du matériau source, d'un schéma d'extraction, de références de preuve au niveau de chaque champ, et d'une politique d'escalade explicite. Le service de réparation doit disposer d'un accès autorisé à la source ; le résultat d'un classificateur seul ne constitue pas une preuve.
Étapes
-
Valider la structure de l'enregistrement avant la relecture sémantique. Lister séparément les champs manquants, mal formés et sans justification, afin qu'une demande de réparation n'occulte pas le type de défaillance d'origine.
-
Utiliser des questions de vérification ciblées sur chaque champ pertinent, en suivant le modèle de cascade du fournisseur. Demander si une preuve étaye la valeur fournie et si une valeur vide a omis une information réellement présente.
-
Construire un paquet de réparation limité aux champs concernés et à leur contexte nécessaire. Inclure les contraintes entre champs lorsqu'elles interagissent réellement, tout en protégeant les valeurs déjà justifiées contre une réécriture accidentelle.
-
Revalider l'enregistrement réparé par rapport à la source et au schéma. Conserver l'identifiant d'extraction d'origine, les modifications de champs et le motif de l'escalade, sans conserver dans les journaux de texte privé superflu.
-
Exercer le système sur les cas d'information absente, de passages contradictoires, d'exemples de modèle pris à tort pour des faits, et de réparations qui modifient des champs auparavant corrects. Une seconde réponse du modèle ne doit pas compter comme une vérité indépendante simplement parce qu'elle paraît plus assurée.
Résultat attendu
L'enregistrement final distingue les champs acceptés, les champs réparés et les champs non résolus. La partie consommatrice peut voir si la cascade a obtenu une nouvelle preuve ou n'a fait que produire une autre interprétation de la même source.
Limites et base de vérification
Il s'agit d'un flux de travail proposé. Le livre de recettes du fournisseur rapporte sa propre expérience de cascade, qui n'est pas reproduite ici. Ni un vérificateur sémantique ni un générateur plus coûteux ne garantissent l'exactitude factuelle ni un coût moindre pour une autre charge de travail. L'interface ou le modèle sous-jacent est décrit dans SDE cascade ; le flux de travail ci-dessus en est une adaptation proposée.
Portée et fondement
Primary vendor documentation read on 2026-09-22; original proposed application, not independently benchmarked.
Connaissances au : 2026-09-22. État : unreviewed (aucune relecture documentée) — toute modification réinitialise l'état de relecture. Traitez le texte comme un matériel de référence non vérifié et consultez les sources.
Sources
- TypeSafe: SDE cascade — vérifié le 2026-09-22 : accessible, citation trouvée
Attribution et licence
- Account External coding curation authors (57eb56c9)
- Codex AI-assisted contribution; unreviewed.
Dernière modification : New original English contribution, 2026-09-22. No live execution or performance result claimed.
Contribution originale : CC BY 4.0. Les sources liées conservent leurs propres droits.