> ## Documentation Index
> Fetch the complete documentation index at: https://docs.abbyy.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Quand utiliser les scripts d'extraction

> Utilisez des scripts d'extraction avec des modèles NLP pour faire correspondre des expressions régulières, des mots de dictionnaire et des objets NER, ou pour extraire des composants d'adresse à partir de documents.

Les scripts d'extraction peuvent améliorer les résultats lorsqu'ils sont utilisés avec un modèle NLP. Utilisez-les dans les cas suivants :

* Vous devez extraire des entités à partir d'un tableau.
* Vous ne disposez pas de suffisamment de documents d'exemple pour entraîner votre modèle NLP.
* La qualité de l'extraction n'est pas satisfaisante pour certains champs.

Les scripts d'extraction vous permettent de :

* Identifier des segments de texte correspondant à une expression régulière, à des mots ou expressions issus d'un dictionnaire utilisateur (sous n'importe quelle forme fléchie) ou à un objet NER intégré.
* Exécuter des requêtes sur le texte et sur les segments de texte, dans lesquels les mots de recherche peuvent apparaître sous n'importe quelle forme fléchie.
* Enregistrer les segments de texte identifiés dans les champs du document.
* Extraire des adresses et leurs composants à partir de documents.

<div id="built-in-ner-objects">
  ## Objets NER intégrés
</div>

| Objet              | Extrait             | Disponibilité                                      |
| ------------------ | ------------------- | -------------------------------------------------- |
| `NerPerson`        | Personnes           |                                                    |
| `NerOrg`           | Organisations       |                                                    |
| `NerGeo`           | Lieux               |                                                    |
| `NerAddress`       | Adresses            |                                                    |
| `NerMoney`         | Montants monétaires | Scripts d’extraction uniquement                    |
| `NerDate`          | Dates               | Scripts d’extraction uniquement                    |
| `NerDuration`      | Durées              | Scripts d’extraction uniquement (russe et anglais) |
| `NERAccountNumber` | Numéros de compte   | Scripts d’extraction uniquement (russe)            |

Composants d’adresse : `NerZipCode` (code postal), `NerCountry` (pays), `NerState` (État), `NerCity` (ville) et `NerStreet` (rue).

<a id="dictionary" />

<div id="create-an-extraction-script">
  ## Créer un script d’extraction
</div>

<Steps>
  <Step title="Ouvrir les propriétés de la section">
    Ouvrez Document Definition Editor, cliquez avec le bouton droit sur une section du document, cliquez sur **Properties**, puis sur l’onglet **NLP**.
  </Step>

  <Step title="Créer le script">
    Sous **Extraction Scripts**, cliquez sur **Create**.
  </Step>

  <Step title="Charger un dictionnaire ou modifier le script">
    Dans la boîte de dialogue **Extraction Script**, cliquez sur **Load** pour charger un dictionnaire utilisateur ou sur **Edit** pour ouvrir l’éditeur de scripts. Les dictionnaires utilisateur doivent être encodés en UTF-8 avec BOM ou en ANSI.
  </Step>
</Steps>

<div id="extract-address-components-from-a-document">
  ## Extraire les composants d’une adresse à partir d’un document
</div>

<Steps>
  <Step title="Définir la zone de l’adresse">
    Spécifiez la partie du document qui contient l’adresse. Limitez la zone de recherche à l’aide d’un champ FlexiLayout et utilisez cette zone comme source du script d’extraction. Pour plus d’informations, consultez [Contraintes de recherche](/fr/flexi-capture/fls/template/basic-constraints).
  </Step>

  <Step title="Appliquer le script d’extraction">
    Appliquez le script approprié. Vous pouvez rechercher des composants d’adresse [dans l’ensemble du champ](/fr/flexi-capture/nlp-extraction-scripts-example#entirefield) ou [dans une partie d’un champ](/fr/flexi-capture/nlp-extraction-scripts-example#partofafield).
  </Step>
</Steps>

Une adresse contient au plus une occurrence de chaque composant (code postal, pays, État, ville et rue), mais un script peut en renvoyer plusieurs. Plus la zone de recherche est définie précisément, moins il y a d’occurrences renvoyées.

Lorsque vous utilisez la méthode `ParseAddressInPosition( resultCollectionNamePrefix : string, startPos : int, endPos : int )` ou `ParseAddressInSpan( resultCollectionNamePrefix : string, span : IInterval )` pour analyser une adresse, chaque mot des composants détectés reçoit les attributs suivants lors de l’indexation, que vous pouvez ensuite utiliser dans des requêtes XML :

1. Le nom de la collection, au format `[resultCollectionNamePrefix]_[NerTypeOfComponent]`.
2. Le préfixe `resultCollectionNamePrefix`.
3. Le type de l’objet NER.

Pour obtenir un exemple de requête XML d’extraction d’adresse, consultez [Langage de requête](/fr/flexi-capture/nlp-extraction-scripts-language#xml-parsing).

<Info>
  Actuellement, vous pouvez extraire des composants uniquement à partir d’adresses allemandes et américaines.
</Info>
