- Vue d'ensemble (Overview)
- Construction de modèles
- Validation du modèle
- Déploiement du modèle
- Utiliser des modèles
- API
- Questions fréquemment posées
Questions fréquemment posées sur la phase de conception dans la fonctionnalité Documents complexes et non structurés d'IXP, couvrant les limites, les champs, les annotations et les performances du modèle.
En phase de conception, existe-t-il des limites pour cette capacité ?
Les limites de la phase de conception sont les suivantes :
- Nombre de champs par groupe de champs : jusqu'à 32 champs.
- Nombre de caractères par nom de champ : jusqu'à 128 caractères.
- Nombre de caractères par instruction d'invite : jusqu'à 2 048 caractères. Cela s'applique à toutes les invites, y compris les instructions générales, les instructions de groupe de champs, les instructions de champ et les instructions de type de champ.
Puis-je créer des champs génériques dans la fonctionnalité Documents ?
Non, il n'existe pas de champ générique dans Extraction et traitement intelligents (IXP). Tous les champs doivent appartenir à un groupe de champs. Chaque groupe de champs représente un tableau distinct, où les champs représentent les colonnes du tableau. Cependant, il est possible de définir un groupe de champs au niveau parent représentant un type de document et d'ajouter des champs plus généraux sous forme de tableau sous ce groupe de champs.
Les modèles de Documents complexes et non structurés du service Extraction et traitement intelligents (IXP) améliorent-ils les performances avec la labélisation ou les annotations ?
Non, le modèle n'apprend pas encore directement à partir des annotations de l'utilisateur. La façon d'améliorer les performances de votre modèle est de modifier vos instructions d'invite ou la configuration de votre modèle. Un modèle ajustable qui apprend des annotations sera disponible dans une version future.
Pourquoi dois-je annoter des documents si cela n'améliore pas les performances du modèle ?
Il reste important de valider et d'annoter les documents pour établir la vérité du terrain pour l'évaluation des performances du modèle, qui est capturée dans les métriques de performances intégrées de la page Mesurer.
Combien de documents dois-je importer pour tester mes instructions ?
Vous devez télécharger un échantillon représentatif de vos documents pour couvrir toutes les variations possibles. Cela doit correspondre à au moins 20 à 30 documents différents. Nous vous recommandons d'examiner les prédictions initiales de deux à trois documents pour ensuite décider si vous devez modifier vos instructions avant d'augmenter progressivement l'échantillon de test à 10, 20, 30, X documents. Il s'agira alors d'un processus itératif.
Combien de documents dois-je annoter pour obtenir des mesures de performances fiables ?
Nous vous recommandons de valider pour chaque champ au moins dix documents ou dix exemples, ou les deux afin que le modèle puisse vous fournir des statistiques de validation significatives. Il s'agit du nombre minimum d'annotations, qui dépendront des exigences spécifiques du cas d'utilisation.
- En phase de conception, existe-t-il des limites pour cette capacité ?
- Puis-je créer des champs génériques dans la fonctionnalité Documents ?
- Les modèles de Documents complexes et non structurés du service Extraction et traitement intelligents (IXP) améliorent-ils les performances avec la labélisation ou les annotations ?
- Pourquoi dois-je annoter des documents si cela n'améliore pas les performances du modèle ?
- Combien de documents dois-je importer pour tester mes instructions ?
- Combien de documents dois-je annoter pour obtenir des mesures de performances fiables ?