Skip to content

Étiquette souple

Configurez l'annotation en étiquettes souples dans Potato pour répartir une distribution de probabilité entre des catégories à l'aide de curseurs dont la somme reste fixe.

Le schéma d'annotation en étiquettes souples permet aux annotateurs d'attribuer des distributions de probabilité entre plusieurs catégories plutôt que de trancher par une classification unique. Les annotateurs se servent de curseurs pour répartir un total fixe (100 points, par exemple) entre les étiquettes, ce qui rend compte du degré d'incertitude ou du recouvrement entre catégories.

Interface d'étiquettes souples de Potato, répartissant 100 points entre des catégories de sentimentLes étiquettes souples dans Potato

Vue d'ensemble

L'étiquetage souple est utile quand un élément peut relever en partie de plusieurs catégories. Au lieu de forcer les annotateurs à choisir une seule étiquette, ce schéma leur permet d'exprimer une confiance relative sur l'ensemble des options. Les curseurs sont liés de sorte que leur somme reste toujours égale au total configuré, et un graphique de distribution facultatif donne un retour visuel.

Démarrage rapide

yaml
annotation_schemes:
  - annotation_type: soft_label
    name: sentiment_distribution
    description: Distribute 100 points across sentiment categories based on how much each applies.
    labels: ["Positive", "Neutral", "Negative"]
    total: 100

Options de configuration

ChampTypeDéfautDescription
annotation_typechaîneRequisDoit valoir "soft_label"
namechaîneRequisIdentifiant unique de ce schéma
descriptionchaîneRequisInstructions affichées aux annotateurs
labelstableauRequisListe des étiquettes de catégorie (2 minimum)
totalentier100Somme fixe que doivent atteindre tous les curseurs
min_per_labelentier0Valeur minimale que doit recevoir chaque étiquette
show_distribution_chartbooléentrueAfficher un camembert ou un histogramme de la distribution en cours
label_requirement.requiredbooléenfalseIndique si l'annotation doit être complétée avant de passer à la suite

Exemples

Distribution de sentiment

yaml
annotation_schemes:
  - annotation_type: soft_label
    name: sentiment_distribution
    description: How much does each sentiment apply to this text?
    labels: ["Positive", "Neutral", "Negative"]
    total: 100
    show_distribution_chart: true

Intensité des émotions

yaml
annotation_schemes:
  - annotation_type: soft_label
    name: emotion_mix
    description: Distribute points to reflect the mix of emotions in this utterance.
    labels: ["Joy", "Sadness", "Anger", "Fear", "Surprise", "Disgust"]
    total: 100
    min_per_label: 0
    show_distribution_chart: true

Pertinence thématique

yaml
annotation_schemes:
  - annotation_type: soft_label
    name: topic_relevance
    description: How relevant is this document to each topic?
    labels: ["Politics", "Sports", "Technology", "Entertainment"]
    total: 100

Allocation minimale imposée

yaml
annotation_schemes:
  - annotation_type: soft_label
    name: genre_mix
    description: Allocate points across genres. Each genre must receive at least 5 points.
    labels: ["Rock", "Pop", "Jazz", "Classical", "Electronic"]
    total: 100
    min_per_label: 5

Format de sortie

json
{
  "sentiment_distribution": {
    "labels": {
      "Positive": 45,
      "Neutral": 30,
      "Negative": 25
    }
  }
}

La somme des valeurs est toujours égale au total configuré.

Bonnes pratiques

  1. Utilisez-les quand les catégories se recouvrent - les étiquettes souples conviennent quand un élément relève réellement de plusieurs catégories à des degrés divers
  2. Gardez un nombre d'étiquettes raisonnable - au-delà de 6 ou 7 étiquettes, l'interface à curseurs devient pénible
  3. Choisissez un total qui a du sens - 100 s'interprète intuitivement en pourcentages, mais des totaux plus petits font l'affaire pour des tâches simples
  4. N'abusez pas de min_per_label - imposer une allocation minimale peut biaiser les résultats quand une étiquette ne s'applique vraiment pas
  5. Activez le graphique de distribution - le retour visuel aide les annotateurs à voir leur répartition d'un coup d'œil

Pour aller plus loin

Pour les détails d'implémentation, consultez la documentation source.