Skip to content
Potato
Why Potato
Docs
Blog
Showcase
Playground
Tools
Community
Get Started
Open main menu
Showcase
/
Text Annotation
Text Annotation
212 annotation designs you can copy and run. Each ships a
config.yaml
and sample data.
All text annotation designs
AdMIRe - Advancing Multimodal Idiomaticity Representation
Adverse Drug Event Extraction (CADEC)
AfriHate - Hate and Abusive Language for African Languages
AfriSenti - African Language Sentiment
AMI Meeting Multi-Tier Annotation
Analysis of Clinical Text: Disorder Identification and Normalization
Argument Reasoning in Civil Procedure
Aspect-Based Sentiment Analysis
Aspect-Based Sentiment Analysis (Original ABSA)
ATOMIC: If-Then Commonsense Reasoning (PersonX / PersonY)
BigEarthNet Remote Sensing Classification
Biomedical Entity Linking (MedMentions)
Biomedical Named Entity Recognition (JNLPBA)
BioNLP 2011 - Gene Regulation Event Extraction
BRAINTEASER - Commonsense-Defying QA
Camelyon17 - Breast Cancer Metastasis Detection in Pathology
Capturing Discriminative Attributes
Causal Medical Claim Identification and PIO Frame Extraction
ChaosNLI: NLI Label Distributions
Character Identification on Multiparty Dialogues
CHART-Infographics: Chart and Infographic Analysis
Check-COVID: Fact-Checking COVID-19 News Claims
Chemical-Disease Relation Extraction (BC5CDR)
ChemProt - Chemical-Protein Interaction Annotation
CheXpert Chest X-Ray Classification
CHILDES Child Language Multi-Tier Annotation
Citation Needed Detection (Multilingual Wikipedia)
CLARITY: Unmasking Political Question Evasions
Clickbait Spoiling
Clinical Trial NLI
CMU-MOSEI: Multimodal Sentiment and Emotion Dataset
Code Defect Detection (CodeXGLUE)
CODWOE - Comparing Dictionaries and Word Embeddings
Commonsense Inference (ATOMIC 2020)
Commonsense Validation and Explanation
Complex Named Entity Recognition (MultiCoNER)
Complex Word Identification
CoNLL-2003 NER with Triage
Coreference Chains
Counterfactual Detection and Reasoning
Counting Events and Participants in News
CrossRE: Cross-Domain Relation Extraction
DeftEval - Extracting Definitions from Free Text
Detecting Machine-Generated Code
Detecting Minimal Semantic Units and Their Meanings (DiMSUM)
Detecting Persuasion Techniques in News
Detecting Stance in Tweets
Detection and Interpretation of English Puns
Determining Sentiment Intensity of English and Arabic Phrases
DGS Corpus Sign Language Multi-Tier Annotation
Dialogue Act Labeling
Dialogue Relation Extraction (DialogRE)
DISRPT: Discourse Segmentation and Relation Classification
DocBank Document Layout Detection
DocLayNet Document Layout Analysis
DoReCo: Language Documentation Reference Corpus
Drug-Drug Interaction Extraction from Biomedical Texts
DWIE Document-Level Entity Annotation and Linking
ECB+ Cross-Document Event Coreference
EmoContext - Contextual Emotion Detection in Text
Emotion Cause Extraction (RECCON)
Emotion Discovery and Reasoning its Flip
Emphasis Selection for Written Text
Entity Linking
Entity Linking in Tweets
Event Annotation
Event Argument Extraction (MAVEN-Arg)
Event Coreference and Relations (MAVEN-ERE)
Explainable Online Sexism Detection
Fact Verification
FEVEROUS Structured Fact Verification Annotation
Financial PhraseBank: Financial News Sentiment Dataset
Fine-Grained Propaganda Detection
FLARE - Financial Named Entity Recognition
FLUTE: Figurative Language Understanding through Textual Explanations
Food Hazard Detection
FQuAD: French Question Answering Dataset
GermanQuAD: German Extractive Question Answering
GoEmotions - Fine-Grained Emotion Classification
Hate Speech Detection
HateXplain - Explainable Hate Speech Detection
Human Values in Arguments
Hypernym Discovery
Hyperpartisan News Detection
i2b2 Clinical Named Entity Recognition
Idiomaticity Detection
IEMOCAP: Dyadic Emotion Recognition Dataset
IndicNLP Suite - Multilingual Sentiment Analysis
Intent Classification
Interlinear Glossing of Endangered Languages
Irony Detection in English Tweets
iSarcasmEval: Intended Sarcasm Detection
KG-BERT Knowledge Graph Triple Validation
KorQuAD: Korean Extractive Question Answering
Legal Event Coreference (LegalCore)
LegalEval - Legal Document Analysis
LexGLUE: Legal Language Understanding Benchmark
LLMs4Subjects - Subject Tagging for a Technical Library
Machine Comprehension Using Commonsense Knowledge
Machine-Generated Text Detection
MasakhaNER 2.0 - Named Entity Recognition for African Languages
MasakhaNEWS - News Topic Classification for African Languages
MasakhaPOS - Part-of-Speech Tagging for African Languages
MASSIVE - Multilingual Intent Classification and Slot Filling
MAST Failure Taxonomy
Math Question Answering and Category Classification
MAUD: Legal Merger Agreement Understanding
MeasEval - Counts and Measurements
Media Frames Corpus: News Framing Annotation
MediTOD Medical Dialogue Annotation
MedNLI: Clinical Natural Language Inference
Memotion Analysis - Sentiment and Type Classification of Memes
Miami Bangor Code-Switching Annotation
MIMIC-CXR Chest Radiograph Classification
Mind2Web: Web Agent Task Annotation
MMMU: Massive Multi-discipline Multimodal Understanding
MOCHEG: Multimodal Fact-Checking with Explanations
Moral Foundations in Tweets
MS MARCO: Passage Ranking Benchmark
MultiCoNER II: Multilingual Complex Named Entity Recognition
Multilingual and Crosslingual Fact-Checked Claim Retrieval
Multilingual Characterization and Extraction of Narratives
Multilingual Coreference Resolution (CorefUD)
Multilingual Emoji Prediction
Multilingual Semantic Role Labeling
Multilingual Word-in-Context
Multimodal Emotion Cause Analysis
MultiNLI - Multi-Genre Natural Language Inference
MultiTACRED Multilingual Relation Extraction Dataset
n2c2 2022: Social Determinants of Health Extraction
Named Entity Disambiguation (AIDA-CoNLL)
Named Entity Recognition
Narrative Story Similarity
Natural Questions - Open-Domain Question Answering
NLPContributionGraph - Structured Extraction of NLP Contributions
NRC Affect Intensity: Word Emotion Intensity via Best-Worst Scaling
NRC Emotion Lexicon (EmoLex): Word-Emotion Association
NRC-VAD: Valence, Arousal & Dominance via Best-Worst Scaling
NumEval - Numeral-Aware Language Understanding and Generation
NusaX - Sentiment Analysis for Indonesian Local Languages
OffensEval - Offensive Language Target Identification
OmniDocBench Comprehensive Document Parsing
OntoNotes - Coreference Resolution
Patient Forum Question Answering
Patronizing and Condescending Language Detection
PDTB 2.0 - Discourse Relations Tree Annotation
Persuasion Techniques in Memes
Plausible Clarifications of Implicit and Underspecified Instructions
POLAR: Detecting Multilingual, Multicultural and Multievent Online Polarization
Political Discourse Analysis (AgoraSpeech)
Predicting Multilingual and Cross-Lingual Lexical Entailment
ProcessBench Earliest-Error Identification
PromiseEval - Corporate ESG Promise Verification
PsyCoMark: Psycholinguistic Conspiracy Marker Extraction and Detection
QA over Tabular Data
Question Answering
R-Judge: Agent Safety Risk Evaluation
R2VQ - Recipe Question Answering
RadGraph-XL: Radiology Entity and Relation Extraction
RadQA: Radiology Report Question Answering Dataset
Rationale Annotation (ERASER)
RCV1: Hierarchical Topic Coding
Reading Comprehension QA
ReCAM - Reading Comprehension of Abstract Meaning
REDFM: Filtered and Multilingual Relation Extraction
Relation Extraction
Ruddit: Offensiveness Best-Worst Scaling
RumourEval Stance and Verification
RuSentiment - Social Media Sentiment
Safe Biomedical NLI
Sarcasm Detection
ScienceQA Multimodal Reasoning
SciER Scientific Entity and Relation Extraction Dataset
SecureNLP - Malware Report Semantic Extraction
Semantic Relation Extraction and Classification in Scientific Papers
Semantic Similarity
SemEval-2007 - Word Sense Disambiguation
SemEval-2017 Task 4 - Sentiment Multi-Rating
SemEval-2019 Task 12: Toponym Resolution in Scientific Papers
SemEval-2020 Task 9: Code-Mixed Sentiment (SentiMix)
SemEval-2021 Task 6: Persuasion Techniques in Memes
SemEval-2022 Task 5: Multimedia Misogyny (MAMI)
SenseRel: Denotational and Connotational Meaning Relations
Sentiment Analysis
Sentiment Composition of Phrases (SCL) via Best-Worst Scaling
SNLI: Stanford Natural Language Inference Corpus
Social Bias Frames (SBIC)
Social Determinants of Health (SDOH) Extraction
SQuAD - Extractive Question Answering
Statement Verification and Evidence Finding with Tables
Structured Sentiment Analysis
Student Essay Discourse Element Classification
Suggestion Mining from Online Reviews and Forums
SWE-bench Verified Issue Validation
Switchboard DAMSL Dialogue Act Corpus (SwDA)
Symlink: Linking Mathematical Symbols to their Descriptions
Table-Based Fact Verification (TabFact)
Text-Based Emotion Detection
Toxic Spans Detection
Toxicity Detection
Triage Quick Annotation Template
TriviaQA - Reading Comprehension
Tweet Emotion Intensity via Best-Worst Scaling (multilingual)
Universal Dependencies - Dependency Parsing Annotation
V-WSD - Visual Word Sense Disambiguation
ValueEval - Human Values behind Arguments
Who&When Multi-Agent Failure Attribution
WikiANN (PAN-X): Multilingual Named Entity Recognition
WNUT-2017: Emerging and Rare Entity Recognition
Word-Colour Associations: Crowdsourcing a Colour Lexicon
Words of Warmth: Social-Perception Norms via Best-Worst Scaling
WorryWords: Word-Anxiety Association via Best-Worst Scaling
Other categories
Image Annotation (41)
Video Annotation (32)
Audio Annotation (33)
Evaluation Tasks (39)
Preference Learning (32)
Comparison Tasks (4)
Surveys (63)