Dataset

PHINC

Parallel Hinglish social-media corpus for machine translation (13,738 sentence pairs).

Theme
Multilingual & Multimodal Intelligence
Type
Dataset
Funding
Unfunded

Paper and data

PHINC: A Parallel Hinglish Social Media Code-Mixed Corpus for Machine Translation

Srivastava, Singh. W-NUT @ EMNLP 2020.

PaperarXivHugging Face

Theme →Datasets and models →Publications →