Dataset

Triveni

Indic multimodal fine-tuning corpus with English, Hindi, and Hinglish captions, plus a larger pretraining split.

Theme
Multilingual & Multimodal Intelligence
Type
Dataset
Funding
Unfunded

Releases

Triveni

Fine-tuning split (English, Hindi, Hinglish captions).

Hugging Face

triveni-raw

Larger pretraining split (Vaani + Flickr30k; Hindi, English, Hinglish).

Hugging Face

Theme →Datasets and models →Publications →