Open Source Datasets

Public training partitions for Bengali language research. Each button opens that training split on Kaggle or Hugging Face. Hidden test sets are not listed. To report data quality issues or mislabeled samples, reach out through our contact form.