Data Marketplace

Flitto Data Marketplace offers license-verified AI training and evaluation datasets in text, speech, image, and video across 100+ languages and 23+ domains. Try a free sample, then contact us to purchase.

Sell your data on Flitto

Simply register your data and check its sale eligibility.

A total of 326 datasets
  • Pre-training DataAudio

    Vietnamese Speech Dataset for Everyday, Travel & Medical Domains

    A single-turn Vietnamese speech dataset specialized for everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageVietnamese
  • Pre-training DataAudio

    Malay Multi-Turn Speech Dataset for Everyday, Travel & Medical Domains

    A Malay multi-turn spoken dialogue dataset covering everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageMalay
  • Pre-training DataAudio

    Indonesian Multi-Turn Speech Dataset for Everyday, Travel & Medical Domains

    An Indonesian multi-turn spoken dialogue dataset covering everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageIndonesian
  • Pre-training DataAudio

    Vietnamese Multi-Turn Speech Dataset for Everyday, Travel & Medical Domains

    A Vietnamese multi-turn spoken dialogue dataset covering everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageVietnamese
  • Pre-training DataAudio

    British English Multi-Turn Speech Dataset for Call Center Domains

    A multi-turn spoken dialogue dataset between native British English speakers in call center domains.

    DomainLifestyle
    LanguageEnglish (United Kingdom)
  • Pre-training DataAudio

    English Multi-Turn Speech Dataset by French Speakers for Call Center Domains

    A multi-turn English spoken dialogue dataset by French speakers in call center domains.

    DomainLifestyle
    LanguageEnglish
  • Pre-training DataAudio

    Multi-Accent English Multi-Turn Speech Dataset for Call Center Domains

    A multi-turn English spoken dialogue dataset featuring mixed accents from German, French, and British speakers in call center domains.

    DomainLifestyle
    LanguageEnglish
  • Pre-training DataAudio

    Arabic Multi-Turn Speech Dataset for Preventing False Positives in Automotive Voice Assistants

    An Arabic multi-turn spoken dialogue dataset designed to prevent false positive activation of in-vehicle voice assistants.

    DomainIT and Tech
    LanguageArabic
  • Pre-training DataAudio

    Hindi Hard Negative & Edge Case Multi-Turn Speech Dataset for Preventing False Positives in Automotive Voice Assistants

    A Hindi multi-turn spoken dialogue dataset designed to prevent false positive activation of in-vehicle voice assistants, with a focus on hard negative and edge case scenarios.

    DomainIT and Tech
    LanguageHindi
  • Pre-training DataAudio

    Indonesian Hard Negative & Edge Case Multi-Turn Speech Dataset for Preventing False Positives in Automotive Voice Assistants

    An Indonesian multi-turn spoken dialogue dataset designed to prevent false positive activation of in-vehicle voice assistants, with a focus on hard negative and edge case scenarios.

    DomainIT and Tech
    LanguageIndonesian