Data Marketplace

Flitto Data Marketplace offers license-verified AI training and evaluation datasets in text, speech, image, and video across 100+ languages and 23+ domains. Try a free sample, then contact us to purchase.

Sell your data on Flitto

Simply register your data and check its sale eligibility.

A total of 326 datasets
  • Pre-training DataAudio

    Japanese Multi-Turn Speech Dataset for Everyday, Travel & Academic Domains

    A Japanese multi-turn spoken dialogue dataset covering everyday, travel, and academic domains.

    DomainLifestyle|Sports, Arts and Culture|Education
    LanguageJapanese
  • Pre-training DataAudio

    Chinese Multi-Turn Speech Dataset for Everyday, Travel & Academic Domains

    A Chinese multi-turn spoken dialogue dataset covering everyday, travel, and academic domains.

    DomainLifestyle|Sports, Arts and Culture|Education
    LanguageChinese (Simplified)
  • Pre-training DataAudio

    English Speech Dataset by Korean Speakers for Everyday, Travel & Medical Domains

    A single-turn English speech dataset by Korean speakers, designed to enhance multilingual interpretation and translation in everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageEnglish
  • Pre-training DataAudio

    English Speech Dataset by Japanese Speakers for Everyday, Travel & Medical Domains

    A single-turn English speech dataset by Japanese speakers, designed to enhance multilingual interpretation and translation in everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageEnglish
  • Pre-training DataAudio

    English Speech Dataset by Indian Speakers for Everyday, Travel & Medical Domains

    A single-turn English speech dataset by Indian speakers, designed to enhance multilingual interpretation and translation in everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageEnglish
  • Pre-training DataAudio

    English Multi-Turn Speech Dataset by Korean Speakers for Everyday, Travel & Medical Domains

    A multi-turn English spoken dialogue dataset by Korean speakers, designed to enhance multilingual interpretation and translation in everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageEnglish
  • Pre-training DataAudio

    English Multi-Turn Speech Dataset by Japanese Speakers for Everyday, Travel & Medical Domains

    A multi-turn English spoken dialogue dataset by Japanese speakers, designed to enhance multilingual interpretation and translation in everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageEnglish
  • Pre-training DataAudio

    English Multi-Turn Speech Dataset by Indian Speakers for Everyday, Travel & Medical Domains

    A multi-turn English spoken dialogue dataset by Indian speakers, designed to enhance multilingual interpretation and translation in everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageEnglish
  • Pre-training DataAudio

    Malay Speech Dataset for Everyday, Travel & Medical Domains

    A single-turn Malay speech dataset specialized for everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageMalay
  • Pre-training DataAudio

    Indonesian Speech Dataset for Everyday, Travel & Medical Domains

    A single-turn Indonesian speech dataset specialized for everyday, travel, and medical domains.

    DomainLifestyle|Medical
    LanguageIndonesian