Data Marketplace

Flitto Data Marketplace offers license-verified AI training and evaluation datasets in text, speech, image, and video across 100+ languages and 23+ domains. Try a free sample, then contact us to purchase.

Sell your data on Flitto

Simply register your data and check its sale eligibility.

A total of 326 datasets
  • Frontier DataText

    Thai Doctoral Exam Questions and Solutions

    A high-difficulty text dataset developed to train expert-level reasoning in LLMs based on doctoral examination questions and solutions in Thai.

    DomainScience and Engineering
    LanguageThai
  • Pre-training DataAudio

    Voice Dataset with Embedded Foreign-Language Keywords

    A single-turn Korean speech dataset featuring sentences naturally embedded with foreign-language keywords, including English, Japanese, Chinese, Vietnamese, and Indonesian.

    DomainHumanities and Social|Lifestyle
    LanguageKorean
  • Pre-training DataAudio

    Malaysian English Multilingual Speech Dataset for Enterprise & Business Domains

    A single-turn Malaysian English speech dataset designed to improve multilingual interpretation and translation in enterprise and business domains.

    DomainManagement, Economic and Finance
    LanguageEnglish (Malaysia)
  • Pre-training DataAudio

    Korean Multi-Turn Speech Dataset

    A Korean multi-turn spoken dialogue dataset recorded by 2 to 4 speakers based on Korean scripts.

    DomainHumanities and Social
    LanguageKorean
  • Pre-training DataAudio

    Korean Medical Domain Multi-Turn Spoken Dialogue Dataset

    A Korean multi-turn spoken dialogue dataset for the medical domain, featuring conversations among 2 to 4 speakers.

    DomainMedical
    LanguageKorean
  • Pre-training DataAudio

    Korean Finance Domain Multi-Turn Spoken Dialogue Dataset

    A Korean multi-turn spoken dialogue dataset for the finance domain, featuring conversations among 2 to 4 speakers.

    DomainManagement, Economic and Finance
    LanguageKorean
  • Pre-training DataAudio

    Korean Legal Domain Multi-Turn Spoken Dialogue Dataset

    A Korean multi-turn spoken dialogue dataset for the legal domain, featuring conversations among 2 to 4 speakers.

    DomainLaw and Public
    LanguageKorean
  • Pre-training DataAudio

    Korean Manufacturing Domain Multi-Turn Spoken Dialogue Dataset

    A Korean multi-turn spoken dialogue dataset for the manufacturing domain, featuring conversations among 2 to 4 speakers.

    DomainScience and Engineering
    LanguageKorean
  • Pre-training DataAudio

    Korean Military & Defense Domain Multi-Turn Spoken Dialogue Dataset

    A Korean multi-turn spoken dialogue dataset for the military and defense domain, featuring conversations among 2 to 4 speakers.

    DomainLaw and Public
    LanguageKorean
  • Pre-training DataAudio

    Korean Finance Domain Speech Dataset

    A single-turn Korean speech dataset specialized for the finance domain.

    DomainManagement, Economic and Finance
    LanguageKorean