Data Marketplace

Flitto Data Marketplace offers license-verified AI training and evaluation datasets in text, speech, image, and video across 100+ languages and 23+ domains. Try a free sample, then contact us to purchase.

Sell your data on Flitto

Simply register your data and check its sale eligibility.

A total of 326 datasets
  • Evaluation DataText

    General BFCL 4v Benchmark Dataset

    A Korean-based BFCL 4v benchmark text dataset built for evaluating function-calling capabilities of AI models.

    DomainIT and Tech|Science and Engineering
    LanguageKorean
  • Evaluation DataText

    General Tau Benchmark Dataset

    A Korean-based Tau benchmark text dataset built for evaluating AI model performance in benchmark tasks.

    DomainHumanities and Social|IT and Tech|Education|Management, Economic and Finance|Ad and Marketing|Lifestyle
    LanguageKorean
  • Alignment DataText

    General Preference Evaluation Chat Arena Single-Turn Dataset

    A Korean-based Chat Arena preference evaluation single-turn dataset built by collecting human preferences for AI model responses.

    DomainHumanities and Social|IT and Tech|Medical|Bio, Environment and Energy|Education|Management, Economic and Finance|Ad and Marketing|Sports, Arts and Culture|Science and Engineering|Law and Public|Lifestyle
    LanguageKorean
  • Alignment DataText

    General Preference Evaluation Chat Arena Multi-Turn Dataset

    A Korean-based Chat Arena preference evaluation multi turn dataset built by collecting human preferences for AI model responses.

    DomainHumanities and Social|IT and Tech|Medical|Bio, Environment and Energy|Education|Management, Economic and Finance|Ad and Marketing|Sports, Arts and Culture|Science and Engineering|Law and Public|Lifestyle
    LanguageKorean
  • Evaluation DataText

    General Long Context Benchmark Dataset

    A Korean-based long context benchmark text dataset built to evaluate AI models' ability to process and reason over extended contexts.

    DomainHumanities and Social|IT and Tech|Medical|Bio, Environment and Energy|Education|Management, Economic and Finance|Ad and Marketing|Sports, Arts and Culture|Science and Engineering|Law and Public|Lifestyle
    LanguageKorean
  • Frontier DataText

    General HLE Reasoning Global Benchmark Dataset

    A high-difficulty Korean reasoning benchmark dataset built according to global HLE standards, including complex expert-level reasoning problems.

    DomainHumanities and Social|IT and Tech|Medical|Bio, Environment and Energy|Education|Management, Economic and Finance|Ad and Marketing|Sports, Arts and Culture|Science and Engineering|Law and Public|Lifestyle
    LanguageKorean
  • Frontier DataText

    Korean HLE Reasoning and Benchmark Dataset

    A high-difficulty Korean HLE reasoning and benchmark dataset built with Korea-specific expert-level reasoning problems.

    DomainHumanities and Social|IT and Tech|Medical|Bio, Environment and Energy|Education|Management, Economic and Finance|Ad and Marketing|Sports, Arts and Culture|Science and Engineering|Law and Public|Lifestyle
    LanguageKorean
  • Evaluation DataText

    Gulf Arabic General Arena Dataset

    A benchmark text dataset developed for Arena evaluation based on Gulf Arabic.

    DomainIT and Tech|Humanities and Social|Science and Engineering
    LanguageArabic
  • Evaluation DataText

    Egyptian Arabic General Arena Dataset

    A benchmark text dataset developed for Arena evaluation based on Egyptian Arabic.

    DomainIT and Tech|Humanities and Social|Science and Engineering
    LanguageArabic (Egypt)
  • Evaluation DataText

    Bengali General Arena Dataset

    A benchmark text dataset developed for Arena evaluation based on Bengali.

    DomainIT and Tech|Humanities and Social|Science and Engineering
    LanguageBengali