Japanese SFT/DPO data convert to speech via TTS. And audio caption data generated by Qwen3-Omni. All datasets are available for commercial use.
Ayuto Tsutsumi
Atotti
P(doom) <0.01%
AI & ML interests
None yet
Recent Activity
liked a dataset 2 days ago
llm-jp/llm-jp-4.1-thinking-sft-data liked a dataset 2 days ago
shunk031/STAIR-Captions upvoted an article 12 days ago
YODAS v3: A 1 Million Hour Dataset for the Next Generation of Open Voice AI Research