-
LLM Text Generation Dataset
4 Millions+ logs
32 Languages
3 Models of GPT -
British English Speech Recognition Dataset
20+ Speakers
10+ Hours -
Spanish Speech Recognition Dataset
10+ Hours
20+ Speakers -
French Speech Recognition Dataset
10+ Hours
20+ Speakers -
German Speech Recognition Dataset
10+ Hours
20+ Speakers -
Hindi Speech Recognition Dataset
10+ Hours
20+ Speakers -
Russian Speech Recognition Dataset
10+ Hours
20+ Speakers -
Italian Speech Recognition Dataset
10+ Hours
20+ Speakers -
American Speech Recognition Dataset
10+ Hours
20+ Speakers -
Japanese Speech Recognition Dataset
10+ Hours
20+ Speakers -
Portuguese Speech Recognition Dataset
10+ Hours
20+ Speakers -
Dataset with 30K Illustrations in 20 Artistic Styles
30,000 images
20 styles -
Korean Speech Recognition Dataset
10+ Hours
20+ Speakers -
Vietnamese Speech Recognition Dataset
10+ Hours
20+ Speakers -
Arabic Speech Recognition Dataset
10+ Hours
20+ Speakers -
Slovenian Speech Recognition Dataset
10+ Hours
20+ Speakers -
Human-Robot Conversation Dataset (English)
660+ Hours
20,000 Files -
Human-Robot Conversation Dataset (German)
660+ Hours
20,000 Files -
Human-Robot Conversation Dataset (Russian)
660+ Hours
20,000 Files -
Human-Robot Conversation Dataset (Korean)
660+ Hours
20,000 Files -
Medical Conversations Dataset (English)
1760 Hours
Language
Comprehensive collection of language datasets designed to support the development, training, and evaluation of natural language processing (NLP) models.
Ready to get started?
Tell us what you need — we’ll reply within 24h with a free estimate
- Andrew
- Head of Client Success
— I'll guide you through every step, from your first
message to full project delivery
Thank you for your
message
We use cookies to enhance your experience, personalize content, ads, and analyze traffic. By clicking 'Accept All', you agree to our Cookie Policy.