-
Khan Akademiden küçük annotated ses kayıtları:
-
CommonVoice
-
Daha noisy bir dataset, buna dB üzerinden bi filtreleme gerekebilir
-
Sadece Türkçesi alınabilir fena durmuyor
-
Seslere belirli noise atarak, metni aynı tutarak bi kaliteyi yükseltmek olabilir, güzel olabilir
-
Bu 11 part, bunun her partı alınabilir, zaten gayet küçük bir dataset olacak sonunda ama yine güzel, temiz veri
-
Diğer datasetlerle ortaklığı var mı bilmiyorum ama data çeşitliliği açısından gayet güzel
-
Appen 700 saat değil ama gayet güzel
-
Noisy güzel bir dataset
-
Mozilla tts fena değil
-
TTS demiş ama pek tts gibi gelmedi bana
-
Çok cümleler bölünmüş ama güzel
-
Hayvan gibi podcast basmış eleman
-
TTS Fena değil
Veriler hep 5-15 saniye arası yapmak gerekiyor gibi, tek sıkıntı bu verilerin hiçbirinde neredeyse düzgün cümle sınırları yok. Podcastlerden biraz veri çekip ya da trt den cümle sınırlarını belirleyerek bir şeyler yapılabilir belki