2.61 GB
102 files
Updated about 2 months ago
Ctrl+K
| Name | Size | Uploaded | Xet hash |
|---|---|---|---|
| test | 1 items | ||
| train | 96 items | ||
| validation | 2 items | ||
| .gitattributes | 2.5 kB xet | 738f1125 | |
| README.md | 694 Bytes xet | 06c5b5d3 | |
| dataset_manifest.json | 5.83 kB xet | 1ca5c93a |
Emilia S2S Mimi Q8 Named Speakers
TinyAya codec-tokenized TTS dataset built from gs://gp-s2s-data/s2s-data/emilia-s2s/chunk_00036_200k/parquet.
Rows are Mimi codec-only examples. The training text field already includes the
user-facing speaker prefix:
Ira: transcript...
Speaker mapping:
SP_SP010->Ira:SP_SP061->Aisha:SP_SP073->Siya:SP_SP079->Zoya:
Reference conditioning is disabled for this artifact. No ref_* fields are emitted.
- Total size
- 2.61 GB
- Files
- 102
- Last updated
- Jun 8
- Pre-warmed CDN
- US EU US EU