|
1 | 1 | // tst_multig2p_languages.cpp |
2 | | -// Multig2p plugin integration tests covering all languages supported by |
3 | | -// Phonetic-Suite-Multi/modules/Multig2p-Multi. |
| 2 | +// Multig2p plugin integration tests covering all 9 default languages |
| 3 | +// supported by Phonetic-Suite-Multi/modules/Multig2p-Multi. |
4 | 4 | // |
5 | 5 | // Verifies the chainG2p → multig2p call path by exercising the multig2p |
6 | 6 | // task directly with G2pInputV1 (languageId set per language). This |
@@ -223,37 +223,22 @@ namespace { |
223 | 223 | std::string expectedPron; // expected space-separated phonemes |
224 | 224 | }; |
225 | 225 |
|
226 | | - /// All 12 languages supported by Multig2p-Multi, each with the simplest |
227 | | - /// common word to minimize ONNX variance. Language codes are ISO 639-3. |
228 | | - /// expectedPron values come from the dict training data (ChainG2p-*/...txt) |
229 | | - /// and config.json phoneme sets. For ita/default, preprocessor |
230 | | - /// remove_tone_digits strips stress marks (i1 → i). |
| 226 | + /// 9 default languages supported by Multig2p-Multi, each with the |
| 227 | + /// simplest common word to minimize ONNX variance. Language codes are |
| 228 | + /// ISO 639-3; internal key uses xxx/default. |
| 229 | + /// expectedPron from ChainG2p-*/...txt dicts + config.json phoneme sets. |
| 230 | + /// ita/default preprocessor remove_tone_digits strips stress (i1 → i). |
231 | 231 | const std::vector<LangCase> &langCases() { |
232 | 232 | static const std::vector<LangCase> cases = { |
233 | | - // eng/default uses CMU ARPABET: ah (not ax) for schwa |
234 | | - {"eng/default", "hello", "eng (CMU)", "hh ah l ow"}, |
235 | | - // eng/plus (ARPABET Plus) uses ax for the reduced schwa |
236 | | - {"eng/plus", "hello", "eng (ARPABET Plus)", "hh ax l ow"}, |
237 | | - // deu dict: ja → y aa; voc has y, aa (OpenUTAU format) |
238 | | - {"deu/default", "ja", "deu (OpenUTAU)", "y aa"}, |
239 | | - // fra dict: oui → ou ii; voc has ou, ii |
240 | | - {"fra/default", "oui", "fra (OpenUTAU)", "ou ii"}, |
241 | | - // ita dict: si → s i1; remove_tone_digits → s i |
242 | | - {"ita/default", "si", "ita (OpenUTAU)", "s i"}, |
243 | | - // kor phoneme set uses Latin: syllable 가 → g a |
244 | | - {"kor/default", "가", "kor (OpenUTAU)", "g a"}, |
245 | | - // por dict: sim → s i~; voc has i~ |
246 | | - {"por/default", "sim", "por (OpenUTAU)", "s i~"}, |
247 | | - // rus dict uses Latin phonemes: да → d a |
248 | | - {"rus/default", "да", "rus (OpenUTAU)", "d a"}, |
249 | | - // spa dict: si → s i |
250 | | - {"spa/default", "si", "spa (OpenUTAU)", "s i"}, |
251 | | - // fil dict has only uppercase OO → Q O Q O; lowercase oo → o o |
252 | | - {"fil/default", "oo", "fil (OpenUTAU)", "o o"}, |
253 | | - // deu/marzipan uses IPA-like voc: ja → j a |
254 | | - {"deu/marzipan", "ja", "deu (Marzipan)", "j a"}, |
255 | | - // fra/millefeuille uses different phoneme set; TBD from model |
256 | | - {"fra/millefeuille", "oui", "fra (Millefeuille)", ""}, |
| 233 | + {"eng/default", "hello", "eng", "hh ah l ow"}, |
| 234 | + {"deu/default", "ja", "deu", "y aa"}, |
| 235 | + {"fra/default", "oui", "fra", "ou ii"}, |
| 236 | + {"ita/default", "si", "ita", "s i"}, |
| 237 | + {"kor/default", "가", "kor", "g a"}, |
| 238 | + {"por/default", "sim", "por", "s i~"}, |
| 239 | + {"rus/default", "да", "rus", "d a"}, |
| 240 | + {"spa/default", "si", "spa", "s i"}, |
| 241 | + {"fil/default", "oo", "fil", "o o"}, |
257 | 242 | }; |
258 | 243 | return cases; |
259 | 244 | } |
|
0 commit comments