Skip to content

Commit 48b260d

Browse files
committed
test(g2p): keep only 9 default languages, drop non-default variants
- Remove eng/plus, deu/marzipan, fra/millefeuille (no official dicts) - Descriptions use ISO 639-3 only (no 'default' suffix in display) - Internal languageId still uses xxx/default for routing
1 parent 1590665 commit 48b260d

1 file changed

Lines changed: 16 additions & 31 deletions

File tree

tests/g2p/tst_multig2p_languages.cpp

Lines changed: 16 additions & 31 deletions
Original file line numberDiff line numberDiff line change
@@ -1,6 +1,6 @@
11
// tst_multig2p_languages.cpp
2-
// Multig2p plugin integration tests covering all languages supported by
3-
// Phonetic-Suite-Multi/modules/Multig2p-Multi.
2+
// Multig2p plugin integration tests covering all 9 default languages
3+
// supported by Phonetic-Suite-Multi/modules/Multig2p-Multi.
44
//
55
// Verifies the chainG2p → multig2p call path by exercising the multig2p
66
// task directly with G2pInputV1 (languageId set per language). This
@@ -223,37 +223,22 @@ namespace {
223223
std::string expectedPron; // expected space-separated phonemes
224224
};
225225

226-
/// All 12 languages supported by Multig2p-Multi, each with the simplest
227-
/// common word to minimize ONNX variance. Language codes are ISO 639-3.
228-
/// expectedPron values come from the dict training data (ChainG2p-*/...txt)
229-
/// and config.json phoneme sets. For ita/default, preprocessor
230-
/// remove_tone_digits strips stress marks (i1 → i).
226+
/// 9 default languages supported by Multig2p-Multi, each with the
227+
/// simplest common word to minimize ONNX variance. Language codes are
228+
/// ISO 639-3; internal key uses xxx/default.
229+
/// expectedPron from ChainG2p-*/...txt dicts + config.json phoneme sets.
230+
/// ita/default preprocessor remove_tone_digits strips stress (i1 → i).
231231
const std::vector<LangCase> &langCases() {
232232
static const std::vector<LangCase> cases = {
233-
// eng/default uses CMU ARPABET: ah (not ax) for schwa
234-
{"eng/default", "hello", "eng (CMU)", "hh ah l ow"},
235-
// eng/plus (ARPABET Plus) uses ax for the reduced schwa
236-
{"eng/plus", "hello", "eng (ARPABET Plus)", "hh ax l ow"},
237-
// deu dict: ja → y aa; voc has y, aa (OpenUTAU format)
238-
{"deu/default", "ja", "deu (OpenUTAU)", "y aa"},
239-
// fra dict: oui → ou ii; voc has ou, ii
240-
{"fra/default", "oui", "fra (OpenUTAU)", "ou ii"},
241-
// ita dict: si → s i1; remove_tone_digits → s i
242-
{"ita/default", "si", "ita (OpenUTAU)", "s i"},
243-
// kor phoneme set uses Latin: syllable 가 → g a
244-
{"kor/default", "", "kor (OpenUTAU)", "g a"},
245-
// por dict: sim → s i~; voc has i~
246-
{"por/default", "sim", "por (OpenUTAU)", "s i~"},
247-
// rus dict uses Latin phonemes: да → d a
248-
{"rus/default", "да", "rus (OpenUTAU)", "d a"},
249-
// spa dict: si → s i
250-
{"spa/default", "si", "spa (OpenUTAU)", "s i"},
251-
// fil dict has only uppercase OO → Q O Q O; lowercase oo → o o
252-
{"fil/default", "oo", "fil (OpenUTAU)", "o o"},
253-
// deu/marzipan uses IPA-like voc: ja → j a
254-
{"deu/marzipan", "ja", "deu (Marzipan)", "j a"},
255-
// fra/millefeuille uses different phoneme set; TBD from model
256-
{"fra/millefeuille", "oui", "fra (Millefeuille)", ""},
233+
{"eng/default", "hello", "eng", "hh ah l ow"},
234+
{"deu/default", "ja", "deu", "y aa"},
235+
{"fra/default", "oui", "fra", "ou ii"},
236+
{"ita/default", "si", "ita", "s i"},
237+
{"kor/default", "", "kor", "g a"},
238+
{"por/default", "sim", "por", "s i~"},
239+
{"rus/default", "да", "rus", "d a"},
240+
{"spa/default", "si", "spa", "s i"},
241+
{"fil/default", "oo", "fil", "o o"},
257242
};
258243
return cases;
259244
}

0 commit comments

Comments
 (0)