g2p_barranquenho Barranquenho के लिए पहला ओपन ग्रैफ़ीम-टू-फ़ोनीम कन्वर्टर है, जो पुर्तगाल के बारांकोस में बोली जाने वाली एक इबेरो-रोमांस संपर्क भाषा है — स्पेनिश सीमा पर स्थित एक नगरपालिका जहाँ पुर्तगाली और एक्स्ट्रेमादुरन/आंदालूसियन स्पेनिश सदियों से सह-अस्तित्व में हैं।
बारांकेन्यो ध्वनिविज्ञान की दृष्टि से क्या दिलचस्प बनाता है
बारांकेन्यो न तो पुर्तगाली की और न ही स्पेनिश की एक बोली है; यह वास्तव में एक विशिष्ट प्रणाली है। बारांकोस नगर परिषद ने हाल ही में तीन आधारभूत दस्तावेज़ प्रकाशित किए — एक शब्दकोश, एक वर्तनी सम्मेलन, और एक बुनियादी व्याकरण — जिन्होंने हमें आवश्यक नियम प्रदान किए। घोषणा: “Un Enormi Passu para u Barranquenhu i para a Cultura Barranquenha!”।
उस वर्तनी सम्मेलन से हमने नियम-समूह व्युत्पन्न किया — लेकिन टेक्स्ट पर एक अलग से बनाया गया पास चलाने के बजाय, यह साझा orthography2ipa इंजन में एक भाषा स्पेक, ext-PT-x-barrancos, के रूप में रहता है। उस स्पेक की ग्रैफ़ीम तालिका, एलोफोन नियम, स्ट्रेस मॉडल और क्रॉस-वर्ड सन्धि हर बारांकेन्यो उच्चारण का वर्णन करते हैं: बहु-अक्षर ग्रैफ़ीम्स उसी तरह संक्षिप्त होते हैं जैसा सम्मेलन दस्तावेज़ करता है (tch → /tʃ/, ch → /ʃ/, nh → /ɲ/, lh → /ʎ/), नासिक द्विस्वर m/n से पहले दिखते हैं, v हमेशा /b/ में मैप होता है, और h एक उच्चारित /h/ के रूप में सामने आता है — दोनों मूल भाषाओं के विपरीत।
g2p_barranquenho स्वयं orthography2ipa.G2P के चारों ओर एक पतला कॉलर-साइड रैपर है, जो उस स्पेक द्वारा संचालित होता है: यह टेक्स्ट सामान्यीकरण (केस-फ़ोल्डिंग, स्पेक की अपेक्षित आकृतियों में टोकनाइज़ेशन), संख्या विस्तार, और एक स्थिर phonemize/transcribe सतह का स्वामित्व रखता है, लेकिन ध्वन्यात्मक नियमों का नहीं — किसी नियम में सुधार का अर्थ है स्पेक को अपस्ट्रीम संपादित करना, ताकि हर डाउनस्ट्रीम उपभोक्ता उसी फिक्स को साझा करे।
व्यवहार में:
“Un Enormi Passu para u Barranquenhu i para a Cultura Barranquenha” →
ˈũ eˈnɔɾmi ˈpas̺u ˈpaɾɐ ˈu bɐrɐ̃ˈkɛɲu ˈi ˈpaɾɐ ɐ kuˈltuɾɐ bɐrɐ̃ˈkɛɲɐ
स्रोत PDF (सम्मेलन, शब्दकोश, व्याकरण) रिपॉज़िटरी रूट में कमिट किए गए हैं ताकि नियम अपने स्रोत के विरुद्ध ऑडिट योग्य हों।
आगे क्या आता है
एक G2P कन्वर्टर TTS और ASR कार्य के लिए न्यूनतम पूर्वापेक्षा है। इसके बिना, टेक्स्ट पर प्रशिक्षित एक मॉडल का कोई सैद्धांतिक ध्वन्यात्मक आधार नहीं होता। इसके साथ, बारांकेन्यो आवाज़ मॉडल की राह उसी हाइब्रिड पाइपलाइन का अनुसरण करती है जिसका उपयोग हमने अस्तूरियन और आरागोनी के लिए किया था — बाधा वाणी डेटा है, टूलिंग नहीं।
यदि आपके पास बोली गई बारांकेन्यो की रिकॉर्डिंग हैं या ऐसे वक्ताओं तक पहुँच है जो एक ओपन लाइसेंस के तहत योगदान करने के इच्छुक हैं, तो संपर्क करें। देशी वक्ता की रिकॉर्डिंग, कुछ घंटे भी, एक TTS मॉडल को व्यवहार्य बना देंगी।