Alpha Cephei
شراكة في التعرّف على الكلام تجلب عقودًا من الخبرة في التعرّف الآلي على الكلام (ASR) — الفريق وراء نماذج Vosk وKaldi — إلى أعمالنا في ضبط النماذج الصوتية ومجموعات البيانات.
أعمالنا
أعمالنا مفتوحة المصدر — مكتبات وأدوات حرة وقابلة للاستضافة الذاتية تشمل الذكاء الاصطناعي الصوتي واستخراج البيانات ومجموعات البيانات ومعالجة اللغة الطبيعية والألعاب، إضافة إلى منظومة OpenVoiceOS وHiveMind التي نساهم في بنائها. دون اعتماد قسري، ودون سحابة إلزامية.
إلى جانب الشيفرة، تُنشَر مجموعات بياناتنا ونماذجنا المفتوحة علىHugging Face,وتوجد دفاتر التدريب الخاصة بنا في مستودعml-notebooks.
المجتمع
نساهم مع شركاء مستقلين ونتبرع بالأعمال الممولة من المال العام لمؤسسة OpenVoiceOS.
شراكة في التعرّف على الكلام تجلب عقودًا من الخبرة في التعرّف الآلي على الكلام (ASR) — الفريق وراء نماذج Vosk وKaldi — إلى أعمالنا في ضبط النماذج الصوتية ومجموعات البيانات.
برنامج إسباني يطوّر تقنية اللغة عبر اللغات الرسمية للبلاد (الإسبانية، الكتالانية، الباسكية، الغاليسية). يموّل تطوير OVOS لإنشاء مساعدين صوتيين قابلين للتنزيل يحترمون الخصوصية ويعملون على Raspberry Pi والحواسيب الشخصية. بتمويل من وزارة التحوّل الرقمي الإسبانية وخطة التعافي الأوروبية.
برنامج الإنترنت للجيل القادم التابع للمفوضية الأوروبية (بتمويل مشترك من SERI السويسري) يدعم OpenVoiceOS كبديل مستقر يضع الخصوصية أولًا عن مساعدي الشركات الكبرى الصوتيين. التركيز: دعم متعدد اللغات، وتهيئة المستخدمين، وتثبيت المنصة، والتوثيق.
مؤسسة غير ربحية مستقلة تبني منصة ذكاء اصطناعي صوتي مفتوحة المصدر يقودها المجتمع وتحترم الخصوصية. TigreGótico مساهم أساسي في OpenVoiceOS، ومؤسسها عضو في مجلس إدارة المؤسسة.
استكشف
صفِّ حسب المجال لاستكشاف المزيد — كل شيء مفتوح المصدر.
غلاف Python غير متزامن لواجهات سطر أوامر وكلاء البرمجة (Claude Code، Gemini، opencode، Antigravity) خلف واجهة Provider واحدة — جلسات لقطة واحدة ومتعددة الأدوار، وأحداث بث مُصنّفة الأنواع، وأنماط خط توزيع/تفويض/إعادة محاولة.
التعرّف على الكيانات المسماة باستخدام خوارزمية Aho-Corasick.
تحويل حروف إلى صوتيات للباسكية والإسبانية بلغة Python خالصة، خالٍ من التبعيات ومدرك للإصدارات — يعيد إنتاج واجهة AhoTTS الأمامية بأمانة ويصدر سلسلة IPA أحادية الحرف المُستخدمة لتدريب أصوات StyleTTS2/VITS.
أداة تعمل في المتصفح لمحاذاة الصوت مع نسخ النص وIPA على مستوى الكلمة والحرف والجملة. تعمل بالكامل من جانب العميل، دون خادم ودون تبعيات ودون خطوة بناء.
HTTP مجهول مع تدوير عناوين IP؛ يتكامل مع unblock_requests لإتاحة التدوير مع تجاوز جدران البوتات.
تحويل نص عربي (فصحى) إلى IPA قائم على القواعد مع التشكيل، مبني على orthography2ipa — شجرة رموز حساسة للسياق تعالج إدغام الحروف الشمسية، وهمزة الوصل، والتنوين، والتاء المربوطة، مع تشكيل النص المجرّد أولًا عبر نماذج ONNX مُرفقة.
ابحث وابثّ الكتب الصوتية في الملك العام من LibriVox ومصادر مشابهة.
استعادة الكلام وإزالة الضوضاء وتوسيع النطاق الترددي بتقنية ONNX الخالصة — يرفع الكلام ضيق النطاق إلى 48 كيلوهرتز دون torch أثناء التشغيل.
مكتبة عميل HTTP بسيطة لـ Python — بديل خفيف لـ requests.
إزالة لبس المتجانسات الخطّية المتغايرة النطق في البرتغالية الأوروبية لأجل TTS — يختار النطق الصحيح للكلمات المكتوبة بالطريقة نفسها لكنها تُقرأ بشكل مختلف حسب المعنى (sede = العطش مقابل المقر، forma = القالب مقابل الشكل). قواعد بلغة Python خالصة إضافة إلى نماذج مُتعلّمة، مع مجموعات بيانات مفتوحة.
مُصنِّفات أقسام كلام Brill مُدرَّبة مسبقًا لـ 11 لغة، مُقدَّمة كنماذج pickle جاهزة للاستخدام فوق NLTK — صنِّف النص دون تدريب.
محرّك استدلال قائم على ONNX للذكاء الاصطناعي الحواري.
حزمة Python لجلب معلومات عن الملحنين الكلاسيكيين من Classical Archives.
مُستخرِج كلمات مفتاحية/مصطلحات بحث متعدد اللغات بـ CRF — يستخرج الاستعلام من سؤال بلغة طبيعية عبر CRF فوق سمات POS وكتابية، مع نماذج مُدرَّبة مسبقًا لكل لغة.
التنبؤ بالمشاعر/الرموز التعبيرية DeepMoji بصيغة ONNX.
اكتشف وحوّل بين سبع قواعد إملائية برتغالية — الكتابة الاشتقاقية لما قبل 1911، وإصلاحات 1911/1943/1945/1971/1973، واتفاق الإملاء لعام 1990 بمتغيريه الأوروبي والبرازيلي.
أدوات لتوجيه المحادثات نحو هدف محدد.
بيانات وعمليات مُنظّمة للتعامل مع المشاعر الإنسانية.
إعادة تنفيذ بلغة Python خالصة وخالية من التبعيات لواجهة espeak-ng الأمامية لتحويل الحروف إلى صوتيات — من نص إلى صوتيات فقط، دون امتداد C. يعيد إنتاج ملف espeak-ng الثنائي بايتًا ببايت عبر مسح لـ 86 لغة على مستوى المداخل ومدونة جمل بـ 31 لغة؛ 117 لغة مُرفقة.
محوّل فونيمات باسكي من النص إلى IPA مراعٍ للهجات، مبني على شبكة النطق المشتركة orthography2ipa — مفتوح وقابل للفحص وموثّق المصادر.
تحويل الحروف إلى صوتيات للهجة البارانكينهو.
بروتوكول لبناء شبكات هرمية من الوكلاء — أجهزة تابعة خفيفة تتصل عبر شبكة مشفّرة بأي وكيل محادثة، من OpenVoiceOS إلى شخصيات LLM ووكلاء A2A عشوائيين. تشمل المنظومة بروتوكولات النقل والأقمار الصوتية وجسور الدردشة والتشفير والاكتشاف دون إعداد.
إضافة بروتوكول وكيل A2A لـ hivemind-core — تربط الخلية بخوادم Agent-to-Agent (A2A) خارجية عبر JSON-RPC 2.0، مع بث الردود إلى الأقمار التابعة.
قاعدة بيانات بسيطة بملف JSON لـ Python.
محرّك نوايا خفيف الوزن.
محرّك مطابقة قوالب الكلمات المفتاحية للتعرّف على النوايا.
كاشف لغة بسيط للغاية بلغة Python خالصة قائم على قوائم الكلمات.
انشر قياسات الطاقة والنظام لجهاز Linux/SBC إلى Home Assistant عبر MQTT — المعالج/معالج الرسوميات/الذاكرة/القرص، ودرجات الحرارة، والاختناق، والصوت وMPRIS، وWiFi/Bluetooth — كلها مُكتشفة تلقائيًا. مبني على powerguess.
تحليل الأسئلة وتصنيفها.
توليد نص بسلاسل ماركوف من بيانات JSON.
نماذج سلاسل ماركوف مُصدَّرة إلى ONNX.
فهرسة وتوحيد وإزالة تكرار وتقديم كتالوجات الوسائط من YouTube ومصادر أخرى.
مفردات مشتركة لبيانات الوسائط الوصفية وطبقة تطبيع توحّد كيفية تعيين العناوين والفنانين والمعرّفات عبر عملاء الوسائط وتكاملات Music Assistant.
عملاء بيانات وسائط وصفية مدعومون بـ Pydantic ومُحلِّل كيانات عبر المصادر دون مفاتيح.
مُفوْنِن قائم على القواعد للغة الميرانديزية.
مكتبة تعلّم آلي وشبكات عصبية على غرار scikit-learn تعتمد فقط على numpy وscipy — كُتبت لتُقرأ.
عميل SoundCloud يصدر إصدارات بيانات وسائط وصفية مُصنّفة الأنواع.
منصة مساعد صوتي مفتوحة المصدر يقودها المجتمع وتراعي الخصوصية. TigreGótico مساهم أساسي في المنظومة كاملة — إذ تصون إضافات الكلام وخدمات STT/TTS وأدوات المطورين والعمل الرسمي على المواصفات عبر عشرات المستودعات.
طقم أدوات لنقل البيانات عبر الصوت بلغة Python خالصة — انقل النص والبيانات عبر قناة صوتية (DTMF وغيرها) باستخدام أساسيات WAV/الجيب/Goertzel مشتركة. المخططات الأساسية خالية من التبعيات.
تحويل الحروف إلى IPA وتعيينات الأصوات البديلة لأكثر من 350 لغة عبر أكثر من 20 عائلة — مُقسِّم رموز IPA بأقصى مطابقة، ومقاييس للمسافة الصوتية والكتابية، وتحويلات لهجية، وخلفية G2P قابلة للتوصيل.
إطار تكامل وكلاء لـ OpenVoiceOS — يتيح سير عمل وكيلي مُوجَّه بالصوت.
مراقب ناقل الرسائل لـ OpenVoiceOS — راقب حركة الناقل مباشرةً لتصحيح المهارات والنوايا والخدمات.
إضافة تضمينات متجهية ChromaDB لـ OpenVoiceOS.
إضافة OVOS لتطبيع نص الحوار قبل تركيب TTS (توسيع الأرقام، الاختصارات).
تقطيع المستندات للاسترجاع/RAG في OpenVoiceOS.
إضافة إعادة ترتيب دلالية سريعة لنتائج استعلامات OVOS.
إضافة تضمينات GGUF محلية لـ OpenVoiceOS.
إضافة LLM محلي (GGUF) لـ OpenVoiceOS.
حلّال LLM محلي باستخدام نماذج GGUF في OpenVoiceOS.
منصة توطين أصيلة على GitHub لمهارات وإضافات OpenVoiceOS — أدِر الترجمات بالكامل عبر Git، دون خدمة خارجية تشغّلها.
خط معالجة نوايا Model2Vec لمعالجة النوايا في OpenVoiceOS.
إضافة ChatEngine لـ OVOS تمرر أدوار المحادثة عبر ناقل رسائل OVOS — صِل واجهات الدردشة مباشرة بمساعد قيد التشغيل.
خادم مقاييس بيانات مفتوحة لـ OpenVoiceOS — يجمع مقاييس استخدام مجهولة الهوية وينشرها كمجموعات بيانات مفتوحة؛ طُوِّر ضمن مشروع ILENIA.
حلبة قياس أداء لإضافات OVOS — مواجهات مباشرة بتصنيفات ELO لمقارنة تطبيقات STT وTTS وغيرها من الإضافات على أحمال حقيقية.
إضافة تضمينات قاعدة بيانات المتجهات Qdrant لـ OpenVoiceOS.
إضافة OVOS ASR تستخدم النموذج الصوتي Citrinet، المُدرَّب على بيانات كلام ILENIA.
إضافة OVOS ASR تستخدم نماذج Faster-Whisper المضبوطة من Zuazo للغة الباسكية.
إضافة OVOS ASR للتعرّف على الكلام الباسكي HiTZ.
إضافة OVOS ASR تستخدم Meta MMS للتعرّف على الكلام متعدد اللغات على نطاق واسع.
إضافة OVOS ASR تستخدم نماذج NVIDIA NeMo ASR.
إضافة OVOS ASR للتعرّف على الكلام الغاليسي NOS.
إضافة تحويل الكلام إلى نص لـ OVOS تعتمد على onnx-asr — تعرّف كلام خفيف من نماذج ONNX دون الحاجة إلى torch.
إضافة OVOS ASR تستخدم نماذج wav2vec 2.0 للإسبانية واللغات الرسمية المشتركة.
إضافة OVOS ASR تجمع بين Whisper ونموذج لغوي لتحسين الدقة.
استضف أي إضافة STT من OpenVoiceOS كخدمة شبكية — خادم صغير يوفر تحويل الكلام إلى نص عبر HTTP للأقمار التابعة وعملاء الأطراف الخارجية.
إضافة OVOS TTS لـ AhoTTS، نظام تركيب كلام للغة الباسكية طُوِّر ضمن ILENIA.
إضافة OVOS TTS تغلّف Coqui TTS لأصوات اللغة الإسبانية.
إضافة OVOS TTS لـ Cotovia، محرّك تحويل نص إلى كلام للغة الغاليسية.
إضافة OVOS TTS لتركيب Matxa متعدد المتحدثين للغة الكتالانية.
إضافة OVOS TTS لتركيب الكلام الغاليسي NOS.
استضف أي إضافة TTS من OpenVoiceOS كخدمة — خادم flask بسيط يحول أي إضافة TTS إلى واجهة برمجية لتوليد الكلام مُستضافة ذاتيًا.
استبانة صوتية فائقة لـ TTS في OVOS — يرفع FlashSR الكلام المُصطنع من 16 إلى 48 كيلوهرتز عبر ONNX قبل التشغيل، فيمنح أي صوت قائم وضوحًا أكبر دون إعادة تدريب.
استبانة صوتية فائقة لـ TTS في OVOS — يرفع NovaSR الكلام المُصطنع من 16 إلى 48 كيلوهرتز عبر مُحسِّن FastSR السريع، متجاوزًا الصوت الذي هو أصلًا بجودة 48 كيلوهرتز.
إعداد Docker لـ OpenVoiceOS مع خدمات Wyoming.
إطار اختبار شامل لمهارات OVOS مع بيئة تشغيل خفيفة داخل العملية.
محلّل نوايا بسيط جدًا قائم على الكلمات المفتاحية — بديل مباشر لـ Adapt يطابق العبارات مع خانات كلمات مفتاحية إلزامية/اختيارية؛ وُلد في TigreGótico وأُهدي إلى OpenVoiceOS.
بحث صوتي تقريبي وحساب المسافة بين المقاطع الصوتية.
مكتبة Python للفوننة متعددة اللغات وتحويل النص إلى كلام (TTS) باستخدام نماذج ONNX.
إضافة لقارئ الشاشة NVDA على Windows تنطق عبر أصوات phoonnx العصبية بصيغة ONNX، لتُظهر phoonnx كخلفية TTS للوصولية.
استدلال VITS TTS داخل المتصفح باستخدام onnxruntime-web. مساران عبر Unicode وespeak-ng. دون خادم ودون API.
مُتحكِّم متصفح آلي مبني على Selenium وSelenium Wire — الجلسات، ومعالجة الأحداث، والتفاعل مع العناصر، وإدارة الإضافات للكشط والاختبار حيث لا مفر من متصفح كامل.
قدِّر أو قِس استهلاك الطاقة لجهاز Linux — مكتبة Python خفيفة التبعيات مع توثيق منشأ لكل قراءة (INA219، RAPL، PMIC في Raspberry Pi، البطارية، أو تقدير محدود مُعاير).
منفذ precise-onnx للكشف عن كلمة التنبيه على المتصفح/Node.js. استخراج ملامح MFCC وكشف قائم على ONNX متوافق مع نماذج Precise بصيغة .onnx.
حلّ الإحالة المرجعية عبر أقسام كلام الضمائر واستدلالات جنس الكلمات.
كاشط Bandcamp يصدر إصدارات بيانات وسائط وصفية مُصنّفة الأنواع.
عميل HTTP بلغة Python وجسر mediavocab لخادم Music Assistant — طبقة النقل والتحويل المشتركة خلف تكامل OVOS مع Music Assistant.
مكتبة Python لتركيب الكلام AhoTTS.
منفذ Python لـ AhoTTS Iparrahotsa، محرّك تحويل نص إلى كلام للباسكية الشمالية (القارّية) — نظير لهجة إيبارالدي لـ pyAhoTTS، مع hts_engine ومُرمِّز AhoCoder الصوتي. طُوِّر مع Aholab (UPV/EHU).
عميل Python مُصنّف الأنواع لـ Classical Archives.
منفذ بلغة Python خالصة لواجهة G2P الأمامية لـ Cotovia للغتين الغاليسية والإسبانية. يعيد إنتاج التقطيع المقطعي والنبر والنسخ في الملف الثنائي المُترجَم بلغة C دون عملية فرعية.
عميل Python متدفق لملفات بيانات Discogs الشهرية.
عميل Python مُصنّف الأنواع ومُصدِّر مجموعة بيانات بصيغة markdown لـ Erowid (erowid.org).
منفذ بلغة Python خالصة لمحرّك الاستنتاج EYE N3 — أدخِل حقائق وقواعد Notation3 فيستنتج حقائق جديدة عبر التسلسل الأمامي/الخلفي، وRDFS، واستنتاج OWL 2 RL، وأشجار البرهان، وأكثر من 280 دالة مدمجة. تبعية واحدة (rdflib).
عميل كشط لموقع fanedit.org / IFDB.
غلاف Python لمحرّك خيال تفاعلي.
عميل Python لـ Project Gutenberg — بيانات الكتب الوصفية عبر الكتالوج المفتوح.
عميل API لـ iHeartRadio.
منفذ بلغة Python خالصة لـ HermiT، مُستنتج OWL 2 DL من أكسفورد — الاتساق والتصنيف واسترجاع النسخ عبر جدول فرط-الحل، دون JVM ودون تبعيات تشغيل.
عميل بيانات وصفية بلغة Python لـ IMDb. يحوّل الاستعلامات النصية الحرة إلى عناوين IMDb المعيارية.
عميل Python مُصنّف الأنواع لـ Infopédia، قاموس Porto Editora للبرتغالية الأوروبية — يحلّل كل مدخل إلى نطق IPA وتقطيع مقطعي وأصل واشتقاق ومعانٍ، مع فصل صحيح للمتجانسات المتغايرة النطق لأجل أعمال G2P وإزالة اللبس.
حزمة Python للتفاعل مع InspiroBot (inspirobot.me).
عميل Python مُصنّف الأنواع لـ Jazz Music Archives.
عميل Python لـ LiveATC.net — اكتشف وابثّ وأرشِف بثوث مراقبة الحركة الجوية الحية والتاريخية، مع تصدير مجموعات بيانات لتدريب ASR.
كاشط / عميل API لـ MyAnimeList — الأنمي والمانغا.
عميل API لـ Encyclopaedia Metallum (Metal Archives).
عميل بيانات وصفية بلغة Python لـ MusicBrainz — موسوعة الموسيقى المفتوحة.
عميل Python مُصنّف الأنواع لـ Portal da Lingua Portuguesa.
عميل Python مُصنّف الأنواع لـ Prog Archives.
عميل Python مُصنّف الأنواع ومُصدِّر مجموعة بيانات بصيغة markdown لـ PsychonautWiki (psychonautwiki.org).
كاشط HTML بلغة Python لموقع rateyourmusic.com.
كاشط Python لموقع romhacking.net (RHDN) — قاعدة بيانات المجتمع لقرصنة ROM، وترجمات المعجبين، وأدوات الترقيع، والوثائق.
عميل Python وحداتي غير متزامن لواجهة Shazam API، مبني على shazamio_core لبصمة صوتية متينة.
عميل Python لواجهة smwcentral.net العامة بصيغة JSON — وصول مُقسّم إلى صفحات لكتالوج قرصنة ROM لـ Super Mario World / SM64 / Yoshi's Island.
عميل صحائف حقائق المخدرات ومصفوفة التفاعلات من TripSit (الحد من الأضرار).
كاشط HTML بلغة Python لموقع PmWiki الخاص بـ tvtropes.org.
عميل Python لـ VNDB (قاعدة بيانات الروايات المرئية) عبر واجهة kana العامة بصيغة JSON.
عميل Python لـ WikiHow.
عميل Python مُصنّف الأنواع لواجهة MediaWiki API لـ Wiktionary الإنجليزي.
عميل مُجمِّع متعدد اللغات لكلمة اليوم.
عميل SomaFM يصدر إصدارات بيانات وسائط وصفية مُصنّفة الأنواع.
تنفيذ لخوارزمية الاستخراج الآلي السريع للكلمات المفتاحية (RAKE).
مكتبة إعداد صوتي تلقائي لـ raspOVOS — تكتشف بطاقات الصوت ولوحات HAT وأجهزة USB على Raspberry Pi وتهيئها لاستخدام المساعد الصوتي؛ طُوِّرت ضمن مشروع ILENIA.
عميل مُعيد إرسال بريد مجهول مع دعم بروتوكولي Cypherpunk وMixmaster.
نواة خالية من التبعيات للنصوص وترميزات الفونيمات — كشف ISO-15924، وتحويل IPA ↔ ARPABET/X-SAMPA/Kirshenbaum/Cotovía، وBuckwalter ↔ العربية، وهانغل ← جامو، وكانا.
جسر بحاوية Docker يبصم صوت الغرفة عبر Shazam وينشر بيانات المقطوعة الوصفية (العنوان، الفنان، الغلاف، الكلمات، روابط Apple Music / Spotify / Deezer) إلى MQTT مع الاكتشاف التلقائي في Home Assistant.
أداة تقطيع مقطعي للنصوص البرتغالية.
تعرّف بسيط على الكيانات المسماة قائم على القواعد.
أداة استطلاع للمواقع لفهم بنية الموقع قبل بناء الكاشطات. تُخطِّط robots.txt وخرائط الموقع وشبكات الروابط باستخدام طبقة نقل unblock_requests لاستكشاف مرن للمواقع المحمية أو المعقدة.
مُفوْنِن للهجات البرتغالية الأوروبية الإقليمية.
مكتبة تضمين المتحدث بـ onnxruntime خالص — استخرج تضمينات المتحدث، واحسب تشابه جيب التمام، وتحقّق من هوية المتحدث من نماذج ONNX، دون أي PyTorch عند التشغيل.
مقاييس موحدة لتقييم الكلام — MOS عصبي (UTMOS وNISQA وSIGMOS وDNSMOS) ومقاييس تدخلية (STOI وSI-SDR وMCD) وASR (WER/CER) — باستخدام numpy وonnxruntime فقط.
خدمة تراقب نقاط تركيب SSHFS/rclone وتعيد تركيبها تلقائيًا عند انقطاعها — مع لوحة تحكم ويب حية، وREST API، ومقاييس Prometheus، وخطافات ويب، ومهام مزامنة rsync/rclone مجدولة.
تحديد النبر اللفظي متعدد اللغات لواجهات تحويل النص إلى كلام، باستخدام onnxruntime وnumpy فقط.
مكتبة Python موحّدة للطقس متعددة المزوّدين. استعلم من OpenWeatherMap وOpen-Meteo وMetNo وIPMA وNWS وغيرها عبر واجهة API واحدة متسقة.
تشكيل عربي خفيف — واجهة صغيرة واحدة فوق نماذج ONNX قابلة للتبادل تستعيد علامات التشكيل الناقصة، دون PyTorch وتعمل دون اتصال افتراضيًا. تُشغّل خطوة التشكيل في arbtok.
معالج معجمي وأداة لغوية للهجات البرتغالية.
مُحلِّل صرفي قائم على القواعد للبرتغالية — يقسّم الكلمات إلى مورفيمات.
أدوات تحويل الحروف إلى صوتيات للغة البرتغالية.
مُصنِّف أقسام الكلام (POS) خفيف للبرتغالية.
كاشط راديو TuneIn يصدر إصدارات بيانات وسائط وصفية مُصنّفة الأنواع.
كاشط YouTube خفيف يصدر إصدارات بيانات وسائط وصفية مُصنّفة الأنواع.
فئة فرعية من requests.Session تتجاوز Cloudflare (انتحال curl_cffi، وFlareSolverr، والرجوع إلى Wayback) — طبقة النقل المضادة للبوتات خلف كاشطاتنا.
قارئ USENET حي وكاشط مقالات لأبحاث البروتوكولات البديلة والأرشفة.
جسر للكشف عن النشاط الصوتي في الوقت الحقيقي باستخدام ovos-plugin-manager. ينشر احتمال الكلام (0–100٪) ومستوى الضوضاء (dB) ومستشعرًا ثنائيًا مُثبّتًا لاكتشاف الكلام إلى MQTT — مع الاكتشاف التلقائي في Home Assistant.
الكشف عن النشاط الصوتي بطريقة ONNX — حمّل أي نموذج VAD خلف واجهة تدفق واحدة ببيئة تشغيل صغيرة (numpy وonnxruntime). نظير VAD لـ phoonnx؛ معظم الخلفيات بيانات لا شيفرة.
تحويل صوت متعدد المحركات بـ ONNX خالص — أعِد تشكيل أي كلام إلى صوت متحدث مرجعي دون أي PyTorch عند الاستدلال. 14 محركًا (kNN-VC، FreeVC، OpenVoice، RVC، CosyVoice…) خلف واجهة VoiceCloner واحدة، إضافة إلى CLI وبنى INT8.
مدرِّب لنماذج كلمات التنبيه طُوِّر بمنحة من NLnet لصالح OpenVoiceOS — ابنِ كلمات تنبيه مخصصة تعمل على الجهاز من عيّناتك الخاصة.
تطبيق ويب بـ Flask لوسم صوت كلمات التنبيه يدويًا — شغّل كل مقطع ووسم الكلمة وجنس المتحدث ونوع الضوضاء، محتفظًا بمجموعة جاهزة للتدريب أو التقييم.
خدمة ASR من OpenVoiceOS لبروتوكول Wyoming — تعرّف خفيف على الكلام.
خدمة TTS من OpenVoiceOS لبروتوكول Wyoming — تحويل خفيف للنص إلى كلام.
خدمة كشف كلمة التنبيه من OpenVoiceOS لبروتوكول Wyoming.
عميل Python وحداتي غير متزامن لواجهة Shazam API — بصمة صوتية عبر shazamio-core مع نماذج Track/Artist مُصنّفة الأنواع وكاشط كتالوج.
مكتبة ترميز ثنائي إلى نص مدمجة (Base91 وZ85B وZ85P) — تطبيقات C سريعة مع بدائل بايثون خالصة، وكلها أكثر إحكامًا من base64.