Alpha Cephei
یک مشارکت در حوزه تشخیص گفتار که دههها تخصص تشخیص خودکار گفتار (ASR) را — تیم پشت مدلهای مبتنی بر Vosk و Kaldi — به کار تنظیم دقیق مدلهای صوتی و دیتاستهای ما میآورد.
نمونهکارها
کار متنباز ما — کتابخانهها و ابزارهای FOSS و قابل میزبانی شخصی که هوش مصنوعی صدا، استخراج داده، مجموعهدادهها، NLP و بازیها را در بر میگیرند، بهعلاوه اکوسیستم OpenVoiceOS و HiveMind که به ساخت آن کمک میکنیم. بدون وابستگی اجباری، بدون ابر الزامی.
فراتر از کد، مجموعهدادهها و مدلهای باز ما منتشر شدهاند درHugging Face,و نوتبوکهای آموزشی ما در مخزنml-notebooksقرار دارند.
جامعه
ما در پروژههای شرکای مستقل مشارکت میکنیم و کارهای دارای بودجه عمومی را به بنیاد OpenVoiceOS اهدا میکنیم.
یک مشارکت در حوزه تشخیص گفتار که دههها تخصص تشخیص خودکار گفتار (ASR) را — تیم پشت مدلهای مبتنی بر Vosk و Kaldi — به کار تنظیم دقیق مدلهای صوتی و دیتاستهای ما میآورد.
برنامهای اسپانیایی که فناوری زبان را در سراسر زبانهای رسمی کشور (اسپانیایی، کاتالان، باسکی، گالیسیایی) پیش میبرد. تأمین مالی توسعه OVOS برای ساخت دستیارهای صوتی قابلدانلود و محترم به حریم خصوصی که روی Raspberry Pi و رایانههای شخصی اجرا میشوند. تأمین مالی از سوی وزارت تحول دیجیتال اسپانیا و طرح بازیابی اتحادیه اروپا.
برنامه اینترنت نسل بعد (Next Generation Internet) کمیسیون اروپا (با همتأمین مالی SERI سوئیس) که از OpenVoiceOS بهعنوان جایگزینی پایدار و حریمخصوصیمحور برای دستیارهای صوتی شرکتهای بزرگ فناوری پشتیبانی میکند. تمرکز: پشتیبانی چندزبانه، آشناسازی کاربر، پایدارسازی بستر و مستندسازی.
یک بنیاد غیرانتفاعی مستقل که یک بستر هوش مصنوعی صوتی متنباز، جامعهمحور و محترم به حریم خصوصی میسازد. TigreGótico یکی از مشارکتکنندگان اصلی OpenVoiceOS است و بنیانگذار آن عضو هیئتمدیرهٔ بنیاد است.
کاوش
برای کاوش بیشتر بر اساس حوزه فیلتر کنید — همه چیز متنباز است.
روکش پایتون ناهمگام برای CLIهای عامل کدنویسی (Claude Code، Gemini، opencode، Antigravity) پشت یک API واحد Provider — نشستهای یکباره و چندنوبتی، رویدادهای جریانی نوعدار و الگوهای خطلوله fan-out/delegate/retry.
شناسایی موجودیت نامدار با استفاده از الگوریتم Aho-Corasick.
گرافم به واج کاملاً پایتونی، بدون وابستگی و آگاه از نسخه برای باسکی و اسپانیایی — فرانتاند AhoTTS را وفادارانه بازتولید میکند و رشته IPA تکنویسهای مورد استفاده برای آموزش صداهای StyleTTS2/VITS را تولید میکند.
ابزاری مرورگری برای همترازسازی صوت با رونویسی متن و IPA در سطح واژه، گرافم و جمله. کاملاً سمت کاربر اجرا میشود، بدون سرور، بدون وابستگی و بدون گام ساخت.
HTTP ناشناس با چرخش IP؛ برای چرخش بههمراه دور زدن دیوار ربات با unblock_requests ترکیب میشود.
تبدیل متن عربی (MSA) به IPA مبتنی بر قاعده با اعرابگذاری تشکیل، ساختهشده بر پایه orthography2ipa — یک درخت توکن حساس به بافت، همگونی حروف شمسی، همزهٔ وصل، تنوین و تاء مربوطه را مدیریت میکند و ابتدا متن بدون اعراب را از طریق مدلهای همراه ONNX اعرابگذاری میکند.
جستوجو و پخش کتابهای صوتی مالکیتعمومی از LibriVox و منابع مشابه.
بازسازی گفتار، حذف نویز و گسترش پهنای باند با ONNX خالص — گفتار باند باریک را بدون torch در زمان اجرا به ۴۸ کیلوهرتز ارتقا میدهد.
کتابخانه کلاینت HTTP کمینه برای پایتون — جایگزینی سبک برای requests.
ابهامزدایی همنگارههای ناهمگویه در پرتغالی اروپایی برای TTS — تلفظ درست واژههایی را که یکسان نوشته میشوند اما بر پایه معنا متفاوت خوانده میشوند برمیگزیند (sede = تشنگی در برابر مقر، forma = قالب در برابر شکل). قواعد کاملاً پایتونی بههمراه مدلهای یادگرفته و دیتاستهای باز.
برچسبزنهای نقش دستوری Brill از پیش آموزشدیده برای ۱۱ زبان، عرضهشده بهصورت مدلهای آماده pickled روی NLTK — متن را بدون آموزش برچسب بزنید.
موتور استنتاج مبتنی بر ONNX برای هوش مصنوعی مکالمهای.
بستهٔ پایتون برای دریافت اطلاعات دربارهٔ آهنگسازان کلاسیک از Classical Archives.
استخراجگر چندزبانهٔ کلیدواژه/عبارت جستوجو مبتنی بر CRF — پرسوجو را از یک پرسش زبان طبیعی با CRF روی ویژگیهای POS و خطی استخراج میکند، با مدلهای از پیش آموزشدیدهٔ هر زبان.
پیشبینی احساس/ایموجی DeepMoji در ONNX.
تشخیص و تبدیل میان هفت هنجار املایی پرتغالی — نگارش ریشهشناختی پیش از ۱۹۱۱، اصلاحات ۱۹۱۱/۱۹۴۳/۱۹۴۵/۱۹۷۱/۱۹۷۳ و Acordo Ortográfico سال ۱۹۹۰ با زیرگونههای اروپایی و برزیلی آن.
ابزارهایی برای هدایت گفتوگوها به سمت یک هدف.
دادهها و عملیات ساختارمند برای کار با احساسات انسانی.
بازپیادهسازی کاملاً پایتونی و بدون وابستگی از فرانتاند گرافم به واج espeak-ng — تنها متن به واج، بدون افزونه C. باینری espeak-ng را بایتبهبایت در یک پیمایش سرواژهٔ ۸۶ زبانی و یک پیکرهٔ جملهای ۳۱ زبانی بازتولید میکند؛ ۱۱۷ زبان همراه.
واجنگار باسکی متن به IPA با پشتیبانی از گویشها، ساختهشده بر شبکهٔ تلفظ مشترک orthography2ipa — باز، قابل بررسی و با ذکر منابع.
گرافم به واج برای زبان بارانکنیو.
پروتکلی برای ساخت شبکههای سلسلهمراتبی از عاملها — دستگاههای ماهوارهای سبک از طریق مش رمزگذاریشده به هر عامل گفتوگویی متصل میشوند؛ از OpenVoiceOS تا شخصیتهای LLM و عاملهای دلخواه A2A. اکوسیستم شامل پروتکلهای انتقال، ماهوارههای صوتی، پلهای چت، رمزنگاری و کشف بدون پیکربندی است.
افزونهٔ پروتکل عامل A2A برای hivemind-core — کندو را از طریق JSON-RPC 2.0 به سرورهای خارجی Agent-to-Agent (A2A) متصل کرده و پاسخها را به ماهوارهها بازپخش میکند.
یک پایگاهدادهٔ سادهٔ مبتنی بر فایل JSON برای پایتون.
یک موتور قصد سبک.
موتور تطبیق الگوی کلیدواژه برای تشخیص قصد.
تشخیصدهندهٔ زبان بسیار ساده و کاملاً پایتونی مبتنی بر فهرست واژگان.
انتشار سنجههای توان و سیستم یک دستگاه لینوکس/SBC به Home Assistant از طریق MQTT — پردازنده/گرافیک/رم/دیسک، دما، محدودسازی، صدا + MPRIS، وایفای/بلوتوث — همه با کشف خودکار. ساختهشده بر پایه powerguess.
تجزیه و دستهبندی پرسشها.
تولید متن با زنجیره مارکوف از دادههای JSON.
مدلهای زنجیره مارکوف صادرشده به ONNX.
نمایهسازی، متعارفسازی، حذف تکراریها و ارائه کاتالوگهای رسانه از YouTube و منابع دیگر.
یک واژگان مشترک فرادادهٔ رسانه و لایه هنجارسازی که نحوه نگاشت عنوانها، هنرمندان و شناسهها را در میان کلاینتهای رسانه و یکپارچهسازیهای Music Assistant یکسان میکند.
کلاینتهای فرادادهٔ رسانه مبتنی بر Pydantic و یک حلگر موجودیت میانمنبعی بدون کلید.
واجنگار مبتنی بر قاعده برای زبان میراندی.
کتابخانهٔ یادگیری ماشین و شبکهٔ عصبی به سبک scikit-learn تنها با وابستگی به numpy و scipy — نوشتهشده برای خوانده شدن.
کلاینت SoundCloud که انتشارهای فرادادهٔ رسانهٔ نوعدار تولید میکند.
سکوی دستیار صوتی متنباز، اجتماعمحور و حریمخصوصیمحور. TigreGótico مشارکتکنندهٔ اصلی کل اکوسیستم است — با نگهداری افزونههای گفتار، سرویسهای STT/TTS، ابزارهای توسعه و کار رسمی مشخصات در دهها مخزن.
جعبهابزار انتقال داده روی صوت بهصورت کاملاً پایتونی — انتقال متن و داده از طریق یک کانال صوتی (DTMF و بیشتر) با استفاده از پایههای مشترک WAV/سینوسی/Goertzel. طرحهای اصلی بدون وابستگی هستند.
نگاشت گرافم به IPA و آلوفون برای بیش از ۳۵۰ زبان از بیش از ۲۰ خانواده زبانی — یک توکنایزر IPA با بیشینهگیری، معیارهای فاصله واجشناختی و خطی، دگرگونیهای گویشی و یک بکاند G2P افزونهپذیر.
چارچوب یکپارچهسازی عامل برای OpenVoiceOS — امکان جریانهای کاری عاملی صوتمحور.
مانیتور گذرگاه پیام برای OpenVoiceOS — ترافیک گذرگاه را زنده تماشا کنید تا مهارتها، نیتها و سرویسها را اشکالزدایی کنید.
افزونه تعبیههای برداری ChromaDB برای OpenVoiceOS.
افزونه OVOS برای هنجارسازی متن گفتوگو پیش از سنتز TTS (بسط اعداد، مخففها).
بخشبندی سند برای بازیابی/RAG در OpenVoiceOS.
افزونه بازرتبهبندی معنایی سریع برای نتایج پرسوجوی OVOS.
افزونه تعبیههای محلی GGUF برای OpenVoiceOS.
افزونه LLM محلی (GGUF) برای OpenVoiceOS.
حلگر LLM محلی با استفاده از مدلهای GGUF در OpenVoiceOS.
یک بستر بومیسازی مبتنی بر GitHub برای مهارتها و افزونههای OpenVoiceOS — مدیریت کامل ترجمهها از طریق Git، بدون نیاز به هیچ سرویس بیرونی.
خطلوله قصد Model2Vec برای مدیریت قصد در OpenVoiceOS.
افزونهٔ ChatEngine در OVOS که نوبتهای گفتوگو را از طریق گذرگاه پیام OVOS عبور میدهد — رابطهای چت را مستقیم به دستیارِ در حال اجرا وصل کنید.
سرور سنجههای دادهٔ باز برای OpenVoiceOS — سنجههای استفادهٔ ناشناس را گردآوری و بهصورت مجموعهدادههای باز منتشر میکند؛ در چارچوب پروژهٔ ILENIA توسعه یافته است.
میدان محکزنی افزونههای OVOS — رقابتهای رودررو با رتبهبندی ELO برای مقایسهٔ پیادهسازیهای STT، TTS و دیگر افزونهها روی بارهای واقعی.
افزونه تعبیههای پایگاهداده برداری Qdrant برای OpenVoiceOS.
افزونه ASR اوواس با استفاده از مدل صوتی Citrinet، آموزشدیده روی دادههای گفتاری ILENIA.
افزونه ASR اوواس با استفاده از مدلهای Faster-Whisper تنظیمشدهٔ Zuazo برای باسکی.
افزونه ASR اوواس برای تشخیص گفتار باسکی HiTZ.
افزونه ASR اوواس با استفاده از تشخیص گفتار چندزبانه گستردهٔ Meta MMS.
افزونه ASR اوواس با استفاده از مدلهای ASR انویدیا NeMo.
افزونه ASR اوواس برای تشخیص گفتار گالیسیایی NOS.
افزونهٔ گفتار به متن OVOS بر پایهٔ onnx-asr — بازشناسی گفتار سبک با مدلهای ONNX، بدون نیاز به torch.
افزونه ASR اوواس با استفاده از مدلهای wav2vec 2.0 برای اسپانیایی و زبانهای همرسمی.
افزونه ASR اوواس که Whisper را با یک مدل زبانی برای دقت بهتر ترکیب میکند.
هر افزونهٔ STT در OpenVoiceOS را بهصورت سرویس شبکه میزبانی کنید — سروری کوچک که گفتار به متن را از طریق HTTP در اختیار ماهوارهها و کلاینتهای ثالث میگذارد.
افزونه TTS اوواس برای AhoTTS، یک سیستم سنتز گفتار باسکی که تحت ILENIA ساخته شده است.
افزونه TTS اوواس که Coqui TTS را برای صداهای اسپانیاییزبان دربر میگیرد.
افزونه TTS اوواس برای Cotovia، یک موتور تبدیل متن به گفتار گالیسیایی.
افزونه TTS اوواس برای سنتز چندگوینده کاتالان Matxa.
افزونه TTS اوواس برای سنتز گفتار گالیسیایی NOS.
هر افزونهٔ TTS در OpenVoiceOS را بهصورت سرویس میزبانی کنید — سرور سادهٔ flask که هر افزونهٔ TTS را به یک API خودمیزبان تولید گفتار تبدیل میکند.
فراتفکیک صوتی برای TTS در OVOS — FlashSR گفتار ساختهشده را پیش از پخش از طریق ONNX از ۱۶ به ۴۸ کیلوهرتز ارتقا میدهد و هر صدای موجود را بدون بازآموزی شفافتر میکند.
فراتفکیک صوتی برای TTS در OVOS — NovaSR گفتار ساختهشده را با ارتقادهندهٔ سریع FastSR از ۱۶ به ۴۸ کیلوهرتز میرساند و صدای ۴۸ کیلوهرتزی را دستنخورده میگذارد.
پیکربندی Docker برای OpenVoiceOS با سرویسهای Wyoming.
چارچوب آزمون سرتاسری برای مهارتهای OVOS با یک زمان اجرای سبک درونفرایندی.
تجزیهگر نیت مبتنی بر کلیدواژه، بسیار ساده — جایگزین مستقیم Adapt که گفتهها را با خانههای کلیدواژهٔ الزامی/اختیاری تطبیق میدهد؛ در TigreGótico زاده شد و به OpenVoiceOS اهدا گردید.
جستوجوی فازی آوایی و فاصله قطعه به قطعه.
یک کتابخانه پایتون برای واجنگاری چندزبانه و تبدیل متن به گفتار (TTS) با استفاده از مدلهای ONNX.
افزونه صفحهخوان NVDA ویندوز که از طریق صداهای عصبی ONNX phoonnx صحبت میکند و phoonnx را بهعنوان یک بکاند TTS دسترسپذیری نشان میدهد.
استنتاج VITS TTS درونمرورگری با onnxruntime-web. مسیرهای Unicode و espeak-ng. بدون سرور، بدون API.
کنترلگر خودکار مرورگر ساختهشده بر پایه Selenium و Selenium Wire — نشستها، مدیریت رویداد، تعامل با عناصر و مدیریت افزونه برای اسکراپینگ و آزمون در جایی که یک مرورگر کامل اجتنابناپذیر است.
برآورد یا اندازهگیری مصرف توان یک دستگاه لینوکسی — یک کتابخانه پایتون کموابستگی با منشأ برای هر خوانش (INA219، RAPL، PMIC رزبری پای، باتری، یا یک برآورد کراندار کالیبرهشده).
نسخه مرورگر/Node.js از تشخیص واژه بیدارباش precise-onnx. استخراج ویژگی MFCC + تشخیص مبتنی بر ONNX سازگار با مدلهای Precise با پسوند .onnx.
حل ارجاع مشترک از طریق نقش دستوری ضمیر و اکتشافیهای جنسیت واژه.
اسکراپر Bandcamp که انتشارهای فرادادهٔ رسانهٔ نوعدار تولید میکند.
کلاینت HTTP پایتون و پل mediavocab برای یک سرور Music Assistant — لایه انتقال و تبدیل مشترک پشت یکپارچهسازی Music Assistant در OVOS.
کتابخانه پایتون برای سنتز تبدیل متن به گفتار AhoTTS.
نسخه پایتونی AhoTTS Iparrahotsa، یک موتور تبدیل متن به گفتار برای باسکی شمالی (قارهای) — همتای گویش Iparralde برای pyAhoTTS، با hts_engine و وکودر AhoCoder. ساختهشده با Aholab (UPV/EHU).
کلاینت پایتون نوعدار برای Classical Archives.
نسخه کاملاً پایتونی از فرانتاند G2P کوتوویا برای گالیسیایی و اسپانیایی. خطلوله هجابندی، تکیه و آوانگاری باینری کامپایلشده C را بدون زیرفرایند بازتولید میکند.
کلاینت پایتون جریانی برای دامپهای دادهٔ ماهانه Discogs.
کلاینت پایتون نوعدار + دامپر دیتاست مارکداون برای Erowid (erowid.org).
نسخه کاملاً پایتونی از موتور استدلال EYE N3 — به آن حقایق و قواعد Notation3 بدهید و حقایق تازه را از طریق زنجیرهسازی رو به جلو/عقب، استلزام RDFS و OWL 2 RL، درختهای اثبات و بیش از ۲۸۰ درونساخت استنتاج میکند. یک وابستگی (rdflib).
کلاینت اسکراپینگ برای fanedit.org / IFDB.
روکش پایتون برای یک موتور داستان تعاملی.
کلاینت پایتون برای Project Gutenberg — فرادادهٔ کتاب از طریق کاتالوگ باز.
کلاینت API iHeartRadio.
نسخه کاملاً پایتونی از HermiT، استدلالگر OWL 2 DL از آکسفورد — سازگاری، طبقهبندی و بازیابی نمونه از طریق یک جدول هایپررزولوشن، بدون JVM و بدون هیچ وابستگی زمان اجرا.
کلاینت فرادادهٔ پایتون برای IMDb. پرسوجوهای متن آزاد را به عنوانهای متعارف IMDb حل میکند.
کلاینت پایتون نوعدار برای Infopédia، فرهنگ لغت پرتغالی اروپایی Porto Editora — هر مدخل را به تلفظهای IPA، هجابندی، ریشهشناسی و معانی تجزیه میکند و همنگارههای ناهمگویه را برای کار G2P و ابهامزدایی بهدرستی جدا میکند.
یک بستهٔ پایتون برای تعامل با InspiroBot (inspirobot.me).
کلاینت پایتون نوعدار برای Jazz Music Archives.
کلاینت پایتون برای LiveATC.net — کشف، پخش و بایگانی خوراکهای صوتی زنده و تاریخی کنترل ترافیک هوایی، با صدور دیتاست برای آموزش ASR.
اسکراپر / کلاینت API برای MyAnimeList — انیمه و مانگا.
کلاینت API برای Encyclopaedia Metallum (Metal Archives).
کلاینت فرادادهٔ پایتون برای MusicBrainz — دانشنامهٔ باز موسیقی.
کلاینت پایتون نوعدار برای Portal da Lingua Portuguesa.
کلاینت پایتون نوعدار برای Prog Archives.
کلاینت پایتون نوعدار + دامپر دیتاست مارکداون برای PsychonautWiki (psychonautwiki.org).
اسکراپر HTML پایتون برای rateyourmusic.com.
اسکراپر پایتون برای romhacking.net (RHDN) — پایگاهداده جامعهای ROM هکها، ترجمههای هواداری، ابزارهای وصله و مستندات.
یک کلاینت پایتون ماژولار و ناهمگام برای API Shazam، ساختهشده بر پایه shazamio_core برای انگشتنگاری صوتی تابآور.
کلاینت پایتون برای API عمومی JSON سایت smwcentral.net — دسترسی صفحهبندیشده به کاتالوگ ROM-هکینگ Super Mario World / SM64 / Yoshi's Island.
کلاینت برگههای اطلاعاتی مواد TripSit + ماتریس تداخل (کاهش آسیب).
اسکراپر HTML پایتون برای PmWiki سایت tvtropes.org.
کلاینت پایتون برای API عمومی JSON کانای VNDB (پایگاهدادهٔ رمان تصویری).
کلاینت پایتون برای WikiHow.
کلاینت پایتون نوعدار برای API مدیاویکی Wiktionary انگلیسی.
کلاینت گردآورندهٔ چندزبانهٔ واژهٔ روز.
کلاینت SomaFM که انتشارهای فرادادهٔ رسانهٔ نوعدار تولید میکند.
پیادهسازی استخراج خودکار سریع کلیدواژه (Rapid Automatic Keyword Extraction).
کتابخانهٔ پیکربندی خودکار صدا برای raspOVOS — کارتهای صدا، HATها و دستگاههای USB را روی Raspberry Pi شناسایی و برای دستیار صوتی آماده میکند؛ در چارچوب پروژهٔ ILENIA توسعه یافته است.
کلاینت بازپستکنندهٔ ایمیل ناشناس با پشتیبانی از پروتکلهای Cypherpunk و Mixmaster.
هستهٔ بدون وابستگی برای خطها و نشانهگذاری واجی — تشخیص ISO-15924، تبدیل IPA ↔ ARPABET/X-SAMPA/Kirshenbaum/Cotovía، بوکوالتر ↔ عربی، هانگول ← جامو، کانا.
پل داکرشده که صدای اتاق را با Shazam انگشتنگاری میکند و فرادادهٔ آهنگ (عنوان، هنرمند، تصویر جلد، متن ترانه، لینکهای Apple Music / Spotify / Deezer) را با کشف خودکار Home Assistant به MQTT منتشر میکند.
ابزار هجابندی متن پرتغالی.
شناسایی موجودیت نامدار سادهٔ مبتنی بر قاعده.
ابزار شناسایی سایت برای درک ساختار سایت پیش از ساخت اسکراپرها. با استفاده از لایه انتقال unblock_requests، robots.txt، سایتمپها و گرافهای پیوند را برای کاوش تابآور سایتهای محافظتشده یا پیچیده نگاشت میکند.
واجنگار برای لهجههای منطقهای پرتغالی اروپایی.
کتابخانه تعبیه گوینده کاملاً onnxruntime — استخراج تعبیههای گوینده، محاسبه شباهت کسینوسی و تأیید هویت گوینده از مدلهای ONNX، بدون PyTorch در زمان اجرا.
معیارهای یکپارچهٔ ارزیابی گفتار — MOS عصبی (UTMOS، NISQA، SIGMOS، DNSMOS)، معیارهای مداخلهای (STOI، SI-SDR، MCD) و ASR (WER/CER) — تنها با numpy و onnxruntime.
یک دیمن که اتصالهای SSHFS/rclone را پایش میکند و هنگام قطع شدن بهطور خودکار دوباره آنها را متصل میکند — با یک داشبورد وب زنده، REST API، متریکهای Prometheus، وبهوکها و کارهای زمانبندیشدهٔ همگامسازی rsync/rclone.
جایگذاری تکیهٔ واژگانی چندزبانه برای فرانتاندهای TTS، تنها با onnxruntime و numpy.
کتابخانه انتزاعی یکپارچهٔ چندارائهدهندهٔ آبوهوا برای پایتون. OpenWeatherMap، Open-Meteo، MetNo، IPMA، NWS و بیشتر را از طریق یک API یکدست پرسوجو کنید.
اعرابگذاری سبک عربی (تشکیل) — یک API کوچک واحد روی مدلهای ONNX قابلتعویض که علائم مصوت گمشده را بازمیگردانند، بدون PyTorch و بهطور پیشفرض آفلاین. گام اعرابگذاری arbtok را نیرو میدهد.
یک مدیر واژگان و ابزار زبانی برای گویشهای پرتغالی.
تحلیلگر ساختواژی مبتنی بر قاعده برای زبان پرتغالی — واژهها را به تکواژها بخش میکند.
ابزارهای گرافم به واج برای زبان پرتغالی.
برچسبزن سبک نقشهای دستوری (POS) برای زبان پرتغالی.
اسکراپر رادیوی TuneIn که انتشارهای فرادادهٔ رسانهٔ نوعدار تولید میکند.
اسکراپر سبک YouTube که انتشارهای فرادادهٔ رسانهٔ نوعدار تولید میکند.
زیرکلاسی از requests.Session که Cloudflare را دور میزند (جعل هویت curl_cffi، FlareSolverr، بازگشت به Wayback) — لایه انتقال ضدربات پشت اسکراپرهای ما.
خوانندهٔ زندهٔ USENET و اسکراپر مقاله برای پژوهش پروتکلهای جایگزین و بایگانی.
پل تشخیص فعالیت صوتی بیدرنگ با استفاده از ovos-plugin-manager. احتمال گفتار (۰ تا ۱۰۰ درصد)، سطح نویز (dB) و یک حسگر دودویی تشخیص گفتار با میراگیری را به MQTT منتشر میکند — با کشف خودکار Home Assistant.
تشخیص فعالیت صوتی به شیوه ONNX — هر مدل VAD را پشت یک API جریانی واحد با یک زمان اجرای کوچک (numpy + onnxruntime) بارگذاری کنید. همتای VAD برای phoonnx؛ بیشتر بکاندها داده هستند نه کد.
تبدیل صدای کاملاً ONNX و چندموتوره — هر گفتاری را به صدای یک گوینده مرجع بازآفرینی کنید، با هیچ PyTorch در زمان استنتاج. ۱۴ موتور (kNN-VC، FreeVC، OpenVoice، RVC، CosyVoice…) پشت یک API واحد VoiceCloner، بههمراه یک CLI و بیلدهای INT8.
یک آموزگار مدل واژه بیدارباش که تحت یک کمکهزینه NLnet برای OpenVoiceOS ساخته شده — واژههای بیدارباش سفارشی و رویدستگاه را از نمونههای خودتان بسازید.
برنامه وب Flask برای برچسبگذاری دستی صوت واژه بیدارباش — هر کلیپ را پخش کنید و واژه، جنسیت گوینده و نوع نویز را برچسب بزنید و یک پیکره آماده برای آموزش یا ارزیابی را ماندگار کنید.
سرویس ASR اوپنوویساواس برای پروتکل Wyoming — تشخیص گفتار سبک.
سرویس TTS اوپنوویساواس برای پروتکل Wyoming — تبدیل متن به گفتار سبک.
سرویس تشخیص واژه بیدارباش OpenVoiceOS برای پروتکل Wyoming.
کلاینت پایتون ماژولار و ناهمگام برای API Shazam — انگشتنگاری صوتی از طریق shazamio-core با مدلهای نوعدار Track/Artist و یک اسکراپر کاتالوگ.
کتابخانهٔ فشردهٔ کدگذاری دودویی به متن (Base91، Z85B، Z85P) — پیادهسازیهای سریع C با جایگزینهای پایتون خالص، همگی فشردهتر از base64.