هوش مصنوعی صدای حریم‌خصوصی‌محور

فناوری صدایی که به داده‌های شما احترام می‌گذارد.

در دنیایی پر از دستیارهای صوتی داده‌محور، راه بهتری وجود دارد. TigreGótico فناوری صوتی را بر پایه حریم خصوصی، متن‌باز و حاکمیت داده می‌سازد. ما به عنوان سازندگان استک HiveMind و مشارکت‌کنندگان اصلی OpenVoiceOS، به شما کمک می‌کنیم راهکارهای صوتی امن و سازگار با GDPR ارائه دهید که روی سخت‌افزار خودتان اجرا می‌شوند — بدون ارسال هیچ داده‌ای به ابر دیگران.

سازندگانHiveMindو مشارکت‌کنندگان اصلی درOpenVoiceOS

کاری که می‌کنیم

فناوری صدا — و مهندسی داده‌ای که پشت آن است

ما در سراسر پشته متن‌باز، فناوری صدای حریم‌خصوصی‌محور می‌سازیم و داده‌های عمومی دشوارِ دسترسی را به APIها و مجموعه‌داده‌های تمیز تبدیل می‌کنیم.

استخراج داده، APIها و مجموعه‌داده‌های تمیز

یک تخصص درجه‌یک: ما داده‌های عمومی را که در غیر این صورت دشوارِ دسترسی‌اند — پشت صفحات بی‌ساختار، دیوارهای ضدربات، یا نقاط پایانی بدون مستندات — با اسکرپرهای مقاوم و APIهای مهندسی‌معکوس‌شده آزاد می‌کنیم، سپس آن را به‌صورت کتابخانه‌های کلاینت تمیز و نوع‌دار بازعرضه کرده و از آن مجموعه‌داده‌های گزیده و آماده برای یادگیری ماشین می‌سازیم.

خدمات داده

دستیارهای صوتی حریم‌خصوصی‌محور

استقرارهای روی‌دستگاهِ OpenVoiceOS که صدا و داده را روی سخت‌افزار خودتان نگه می‌دارند — مطابق GDPR از پایه طراحی‌شده.

مدل‌های صوتی سفارشی — TTS و ASR

صداهای تبدیل متن به گفتار آفلاین برای زبان یا برند شما، و تشخیص گفتار تنظیم‌شده (Zipformer، Parakeet، Whisper) برای حوزه شما — با پشتیبانی مشارکت ASR ما با Alpha Cephei.

فناوری گفتار برای زبان‌های اقلیت و لوزوفون

واج‌سازی، ASR و TTS برای زبان‌های کم‌برخوردار که ابزارهای متعارف نادیده می‌گیرند.

شبکه‌های دستگاهی HiveMind

صدای توزیع‌شده در میان ماهواره‌ها و هاب‌ها با مجوزهای دقیق و بدون ابر مرکزی.

سازندگانHiveMindو مشارکت‌کنندگان اصلی درOpenVoiceOS.


پشته‌ای که بر آن می‌سازیم

OpenVoiceOSHiveMind

با OpenVoiceOS

دو صدا. هر زبان.

Miro و Dii دو هویت صوتی هستند که فارغ از اینکه دستیار شما به کدام زبان صحبت کند یکسان به گوش می‌رسند — یک صدای برندِ به‌راستی جهانی برای OpenVoiceOS. ما با خط‌لوله شبیه‌سازی صدای خود، برای هر زبان یک مدل تک‌زبانه آموزش می‌دهیم و در این مسیر پژوهش تبدیل نویسه به واج انجام می‌دهیم — و زبان‌های در معرض خطری را پوشش می‌دهیم که ابزارهای متعارف نادیده می‌گیرند، مانند فریزی، آستوریایی و آراگونی. هر صدا یکمدل کوچک با حدود ۱۵٫۶ میلیون پارامتر است که روی رزبری پای، گوشی، یا درست در مرورگر شما اجرا می‌شود — بدون GPU، بدون ابر.

برگزیده

چه می‌سازیم و منتشر می‌کنیم

هر آنچه می‌سازیم FOSS و قابل میزبانی شخصی است — بدون وابستگی اجباری، بدون ابر الزامی.

کار ما کل پشته صدا را در بر می‌گیرد — تبدیل متن به گفتار، تشخیص گفتار و تشخیص کلمه بیدارباش، به‌علاوه افزونه‌های OpenVoiceOS که آن‌ها را به هم پیوند می‌دهند و شبکه HiveMind که دستیارها را در میان دستگاه‌های بسیار اجرا می‌کند. در سمت داده، خانواده‌ای از کتابخانه‌های اسکرپینگ، انتقالِ ضدربات و تفکیک موجودیت، داده‌های عمومی دشوارِ دسترسیِ وب را به APIهای تمیز و نوع‌دار و مجموعه‌داده‌های تکرارپذیر تبدیل می‌کند. هر بخش یک کتابخانه کوچک و ترکیب‌پذیر است که می‌توانید روی سخت‌افزار خود اجرا کنید — و مجموعه‌داده‌ها و مدل‌های پشت آن‌ها، از جمله صداهای چندزبانه Miro و Dii ما و ابزارهای زبان پرتغالی، به‌طور آزاد در Hugging Face منتشر می‌شوند.

مرور همه متن‌بازها مجموعه‌داده‌ها و مدل‌ها

بازی

بازی‌های متنی و صوتی

از داستان‌های تعاملی کلاسیک تا دنیاهای مولدِ مبتنی بر LLM — قابل بازی در خط فرمان یا کاملاً با صدا، با طراحی صدا-محور برای همه.

از وبلاگ

تازه‌ترین نوشته‌ها

خواندن وبلاگ

نظرات

شرکا و کاربران چه می‌گویند

سخنانی از افراد و پروژه‌هایی که با آن‌ها می‌سازیم.

“اگر به راهکارهای صوتی و هوش مصنوعی مبتنی بر حریم خصوصی نیاز دارید، TigreGotico انتخاب نخست ما برای یک شریک است. حریم خصوصی بخشی از ذات آنهاست. سازمان دیگری را نخواهید یافت که تا این اندازه به محلی و امن نگه‌داشتن داده‌های شما متعهد باشد.”
Mike J. GrayOscillate Labs
“Casimiro کار فوق‌العاده‌ای روی رونویسی ATC برای PilotGPT انجام داد. او ژرف‌اندیش و از نظر فنی قوی بود و توانست با سرعت و خلاقیت یک مسئلهٔ دشوار صوتی در دنیای واقعی را حل کند. او پیوسته کار با کیفیت بالا ارائه می‌داد و همکاری با او عالی بود. من او را برای هر نقشی در زمینهٔ مهندسی هوش مصنوعی/صوت به‌شدت توصیه می‌کنم.”
Murti Hussain, Founder @ PilotGPTPilotGPT
“Casimiro یکی از نیروهای پیشران در عملی‌کردن دستیارهای صوتی مبتنی بر حریم خصوصی بوده است، به جای اینکه صرفاً یک آرمان باقی بمانند. کار او روی HiveMind و OpenVoiceOS، مهندسی قدرتمند را با احترامی عمیق به حریم خصوصی، باز بودن و نگهداری‌پذیری بلندمدت متعادل می‌کند. هنگامی که او زیرساخت می‌سازد، آن را برای توانمندسازی توسعه‌دهندگان و کاربران طراحی می‌کند — نه برای محبوس‌کردن آنها در اکوسیستم شخص دیگری.”
Gaëtan Trellu, Founder @ ThalovantThalovant
“Casimiro یک توسعه‌دهنده Python و متخصص هوش مصنوعی بی‌همتاست. آنچه او را متمایز می‌کند، توانایی خلاقانه‌اش در ساخت راهکارهای سفارشی در فضای متن‌باز است، همراه با نگرشی سالم، نقادانه و مسئله‌محور به جای صرفاً انجام آنچه خواسته شده است. این را با دانش عمیق او از نحوهٔ کار محصولاتش ترکیب کنید — او خودش مجموعه‌داده‌ها، مدل‌ها و گردش‌کارها را می‌سازد — و همیشه یک راهکار پیشرفته و روزآمد دریافت می‌کنید.”
Timon van Hasselt, VisioLabKoninklijke Visio

بیایید بسازیم

پروژه صوتی‌ای در ذهن دارید؟

با کسانی صحبت کنید که این پشته را می‌سازند. بدون دلال داده، بدون وابستگی اجباری — فقط فناوری صدای خصوصی و باز که برای ماندگاری ساخته شده است.