Alpha Cephei
Een spraakherkenningspartnerschap dat decennia aan expertise in automatische spraakherkenning (ASR) inbrengt — het team achter Vosk en Kaldi-gebaseerde modellen — voor ons fijnafstemmings- en datasetwerk voor spraakmodellen.
Portfolio
Ons opensourcewerk – vrije, zelf te hosten bibliotheken en tools voor spraak-AI, gegevensextractie, datasets, NLP en games, plus het OpenVoiceOS- en HiveMind-ecosysteem waaraan wij meebouwen. Geen lock-in, geen verplichte cloud.
Naast de code zijn onze open datasets en modellen gepubliceerd opHugging Face,en onze trainingsnotebooks bevinden zich in de repositoryml-notebooks.
Community
Wij dragen bij aan onafhankelijke partners en doneren publiek gefinancierd werk aan de OpenVoiceOS-stichting.
Een spraakherkenningspartnerschap dat decennia aan expertise in automatische spraakherkenning (ASR) inbrengt — het team achter Vosk en Kaldi-gebaseerde modellen — voor ons fijnafstemmings- en datasetwerk voor spraakmodellen.
Spaans programma dat taaltechnologie bevordert voor de officiële talen van het land (Spaans, Catalaans, Baskisch, Galicisch). Financiert OVOS-ontwikkeling om downloadbare, privacyvriendelijke spraakassistenten te maken die draaien op Raspberry Pi en personal computers. Gefinancierd door het Spaanse Ministerie van Digitale Transformatie en het EU-herstelplan.
Het Next Generation Internet-programma van de Europese Commissie (met Zwitserse SERI-cofinanciering) dat OpenVoiceOS ondersteunt als een stabiel, privacyvriendelijk alternatief voor de spraakassistenten van Big Tech. Focus: meertalige ondersteuning, gebruikersonboarding, platformstabilisatie en documentatie.
Een onafhankelijke non-profitstichting die een gemeenschapsgedreven, privacyvriendelijk opensource spraak-AI-platform bouwt. TigreGótico is een kernbijdrager aan OpenVoiceOS, en zijn oprichter zetelt in het bestuur van de stichting.
Verkennen
Filter op gebied om meer te verkennen – alles is open source.
Asynchrone Python-wrapper voor coding-agent-CLI's (Claude Code, Gemini, opencode, Antigravity) achter één Provider-API — one-shot, multi-turn-sessies, getypeerde streaming-events en fan-out-/delegate-/retry-pijplijnpatronen.
Named Entity Recognition met het Aho-Corasick-algoritme.
Pure-Python, afhankelijkheidsvrije, versiebewuste grafeem-naar-foneem voor het Baskisch en Spaans — reproduceert getrouw de AhoTTS-frontend en levert de single-char IPA-string die gebruikt wordt om StyleTTS2-/VITS-stemmen te trainen.
Een browsergebaseerd hulpmiddel om audio uit te lijnen met teksttranscripties en IPA op woord-, grafeem- en zinsniveau. Draait volledig aan de clientzijde, zonder server, afhankelijkheden of buildstap.
Anonieme HTTP met IP-rotatie; combineert met unblock_requests voor rotatie plus omzeiling van bot-muren.
Op regels gebaseerde Arabische (MSA) tekst-naar-IPA met tashkeel-diacritisering, gebouwd op orthography2ipa — een contextgevoelige tokenboom verwerkt zonneletter-assimilatie, hamzat al-waṣl, tanwīn en tāʾ marbūṭa, en diacritiseert kale tekst eerst via meegeleverde ONNX-modellen.
Zoek en stream publiek-domein-audioboeken van LibriVox en vergelijkbare bronnen.
Spraakrestauratie, ruisonderdrukking en bandbreedte-uitbreiding in puur ONNX — schaalt smalbandspraak op naar 48 kHz zonder torch tijdens runtime.
Minimale HTTP-clientbibliotheek voor Python — lichtgewicht alternatief voor requests.
Heterofone homograafdisambiguatie voor het Europees Portugees ten behoeve van TTS — kiest de juiste uitspraak van woorden die hetzelfde geschreven worden maar naar betekenis anders klinken (sede = dorst vs hoofdkantoor, forma = mal vs vorm). Pure-Python-regels plus geleerde modellen, met open datasets.
Voorgetrainde Brill part-of-speech-taggers voor 11 talen, geleverd als kant-en-klare gepickelde modellen bovenop NLTK — tag tekst zonder te trainen.
ONNX-gebaseerde inferentie-engine voor conversationele AI.
Python-pakket om informatie over klassieke componisten op te halen bij Classical Archives.
Meertalige CRF-extractor voor sleutelwoorden/zoektermen — haalt de query uit een natuurlijketaalvraag met een CRF over POS- en orthografische kenmerken, met voorgetrainde modellen per taal.
DeepMoji-emotie-/emojivoorspelling in ONNX.
Detecteer en converteer tussen zeven Portugese orthografische normen — de pre-1911 etymologische schrijfwijze, de hervormingen van 1911/1943/1945/1971/1973, en het Acordo Ortográfico de 1990 met zijn Europese en Braziliaanse subvarianten.
Hulpmiddelen om gesprekken naar een doel te leiden.
Gestructureerde data en bewerkingen voor het werken met menselijke emoties.
Pure-Python, afhankelijkheidsvrije herimplementatie van de grafeem-naar-foneem-frontend van espeak-ng — tekst uitsluitend naar fonemen, zonder C-extensie. Reproduceert het espeak-ng-binary byte voor byte over een steekproef van trefwoorden in 86 talen en een zinscorpus in 31 talen; 117 talen meegeleverd.
Dialectbewuste Baskische tekst-naar-IPA-fonemizer, gebouwd op het gedeelde orthography2ipa-uitspraakrooster — open, inspecteerbaar en met bronvermelding.
Grafeem-naar-foneem voor het Barranquenho.
Een protocol voor het bouwen van hiërarchische agentnetwerken — lichtgewicht satellietapparaten verbinden zich via een versleuteld mesh met elke conversatie-agent, van OpenVoiceOS tot LLM-persona's tot willekeurige A2A-agenten. Het ecosysteem omvat transportprotocollen, spraaksatellieten, chatbruggen, cryptografie en configuratievrije discovery.
A2A-agentprotocolplugin voor hivemind-core — verbindt de hive via JSON-RPC 2.0 met externe Agent-to-Agent-(A2A-)servers en streamt antwoorden terug naar de satellieten.
Een eenvoudige JSON-bestandsdatabase voor Python.
Een lichtgewicht intentie-engine.
Sleutelwoordsjabloon-matchingengine voor intentieherkenning.
Doodeenvoudige, op woordlijsten gebaseerde pure-Python-taaldetector.
Publiceer de stroom- en systeemtelemetrie van een Linux/SBC naar Home Assistant via MQTT — CPU/GPU/RAM/schijf, temperaturen, throttling, audio + MPRIS, WiFi/Bluetooth — allemaal automatisch ontdekt. Gebouwd op powerguess.
Parseer en classificeer vragen.
Markov-keten-tekstgeneratie uit JSON-data.
Naar ONNX geëxporteerde Markov-ketenmodellen.
Indexeer, canonicaliseer, dedupliceer en bedien mediacatalogi van YouTube en andere bronnen.
Een gedeelde media-metadatawoordenschat en normalisatielaag die verenigt hoe titels, artiesten en identifiers worden afgebeeld tussen mediaclients en Music Assistant-integraties.
Op Pydantic gebaseerde media-metadataclients en een sleutelloze cross-source-entiteitsresolver.
Op regels gebaseerde fonemizer voor het Mirandees.
Een machine-learning- en neurale-netwerkbibliotheek in scikit-learn-stijl met alleen numpy en scipy als afhankelijkheden — geschreven om gelezen te worden.
SoundCloud-client die getypeerde media-metadatareleases uitzendt.
Communitygedreven, privacygerichte open-source spraakassistentplatform. TigreGótico is een kernbijdrager aan het hele ecosysteem — met spraakplugins, STT/TTS-diensten, ontwikkelaarstooling en formeel specificatiewerk over tientallen repositories.
Data-over-geluid-toolkit in pure Python — draag tekst en data via een audiokanaal (DTMF en meer) met gedeelde WAV-/sinus-/Goertzel-primitieven. De kernschema's zijn afhankelijkheidsvrij.
Grafeem-naar-IPA- en allofoonafbeeldingen voor meer dan 350 talen in ruim 20 taalfamilies — een maximal-munch IPA-tokenizer, fonologische en schriftafstandsmetrieken, dialecttransformaties en een pluggbare G2P-backend.
Agentintegratieframework voor OpenVoiceOS — maak spraakgestuurde agentische workflows mogelijk.
Messagebus-monitor voor OpenVoiceOS — bekijk busverkeer live om skills, intents en services te debuggen.
ChromaDB-vectorembeddingsplugin voor OpenVoiceOS.
OVOS-plugin die dialoogtekst normaliseert vóór TTS-synthese (getaluitschrijving, afkortingen).
Documentopdeling voor retrieval/RAG in OpenVoiceOS.
Snelle semantische reranking-plugin voor OVOS-queryresultaten.
Lokale GGUF-embeddingsplugin voor OpenVoiceOS.
Lokale LLM (GGUF)-plugin voor OpenVoiceOS.
Lokale LLM-solver met GGUF-modellen in OpenVoiceOS.
Een GitHub-native lokalisatieplatform voor OpenVoiceOS-skills en -plugins — beheer vertalingen volledig via Git, zonder externe dienst om te draaien.
Model2Vec-intentiepijplijn voor de intentieafhandeling van OpenVoiceOS.
OVOS-ChatEngine-plugin die gespreksbeurten via de OVOS-messagebus doorstuurt — koppel chatinterfaces rechtstreeks aan een draaiende assistent.
Open-data-metriekenserver voor OpenVoiceOS — verzamelt anonieme gebruiksmetrieken en publiceert ze als open datasets; ontwikkeld binnen het ILENIA-project.
Benchmarkarena voor OVOS-plugins — onderlinge duels met ELO-ranglijsten om STT-, TTS- en andere plugin-implementaties op echte workloads te vergelijken.
Qdrant-vectordatabase-embeddingsplugin voor OpenVoiceOS.
OVOS ASR-plugin met het Citrinet-akoestisch model, getraind op ILENIA-spraakdata.
OVOS ASR-plugin met door Zuazo fijnafgestelde Faster-Whisper-modellen voor het Baskisch.
OVOS ASR-plugin voor HiTZ Baskische spraakherkenning.
OVOS ASR-plugin met Meta MMS massaal meertalige spraakherkenning.
OVOS ASR-plugin met NVIDIA NeMo ASR-modellen.
OVOS ASR-plugin voor NOS Galicische spraakherkenning.
OVOS-spraakherkenningsplugin rond onnx-asr — lichtgewicht ASR met ONNX-modellen, zonder torch.
OVOS ASR-plugin met wav2vec 2.0-modellen voor het Spaans en co-officiële talen.
OVOS ASR-plugin die Whisper combineert met een taalmodel voor betere nauwkeurigheid.
Host elk OpenVoiceOS-STT-plugin als netwerkdienst — een kleine server die spraakherkenning via HTTP aanbiedt aan satellieten en externe clients.
OVOS TTS-plugin voor AhoTTS, een Baskisch spraaksynthesesysteem ontwikkeld onder ILENIA.
OVOS TTS-plugin die Coqui TTS omhult voor Spaanstalige stemmen.
OVOS TTS-plugin voor Cotovia, een Galicische text-to-speech-engine.
OVOS TTS-plugin voor Matxa multispeaker Catalaanse synthese.
OVOS TTS-plugin voor NOS Galicische spraaksynthese.
Host elk OpenVoiceOS-TTS-plugin als dienst — een eenvoudige flask-server die elk TTS-plugin verandert in een zelfgehoste spraaksynthese-API.
Audio-superresolutie voor OVOS-TTS — FlashSR schaalt gesynthetiseerde spraak vóór afspelen via ONNX op van 16 kHz naar 48 kHz en maakt elke bestaande stem helderder zonder hertraining.
Audio-superresolutie voor OVOS-TTS — NovaSR schaalt gesynthetiseerde spraak op van 16 kHz naar 48 kHz met de snelle FastSR-upsampler en slaat audio over die al 48 kHz is.
Docker-opzet voor OpenVoiceOS met Wyoming-diensten.
End-to-end-testframework voor OVOS-skills met een lichtgewicht in-process runtime.
Doodsimpele op trefwoorden gebaseerde intentparser — een drop-in vervanger voor Adapt die uitingen matcht met verplichte/optionele trefwoordslots; ontstaan bij TigreGótico en gedoneerd aan OpenVoiceOS.
Fonetisch fuzzy zoeken en segment-naar-segment-afstand.
Een Python-bibliotheek voor meertalige fonemisering en Text-to-Speech (TTS) met ONNX-modellen.
Windows NVDA-schermlezer-add-on die spreekt via de neurale ONNX-stemmen van phoonnx, en demonstreert phoonnx als een TTS-backend voor toegankelijkheid.
VITS TTS-inferentie in de browser met onnxruntime-web. Unicode- en espeak-ng-paden. Geen server, geen API.
Geautomatiseerde browserbesturing gebouwd op Selenium en Selenium Wire — sessies, eventafhandeling, elementinteractie en extensiebeheer voor scraping en testen waar een volledige browser onvermijdelijk is.
Schat of meet het stroomverbruik van een Linux-apparaat — een afhankelijkheidsarme Python-bibliotheek met herkomst bij elke meting (INA219, RAPL, Raspberry Pi PMIC, batterij of een gekalibreerde, begrensde schatting).
Browser-/Node.js-port van precise-onnx wakewoorddetectie. MFCC-kenmerkextractie + ONNX-gebaseerde detectie, compatibel met Precise .onnx-modellen.
Coreferentieresolutie via voornaamwoord-POS en woordgeslachtsheuristieken.
Bandcamp-scraper die getypeerde media-metadatareleases uitzendt.
Python HTTP-client en mediavocab-brug voor een Music Assistant-server — de gedeelde transport- en conversielaag achter de OVOS Music Assistant-integratie.
Python-bibliotheek voor AhoTTS Text-to-Speech-synthese.
Python-port van AhoTTS Iparrahotsa, een Text-to-Speech-engine voor het Noord- (continentaal) Baskisch — de tegenhanger in het Iparralde-dialect van pyAhoTTS, met hts_engine en de AhoCoder-vocoder. Ontwikkeld met Aholab (UPV/EHU).
Getypeerde Python-client voor Classical Archives.
Pure-Python-port van de Cotovia G2P-frontend voor het Galicisch en Spaans. Reproduceert de lettergreepverdeling, klemtoon en transcriptiepijplijn van het gecompileerde C-binary zonder subprocess.
Streaming Python-client voor de maandelijkse datadumps van Discogs.
Getypeerde Python-client + markdown-datasetdumper voor Erowid (erowid.org).
Pure-Python-port van de EYE N3-redeneerengine — voed het Notation3-feiten en -regels en het leidt nieuwe feiten af via voorwaartse/achterwaartse chaining, RDFS- en OWL 2 RL-entailment, bewijsbomen en meer dan 280 built-ins. Eén afhankelijkheid (rdflib).
Scrapingclient voor fanedit.org / IFDB.
Python-wrapper voor een engine voor interactieve fictie.
Python-client voor Project Gutenberg — boekmetadata via de open catalogus.
iHeartRadio API-client.
Pure-Python-port van HermiT, de OWL 2 DL-reasoner van Oxford — consistentie, classificatie en instantie-ophaling via een hyperresolutie-tableau, zonder JVM en zonder runtimeafhankelijkheden.
Python-metadataclient voor IMDb. Zet vrijetekstquery's om naar canonieke IMDb-titels.
Getypeerde Python-client voor Infopédia, het Europees-Portugese woordenboek van Porto Editora — parseert elk lemma naar IPA-uitspraken, lettergreepverdeling, etymologie en betekenissen, waarbij heterofone homografen correct gescheiden worden voor G2P- en disambiguatiewerk.
Een Python-pakket om te interageren met InspiroBot (inspirobot.me).
Getypeerde Python-client voor Jazz Music Archives.
Python-client voor LiveATC.net — ontdek, stream en archiveer live en historische luchtverkeersleidingsaudio (ATC), met datasetexport voor ASR-training.
Scraper / API-client voor MyAnimeList — anime en manga.
Encyclopaedia Metallum (Metal Archives) API-client.
Python-metadataclient voor MusicBrainz — de open muziekencyclopedie.
Getypeerde Python-client voor het Portal da Lingua Portuguesa.
Getypeerde Python-client voor Prog Archives.
Getypeerde Python-client + markdown-datasetdumper voor PsychonautWiki (psychonautwiki.org).
Python HTML-scraper voor rateyourmusic.com.
Python-scraper voor romhacking.net (RHDN) — de communitydatabase van ROM-hacks, fanvertalingen, patchtools en documentatie.
Een modulaire, asynchrone Python-client voor de Shazam-API, gebouwd op shazamio_core voor robuuste audiovingerafdrukken.
Python-client voor de publieke JSON-API van smwcentral.net — gepagineerde toegang tot de ROM-hacking-catalogus van Super Mario World / SM64 / Yoshi's Island.
TripSit-client voor drugsfactsheets + interactiematrix (schadebeperking).
Python HTML-scraper voor de PmWiki van tvtropes.org.
Python-client voor de publieke kana-JSON-API van VNDB (Visual Novel Database).
Python-client voor WikiHow.
Getypeerde Python-client voor de MediaWiki-API van de Engelse Wiktionary.
Meertalige Word-of-the-Day-aggregatorclient.
SomaFM-client die getypeerde media-metadatareleases uitzendt.
Implementatie van Rapid Automatic Keyword Extraction.
Audio-autoconfiguratiebibliotheek voor raspOVOS — detecteert geluidskaarten, HATs en USB-apparaten op de Raspberry Pi en stelt ze in voor spraakassistentgebruik; ontwikkeld binnen het ILENIA-project.
Anonieme e-mailremailerclient met ondersteuning voor de Cypherpunk- en Mixmaster-protocollen.
Afhankelijkheidsvrije kern voor schriften en foneemnotaties — ISO-15924-detectie, IPA ↔ ARPABET/X-SAMPA/Kirshenbaum/Cotovía, Buckwalter ↔ Arabisch, Hangul → jamo, kana.
Gedockeriseerde brug die kamergeluid met Shazam vingerprintt en trackmetadata (titel, artiest, hoesafbeelding, songtekst, Apple Music- / Spotify- / Deezer-links) naar MQTT publiceert met automatische ontdekking in Home Assistant.
Portugees hulpmiddel voor lettergreepverdeling.
Eenvoudige op regels gebaseerde named-entity recognition.
Verkenningshulpmiddel voor sites om de sitestructuur te leren kennen vóór het bouwen van scrapers. Brengt robots.txt, sitemaps en linkgrafieken in kaart met het unblock_requests-transport voor veerkrachtige verkenning van beveiligde of complexe sites.
Fonemizer voor regionale accenten van het Europees Portugees.
Pure-onnxruntime-bibliotheek voor sprekerembeddings — extraheer sprekerembeddings, bereken cosinusgelijkenis en verifieer sprekeridentiteit uit ONNX-modellen, zonder PyTorch bij runtime.
Uniforme spraakevaluatiemetrieken — neurale MOS (UTMOS, NISQA, SIGMOS, DNSMOS), intrusieve (STOI, SI-SDR, MCD) en ASR (WER/CER) — alleen met numpy en onnxruntime.
Een daemon die SSHFS/rclone-mounts bewaakt en automatisch herkoppelt wanneer ze wegvallen — met een live webdashboard, REST API, Prometheus-metrieken, webhooks en geplande rsync-/rclone-synchronisatietaken.
Meertalige woordklemtoon-plaatsing voor TTS-frontends, met alleen onnxruntime en numpy.
Uniforme, multi-provider weerabstractiebibliotheek voor Python. Bevraag OpenWeatherMap, Open-Meteo, MetNo, IPMA, NWS en meer via één consistente API.
Lichtgewicht Arabische diacritisering (tashkeel) — één minieme API over uitwisselbare ONNX-modellen die de ontbrekende klinkertekens herstellen, zonder PyTorch en standaard offline. Levert de diacritiseringsstap van arbtok.
Een lexiconhandler en linguïstisch hulpmiddel voor Portugese dialecten.
Op regels gebaseerde morfologische analysator voor het Portugees — segmenteert woorden in morfemen.
Portugese grafeem-naar-foneem-hulpmiddelen.
Lichtgewicht Portugese part-of-speech (POS)-tagger.
TuneIn-radioscraper die getypeerde media-metadatareleases uitzendt.
Lichtgewicht YouTube-scraper die getypeerde media-metadatareleases uitzendt.
Een subklasse van requests.Session die Cloudflare omzeilt (curl_cffi-impersonatie, FlareSolverr, Wayback-fallback) — het anti-bottransport achter onze scrapers.
Live USENET-lezer en artikelscraper voor onderzoek naar alternatieve protocollen en archivering.
Realtime Voice Activity Detection-brug met ovos-plugin-manager. Publiceert spraakwaarschijnlijkheid (0–100 %), ruisniveau (dB) en een gedebouncede binaire sensor voor spraakdetectie naar MQTT — met automatische ontdekking in Home Assistant.
Voice Activity Detection op de ONNX-manier — laad elk VAD-model achter één streaming-API met een minieme runtime (numpy + onnxruntime). De VAD-tegenhanger van phoonnx; de meeste backends zijn data, geen code.
Pure-ONNX, multi-engine stemconversie — herschep elke spraak naar de stem van een referentiespreker zonder enige PyTorch bij inferentie. 14 engines (kNN-VC, FreeVC, OpenVoice, RVC, CosyVoice…) achter één VoiceCloner-API, plus een CLI en INT8-builds.
Een wakewoord-modeltrainer ontwikkeld onder een NLnet-subsidie voor OpenVoiceOS — bouw eigen wakewoorden op het apparaat uit je eigen samples.
Flask-webapp voor het handmatig labelen van wakewoordaudio — speel elke clip af en tag woord, spreekergeslacht en ruistype, en bewaar een corpus klaar voor training of evaluatie.
OpenVoiceOS ASR-dienst voor het Wyoming-protocol — lichtgewicht spraakherkenning.
OpenVoiceOS TTS-dienst voor het Wyoming-protocol — lichtgewicht text-to-speech.
OpenVoiceOS wakewoorddetectiedienst voor het Wyoming-protocol.
Modulaire, asynchrone Python-client voor de Shazam-API — audiovingerafdrukken via shazamio-core met getypeerde Track-/Artist-modellen en een catalogusscraper.
Compacte binair-naar-tekst-coderingsbibliotheek (Base91, Z85B, Z85P) — snelle C-implementaties met pure-Python-fallbacks, allemaal compacter dan base64.