Portfolio

Open Source

Unsere Open-Source-Arbeit – freie, selbst hostbare Bibliotheken und Werkzeuge für Sprach-KI, Datenextraktion, Datensätze, NLP und Spiele sowie das OpenVoiceOS- und HiveMind-Ökosystem, an dem wir mitwirken. Kein Lock-in, keine verpflichtende Cloud.


Über den Code hinaus sind unsere offenen Datensätze und Modelle veröffentlicht aufHugging Face,und unsere Trainings-Notebooks befinden sich im Repositoryml-notebooks.

Community

Zusammenarbeit mit der Community

Wir tragen zu unabhängigen Partnern bei und spenden öffentlich finanzierte Arbeit an die OpenVoiceOS-Stiftung.

Alpha Cephei

Eine Partnerschaft im Bereich Spracherkennung, die jahrzehntelange Expertise in der automatischen Spracherkennung (ASR) — das Team hinter Vosk und Kaldi-basierten Modellen — in unsere Sprachmodell-Feinabstimmung und Datensatzarbeit einbringt.

ILENIA

Spanisches Programm zur Förderung der Sprachtechnologie für die offiziellen Sprachen des Landes (Spanisch, Katalanisch, Baskisch, Galicisch). Finanziert die OVOS-Entwicklung zur Schaffung herunterladbarer, datenschutzfreundlicher Sprachassistenten, die auf Raspberry Pi und Personalcomputern laufen. Finanziert vom spanischen Ministerium für digitale Transformation und dem EU-Aufbauplan.

NGI0 Commons Fund / NLnet

Das Next-Generation-Internet-Programm der Europäischen Kommission (mit Kofinanzierung durch das Schweizer SERI), das OpenVoiceOS als stabile, datenschutzorientierte Alternative zu den Sprachassistenten der großen Tech-Konzerne unterstützt. Schwerpunkt: Mehrsprachigkeit, Nutzer-Onboarding, Plattformstabilisierung und Dokumentation.

OpenVoiceOS

Eine unabhängige gemeinnützige Stiftung, die eine community-getriebene, datenschutzfreundliche und quelloffene Sprach-KI-Plattform aufbaut. TigreGótico ist ein zentraler Beitragender zu OpenVoiceOS, und sein Gründer sitzt im Vorstand der Stiftung.

Entdecken

Highlights

Filtern Sie nach Bereich, um mehr zu entdecken – alles ist Open Source.

Entwicklerwerkzeuge

agentpipe

Asynchroner Python-Wrapper für Coding-Agenten-CLIs (Claude Code, Gemini, opencode, Antigravity) hinter einer einzigen Provider-API — Einzelaufrufe, mehrstufige Sitzungen, typisierte Streaming-Ereignisse und Fan-out-/Delegate-/Retry-Pipeline-Muster.

  • agents
  • async
  • CLI
  • orchestration
Selbst gehostetRepository ansehen
Phonetik & G2P

ahotts-g2p

Reine Python-, abhängigkeitsfreie, versionsbewusste Graphem-zu-Phonem-Umwandlung für Baskisch und Spanisch — reproduziert originalgetreu das AhoTTS-Frontend und gibt die Einzelzeichen-IPA-Zeichenkette aus, die zum Trainieren von StyleTTS2-/VITS-Stimmen verwendet wird.

  • G2P
  • Basque
  • Spanish
  • IPA
Selbst gehostetRepository ansehen
Spracherkennung

ALIGN

Ein browserbasiertes Werkzeug zum Abgleichen von Audio mit Texttranskriptionen und IPA auf Wort-, Graphem- und Satzebene. Läuft vollständig clientseitig, ohne Server, ohne Abhängigkeiten, ohne Build-Schritt.

  • IPA
  • audio-text alignment
  • browser-based
  • JavaScript
Selbst gehostetRepository ansehen
Daten & Scraping

anon_requests

Anonymes HTTP mit IP-Rotation; kombiniert sich mit unblock_requests für Rotation plus Umgehung von Bot-Sperren.

  • HTTP
  • IP rotation
  • privacy
Selbst gehostetRepository ansehen
Phonetik & G2P

arbtok

Regelbasierte Arabisch-(MSA)-Text-zu-IPA-Umwandlung mit Tashkeel-Diakritisierung, aufgebaut auf orthography2ipa — ein kontextsensitiver Token-Baum behandelt Sonnenbuchstaben-Assimilation, Hamzat al-waṣl, Tanwīn und Tāʾ marbūṭa und diakritisiert bloßen Text zuvor über mitgelieferte ONNX-Modelle.

  • Arabic
  • G2P
  • IPA
  • diacritization
Selbst gehostetRepository ansehen
Medien & Musik

audiobooker

Suchen und Streamen gemeinfreier Hörbücher von LibriVox und ähnlichen Quellen.

  • LibriVox
  • audiobooks
  • scraper
Selbst gehostetRepository ansehen
Sprachsynthese

audiosronnx

Sprachrestaurierung, Entrauschung und Bandbreitenerweiterung in reinem ONNX — skaliert Schmalband-Sprache auf 48 kHz, ohne torch zur Laufzeit.

  • ONNX
  • audio super-resolution
  • speech enhancement
Selbst gehostetRepository ansehen
Entwicklerwerkzeuge

baresipy

Minimale HTTP-Client-Bibliothek für Python — leichtgewichtige Alternative zu requests.

  • HTTP
  • Python
  • client
  • lightweight
Selbst gehostetRepository ansehen
Phonetik & G2P

bifonia

Disambiguierung heterophoner Homographen im europäischen Portugiesisch für TTS — wählt die korrekte Aussprache gleich geschriebener, aber je nach Bedeutung unterschiedlich gelesener Wörter (sede = Durst vs. Sitz, forma = Form vs. Gestalt). Reine Python-Regeln plus gelernte Modelle, mit offenen Datensätzen.

  • grapheme-to-phoneme
  • TTS
  • homographs
  • word-sense disambiguation
Selbst gehostetRepository ansehen
NLP & Sprache

brill_postaggers

Vortrainierte Brill-Part-of-Speech-Tagger für 11 Sprachen, ausgeliefert als einsatzbereite gepicklete Modelle über NLTK — taggen Sie Text ohne Training.

  • POS tagging
  • 11 languages
  • NLTK
Selbst gehostetRepository ansehen
Medien & Musik

classical-archives

Python-Paket zum Abrufen von Informationen über klassische Komponisten von Classical Archives.

  • Classical music
  • API client
  • Music archives
Selbst gehostetRepository ansehen
NLP & Sprache

crf_query_xtract

Mehrsprachiger CRF-Extraktor für Schlüsselwörter/Suchbegriffe — extrahiert die Abfrage aus einer natürlichsprachlichen Frage über ein CRF auf Basis von POS- und orthographischen Merkmalen, mit vortrainierten Modellen pro Sprache.

  • keyword extraction
  • CRF
  • multilingual
Selbst gehostetRepository ansehen
Phonetik & G2P

desacordo_ortografico

Erkennen und Konvertieren zwischen sieben portugiesischen Rechtschreibnormen — der etymologischen Schreibweise vor 1911, den Reformen von 1911/1943/1945/1971/1973 und dem Acordo Ortográfico von 1990 mit seinen europäischen und brasilianischen Untervarianten.

  • Portuguese
  • orthography
  • AO1990
  • text conversion
Selbst gehostetRepository ansehen
Phonetik & G2P

espyak

Reine Python-, abhängigkeitsfreie Neuimplementierung des Graphem-zu-Phonem-Frontends von espeak-ng — nur Text zu Phonemen, ohne C-Erweiterung. Reproduziert das espeak-ng-Binär Byte für Byte über einen 86-sprachigen Stichwort-Durchlauf und einen 31-sprachigen Satzkorpus; 117 Sprachen mitgeliefert.

  • G2P
  • IPA
  • phonemization
  • espeak-ng
Selbst gehostetRepository ansehen
Phonetik & G2P

euskaphone

Dialektbewusster baskischer Text-zu-IPA-Phonemisierer auf Basis des gemeinsamen orthography2ipa-Aussprachegitters — offen, nachvollziehbar und quellenbelegt.

  • Basque
  • G2P
  • IPA
  • TTS frontend
Selbst gehostetRepository ansehen
Voice PlatformsEmpfohlen

HiveMind

Ein Protokoll zum Aufbau hierarchischer Agentennetzwerke — leichtgewichtige Satellitengeräte verbinden sich über ein verschlüsseltes Mesh mit einem beliebigen Konversationsagenten, von OpenVoiceOS über LLM-Personas bis zu beliebigen A2A-Agenten. Das Ökosystem umfasst Transportprotokolle, Sprachsatelliten, Chat-Brücken, Kryptografie und konfigurationsfreie Discovery.

  • agent networks
  • distributed voice
  • protocol
Selbst gehostetRepository ansehen
NLnet

hivemind-a2a-agent-plugin

A2A-Agentenprotokoll-Plugin für hivemind-core — verbindet den Hive über JSON-RPC 2.0 mit externen Agent-to-Agent-(A2A-)Servern und streamt Antworten zurück an die Satelliten.

  • A2A
  • agent
  • interoperability
Selbst gehostetRepository ansehen
Smart Home

linux2mqtt

Veröffentlichen Sie die Leistungs- und Systemtelemetrie eines Linux-/SBC-Geräts über MQTT an Home Assistant — CPU/GPU/RAM/Festplatte, Temperaturen, Throttling, Audio + MPRIS, WLAN/Bluetooth — alles automatisch erkannt. Aufgebaut auf powerguess.

  • MQTT
  • Home Assistant
  • power
  • system monitoring
Selbst gehostetRepository ansehen
Medien & Musik

media-archivist

Indizieren, Kanonisieren, Deduplizieren und Bereitstellen von Medienkatalogen von YouTube und anderen Quellen.

  • catalogue
  • homelab
  • indexing
  • media
Selbst gehostetRepository ansehen
Medien & MusikEmpfohlen

mediavocab

Ein gemeinsames Medien-Metadaten-Vokabular und eine Normalisierungsschicht, die vereinheitlicht, wie Titel, Interpreten und Identifikatoren über Medien-Clients und Music-Assistant-Integrationen hinweg zugeordnet werden.

  • media metadata
  • normalization
  • vocabulary
Selbst gehostetRepository ansehen
Medien & Musik

metadatarr

Pydantic-gestützte Medien-Metadaten-Clients und ein schlüsselloser quellenübergreifender Entity-Resolver.

  • Pydantic
  • media metadata
  • resolver
Selbst gehostetRepository ansehen
Entwicklerwerkzeuge

nupyml

Eine Machine-Learning- und Neuronale-Netze-Bibliothek im Stil von scikit-learn, nur mit numpy und scipy als Abhängigkeiten — geschrieben, um gelesen zu werden.

  • machine learning
  • numpy
  • education
Selbst gehostetRepository ansehen
Voice PlatformsEmpfohlen

Open Voice OS

Community-getriebene, datenschutzorientierte Open-Source-Sprachassistenzplattform. TigreGótico ist ein zentraler Mitwirkender am gesamten Ökosystem — mit Sprach-Plugins, STT/TTS-Diensten, Entwickler-Tooling und formaler Spezifikationsarbeit über Dutzende Repositories hinweg.

  • FOSS
  • privacy-first
  • voice platform
Selbst gehostetRepository ansehen
Entwicklerwerkzeuge

OpenTone

Data-over-Sound-Toolkit in reinem Python — übertragen Sie Text und Daten über einen Audiokanal (DTMF und mehr) mit gemeinsamen WAV-/Sinus-/Goertzel-Primitiven. Die Kernverfahren sind abhängigkeitsfrei.

  • data-over-sound
  • DTMF
  • audio
  • signal processing
Selbst gehostetRepository ansehen
Phonetik & G2PEmpfohlen

orthography2ipa

Graphem-zu-IPA- und Allophon-Zuordnungen für über 350 Sprachen aus mehr als 20 Familien — ein Maximal-Munch-IPA-Tokenizer, phonologische und Schrift-Distanzmetriken, Dialekttransformationen und ein modulares G2P-Backend.

  • 350+ languages
  • G2P
  • IPA
  • phonemization
Selbst gehostetRepository ansehen
NLnet

OVOS Agentic Loop

Agenten-Integrationsframework für OpenVoiceOS — ermöglicht sprachgesteuerte agentische Workflows.

  • OpenVoiceOS
  • agentic
  • agents
  • integration
Selbst gehostetRepository ansehen
NLnet

ovos-busmon

Messagebus-Monitor für OpenVoiceOS — Bus-Verkehr live beobachten, um Skills, Intents und Dienste zu debuggen.

  • messagebus
  • debugging
  • monitoring
Selbst gehostetRepository ansehen
NLnet

ovos-localize

Eine GitHub-native Lokalisierungsplattform für OpenVoiceOS-Skills und -Plugins — verwalten Sie Übersetzungen vollständig über Git, ohne einen externen Dienst betreiben zu müssen.

  • GitHub-native
  • i18n
  • localization
  • no-infra
Selbst gehostetRepository ansehen
NLnet

ovos-messagebus-chat-plugin

OVOS-ChatEngine-Plugin, das Gesprächszüge über den OVOS-Messagebus weiterleitet — Chat-Oberflächen direkt mit einem laufenden Assistenten verbinden.

  • chat
  • messagebus
  • plugin
Selbst gehostetRepository ansehen
ILENIA

ovos-opendata-server

Open-Data-Metrikserver für OpenVoiceOS — sammelt anonyme Nutzungsmetriken und veröffentlicht sie als offene Datensätze; entwickelt im Rahmen des ILENIA-Projekts.

  • metrics
  • open data
  • server
Selbst gehostetRepository ansehen
NLnet

ovos-plugin-arena

Benchmarking-Arena für OVOS-Plugins — direkte Duelle mit ELO-Wertungen, um STT-, TTS- und andere Plugin-Implementierungen unter realen Lasten zu vergleichen.

  • benchmark
  • ELO
  • plugins
Selbst gehostetRepository ansehen
NLnet

ovos-stt-server

Beliebige OpenVoiceOS-STT-Plugins als Netzwerkdienst betreiben — ein kleiner Server, der Spracherkennung über HTTP für Satelliten und Drittanbieter-Clients bereitstellt.

  • STT
  • server
  • self-hosted
Selbst gehostetRepository ansehen
NLnet

ovos-tts-server

Beliebige OpenVoiceOS-TTS-Plugins als Dienst betreiben — ein einfacher Flask-Server, der jedes TTS-Plugin in eine selbst gehostete Sprachsynthese-API verwandelt.

  • TTS
  • server
  • self-hosted
Selbst gehostetRepository ansehen
NLnet

ovos_tts_transformer_FlashSR

Audio-Superresolution für OVOS-TTS — FlashSR skaliert synthetisierte Sprache vor der Wiedergabe per ONNX von 16 kHz auf 48 kHz und macht jede vorhandene Stimme klarer, ohne Neutraining.

  • TTS
  • super-resolution
  • ONNX
Selbst gehostetRepository ansehen
NLnet

ovos_tts_transformer_NovaSR

Audio-Superresolution für OVOS-TTS — NovaSR skaliert synthetisierte Sprache mit dem schnellen FastSR-Upsampler von 16 kHz auf 48 kHz und überspringt Audio, das bereits 48 kHz hat.

  • TTS
  • super-resolution
  • ONNX
Selbst gehostetRepository ansehen
NLnet

ovoscope

End-to-End-Testframework für OVOS-Skills mit einer leichtgewichtigen In-Process-Laufzeit.

  • OVOS skills
  • end-to-end testing
  • in-process runtime
Selbst gehostetRepository ansehen
NLnet, NLP & Sprache

palavreado

Denkbar einfacher schlüsselwortbasierter Intent-Parser — ein Drop-in-Ersatz für Adapt, der Äußerungen gegen Pflicht-/Optional-Keyword-Slots abgleicht; bei TigreGótico entstanden und an OpenVoiceOS gestiftet.

  • intent parsing
  • NLP
Selbst gehostetRepository ansehen
SprachsyntheseEmpfohlen

phoonnx

Eine Python-Bibliothek für mehrsprachige Phonemisierung und Text-to-Speech (TTS) mithilfe von ONNX-Modellen.

  • ONNX models
  • multilingual TTS
  • phonemization
Selbst gehostetRepository ansehen
Sprachsynthese

phoonnx-AddonNVDA

Add-on für den Windows-Screenreader NVDA, das über neuronale phoonnx-ONNX-Stimmen spricht und phoonnx als Barrierefreiheits-TTS-Backend demonstriert.

  • NVDA
  • accessibility
  • screen reader
  • ONNX
Selbst gehostetRepository ansehen
Sprachsynthese

phoonnx.js

VITS-TTS-Inferenz im Browser mit onnxruntime-web. Unicode- und espeak-ng-Pfade. Kein Server, keine API.

  • ONNX
  • TTS
  • browser
  • VITS
Selbst gehostetRepository ansehen
Daten & Scraping

pombo_correio

Automatisierter Browser-Controller auf Basis von Selenium und Selenium Wire — Sitzungen, Ereignisbehandlung, Elementinteraktion und Erweiterungsverwaltung für Scraping und Tests, wo ein vollwertiger Browser unvermeidlich ist.

  • browser automation
  • Selenium
  • scraper
Selbst gehostetRepository ansehen
Smart Home

powerguess

Schätzen oder messen Sie die Leistungsaufnahme eines Linux-Geräts — eine abhängigkeitsarme Python-Bibliothek mit Herkunftsnachweis für jede Messung (INA219, RAPL, Raspberry Pi PMIC, Akku oder eine kalibrierte, begrenzte Schätzung).

  • power
  • energy
  • RAPL
  • INA219
Selbst gehostetRepository ansehen
Aktivierungswörter

precise-onnx-js

Browser-/Node.js-Portierung der precise-onnx-Wake-Word-Erkennung. MFCC-Merkmalsextraktion + ONNX-basierte Erkennung, kompatibel mit Precise-.onnx-Modellen.

  • ONNX
  • Wake words
  • Web
  • Audio
Selbst gehostetRepository ansehen
Smart Home

py-music-assistant

Python-HTTP-Client und mediavocab-Bridge für einen Music-Assistant-Server — die gemeinsame Transport- und Konvertierungsschicht hinter der OVOS-Music-Assistant-Integration.

  • Music Assistant
  • media metadata
  • API client
Selbst gehostetRepository ansehen
ILENIA

pyAhoTTS

Python-Bibliothek für die AhoTTS-Text-to-Speech-Synthese.

  • AhoTTS
  • ILENIA project
  • Python
  • TTS library
Selbst gehostetRepository ansehen
ILENIA

pyAhoTTS-Iparrahotsa

Python-Portierung von AhoTTS Iparrahotsa, einer Text-to-Speech-Engine für das nördliche (kontinentale) Baskisch — das Gegenstück des Iparralde-Dialekts zu pyAhoTTS, mit hts_engine und dem AhoCoder-Vocoder. Entwickelt mit Aholab (UPV/EHU).

  • AhoTTS
  • Basque
  • ILENIA
  • TTS library
Selbst gehostetRepository ansehen
Phonetik & G2P

pycotovia

Reine Python-Portierung des Cotovia-G2P-Frontends für Galicisch und Spanisch. Reproduziert die Silbentrennungs-, Betonungs- und Transkriptions-Pipeline des kompilierten C-Binärs ohne Subprozess.

  • G2P
  • Galician
  • Spanish
  • phonemization
Selbst gehostetRepository ansehen
Medien & Musik

pydiscogs

Streaming-Python-Client für die monatlichen Discogs-Datendumps.

  • Discogs
  • Music metadata
  • Data dumps
  • API client
Selbst gehostetRepository ansehen
Daten & Scraping

pyerowid

Typisierter Python-Client + Markdown-Datensatz-Dumper für Erowid (erowid.org).

  • Erowid
  • Harm reduction
  • API client
  • Dataset
Selbst gehostetRepository ansehen
Entwicklerwerkzeuge

pyeye

Reine Python-Portierung der EYE-N3-Reasoning-Engine — geben Sie ihr Notation3-Fakten und -Regeln, und sie leitet neue Fakten über Vorwärts-/Rückwärtsverkettung, RDFS- und OWL-2-RL-Entailment, Beweisbäume und über 280 Built-ins ab. Eine Abhängigkeit (rdflib).

  • N3
  • reasoner
  • RDF
  • forward chaining
Selbst gehostetRepository ansehen
Medien & Musik

pygutenberg

Python-Client für das Project Gutenberg — Buch-Metadaten über den offenen Katalog.

  • Project Gutenberg
  • Books
  • API client
  • Literature
Selbst gehostetRepository ansehen
Entwicklerwerkzeuge

pyhermit

Reine Python-Portierung von HermiT, dem OWL-2-DL-Reasoner aus Oxford — Konsistenzprüfung, Klassifikation und Instanzabruf über ein Hyperresolutions-Tableau, ohne JVM und ohne Laufzeitabhängigkeiten.

  • OWL 2
  • reasoner
  • symbolic
  • logic
Selbst gehostetRepository ansehen
Medien & Musik

pyimdb

Python-Metadaten-Client für IMDb. Löst Freitextabfragen zu kanonischen IMDb-Titeln auf.

  • IMDb
  • Movies
  • Metadata
  • API client
Selbst gehostetRepository ansehen
Daten & Scraping

pyinfopedia

Typisierter Python-Client für Infopédia, das europäisch-portugiesische Wörterbuch von Porto Editora — parst jeden Eintrag in IPA-Aussprachen, Silbentrennung, Etymologie und Bedeutungen und trennt dabei korrekt heterophone Homographen für G2P- und Disambiguierungsarbeit.

  • Portuguese
  • dictionary
  • IPA
  • lexicon
Selbst gehostetRepository ansehen
Daten & Scraping

pyliveatc

Python-Client für LiveATC.net — entdecken, streamen und archivieren Sie Live- und historische Flugsicherungs-Audiofeeds, mit Datensatz-Export für ASR-Training.

  • API client
  • ATC
  • audio
  • scraper
Selbst gehostetRepository ansehen
Medien & Musik

pymal

Scraper / API-Client für MyAnimeList — Anime und Manga.

  • anime
  • manga
  • scraper
Selbst gehostetRepository ansehen
Medien & Musik

pymetal

API-Client für Encyclopaedia Metallum (Metal Archives).

  • API client
  • Metal Archives
  • metal
Selbst gehostetRepository ansehen
Medien & Musik

pymusicbrainz

Python-Metadaten-Client für MusicBrainz — die offene Musik-Enzyklopädie.

  • MusicBrainz
  • Music metadata
  • API client
Selbst gehostetRepository ansehen
Daten & Scraping

pypsychonaut

Typisierter Python-Client + Markdown-Datensatz-Dumper für PsychonautWiki (psychonautwiki.org).

  • PsychonautWiki
  • Harm reduction
  • API client
  • Dataset
Selbst gehostetRepository ansehen
Daten & Scraping

pyromhacking

Python-Scraper für romhacking.net (RHDN) — die Community-Datenbank für ROM-Hacks, Fan-Übersetzungen, Patching-Werkzeuge und Dokumentation.

  • scraper
  • games
  • fan translation
Selbst gehostetRepository ansehen
Medien & Musik

pyshazam

Ein modularer, asynchroner Python-Client für die Shazam-API, aufbauend auf shazamio_core für robustes Audio-Fingerprinting.

  • Shazam
  • Audio fingerprinting
  • Music recognition
  • API client
Selbst gehostetRepository ansehen
Daten & Scraping

pysmwcentral

Python-Client für die öffentliche JSON-API von smwcentral.net — paginierter Zugriff auf den ROM-Hacking-Katalog für Super Mario World / SM64 / Yoshi's Island.

  • API client
  • games
  • scraper
Selbst gehostetRepository ansehen
Daten & Scraping

pytripsit

Client für TripSit-Drogen-Factsheets + Interaktionsmatrix (Schadensminderung).

  • TripSit
  • Harm reduction
  • Drug interactions
  • API client
Selbst gehostetRepository ansehen
Spiele

pyvndb

Python-Client für die öffentliche Kana-JSON-API von VNDB (Visual Novel Database).

  • Visual Novels
  • Games
  • API client
  • VNDB
Selbst gehostetRepository ansehen
Daten & Scraping

pywiktionary

Typisierter Python-Client für die MediaWiki-API des englischen Wiktionary.

  • Wiktionary
  • Dictionary
  • API client
  • Language
Selbst gehostetRepository ansehen
Daten & Scraping

pywod

Mehrsprachiger Aggregator-Client für Word-of-the-Day.

  • Word of the Day
  • Language
  • API client
  • Dictionary
Selbst gehostetRepository ansehen
ILENIA

raspovos-audio-setup

Audio-Autokonfigurationsbibliothek für raspOVOS — erkennt Soundkarten, HATs und USB-Geräte am Raspberry Pi und richtet sie für den Sprachassistenten-Einsatz ein; entwickelt im Rahmen des ILENIA-Projekts.

  • Raspberry Pi
  • audio
  • raspOVOS
Selbst gehostetRepository ansehen
Daten & Scraping

remailers

Anonymer E-Mail-Remailer-Client mit Unterstützung für die Protokolle Cypherpunk und Mixmaster.

  • anonymity
  • email
  • privacy
  • remailers
Selbst gehostetRepository ansehen
Phonetik & G2P

scriptconv

Abhängigkeitsfreier Kern für Schriften und Phonemnotationen — ISO-15924-Erkennung, IPA ↔ ARPABET/X-SAMPA/Kirshenbaum/Cotovía, Buckwalter ↔ Arabisch, Hangul → Jamo, Kana.

  • IPA
  • transliteration
  • phoneme notation
  • zero dependencies
Selbst gehostetRepository ansehen
Smart Home

shazam2mqtt

Dockerisierte Bridge, die Raumaudio mit Shazam per Fingerprint erkennt und Titel-Metadaten (Titel, Interpret, Coverbild, Songtext, Apple-Music-/Spotify-/Deezer-Links) via MQTT mit Home-Assistant-Auto-Discovery veröffentlicht.

  • Shazam
  • MQTT
  • Home Assistant
  • music recognition
Selbst gehostetRepository ansehen
Daten & Scraping

sitemapper

Werkzeug zur Standort-Aufklärung, um die Struktur einer Website zu erkunden, bevor Scraper gebaut werden. Kartiert robots.txt, Sitemaps und Link-Graphen mithilfe des unblock_requests-Transports für die robuste Erkundung geschützter oder komplexer Websites.

  • web scraping
  • site mapping
  • robots.txt
  • sitemap
Selbst gehostetRepository ansehen
Spracherkennung

speakeronnx

Reine onnxruntime-Sprecher-Embedding-Bibliothek — extrahieren Sie Sprecher-Embeddings, berechnen Sie die Kosinus-Ähnlichkeit und verifizieren Sie die Sprecheridentität aus ONNX-Modellen, ohne PyTorch zur Laufzeit.

  • ONNX
  • speaker embeddings
  • speaker verification
Selbst gehostetRepository ansehen
Sprachsynthese, Spracherkennung

speechonnxmetrics

Vereinheitlichte Sprachbewertungsmetriken — neuronales MOS (UTMOS, NISQA, SIGMOS, DNSMOS), intrusive (STOI, SI-SDR, MCD) und ASR (WER/CER) — nur mit numpy und onnxruntime.

  • ONNX
  • evaluation
  • MOS
  • WER
Selbst gehostetRepository ansehen
Entwicklerwerkzeuge

sshfs-keeper

Ein Daemon, der SSHFS-/rclone-Mounts überwacht und automatisch neu einbindet, wenn sie abbrechen — mit einem Live-Web-Dashboard, REST-API, Prometheus-Metriken, Webhooks und geplanten rsync-/rclone-Synchronisierungsaufgaben.

  • SSHFS
  • homelab
  • monitoring
  • self-hosted
Selbst gehostetRepository ansehen
Phonetik & G2P

stressonnx

Mehrsprachige Wortbetonungs-Platzierung für TTS-Frontends, nur mit onnxruntime und numpy.

  • ONNX
  • TTS frontend
  • word stress
Selbst gehostetRepository ansehen
Daten & Scraping

temporalis

Einheitliche, anbieterübergreifende Wetter-Abstraktionsbibliothek für Python. Fragen Sie OpenWeatherMap, Open-Meteo, MetNo, IPMA, NWS und mehr über eine konsistente API ab.

  • Weather
  • Multi-provider
  • API client
  • Open-Meteo
Selbst gehostetRepository ansehen
Phonetik & G2P

text2tashkeel

Leichtgewichtige arabische Diakritisierung (Tashkeel) — eine einzige winzige API über austauschbare ONNX-Modelle, die die fehlenden Vokalzeichen wiederherstellen, ohne PyTorch und standardmäßig offline. Treibt den Diakritisierungsschritt von arbtok an.

  • Arabic
  • diacritization
  • tashkeel
  • ONNX
Selbst gehostetRepository ansehen
NLP & Sprache

tugalex

Ein Lexikon-Handler und linguistisches Hilfswerkzeug für portugiesische Dialekte.

  • NLP
  • Portuguese
  • lexicon
Selbst gehostetRepository ansehen
NLP & Sprache

tugamorph

Regelbasierter morphologischer Analysator für Portugiesisch — segmentiert Wörter in Morpheme.

  • NLP
  • Portuguese
  • morphology
Selbst gehostetRepository ansehen
Medien & Musik

tunein

TuneIn-Radio-Scraper, der typisierte Medien-Metadaten-Releases ausgibt.

  • TuneIn
  • radio
  • scraper
Selbst gehostetRepository ansehen
Medien & Musik

tutubo

Leichtgewichtiger YouTube-Scraper, der typisierte Medien-Metadaten-Releases ausgibt.

  • YouTube
  • scraper
  • video
Selbst gehostetRepository ansehen
Daten & ScrapingEmpfohlen

unblock_requests

Eine Unterklasse von requests.Session, die Cloudflare umgeht (curl_cffi-Impersonation, FlareSolverr, Wayback-Fallback) — der Anti-Bot-Transport hinter unseren Scrapern.

  • HTTP
  • anti-bot
  • scraping
Selbst gehostetRepository ansehen
Daten & Scraping

usenet

Live-USENET-Reader und Artikel-Scraper für die Erforschung und Archivierung alternativer Protokolle.

  • USENET
  • privacy
  • protocols
  • scraping
Selbst gehostetRepository ansehen
Smart Home

vad2mqtt

Echtzeit-Voice-Activity-Detection-Bridge auf Basis von ovos-plugin-manager. Veröffentlicht die Sprachwahrscheinlichkeit (0–100 %), den Geräuschpegel (dB) und einen entprellten Binärsensor für erkannte Sprache via MQTT — mit Home-Assistant-Auto-Discovery.

  • VAD
  • MQTT
  • Home Assistant
  • OpenVoiceOS
Selbst gehostetRepository ansehen
Spracherkennung

vadonnx

Voice Activity Detection auf ONNX-Art — laden Sie beliebige VAD-Modelle hinter einer einzigen Streaming-API mit winziger Laufzeit (numpy + onnxruntime). Das VAD-Gegenstück zu phoonnx; die meisten Backends sind Daten, nicht Code.

  • ONNX
  • VAD
  • audio
  • streaming
Selbst gehostetRepository ansehen
Sprachsynthese

voiceclonnx

Reine ONNX-, Multi-Engine-Stimmkonvertierung — wandeln Sie beliebige Sprache in die Stimme eines Referenzsprechers um, ohne PyTorch zur Inferenzzeit. 14 Engines (kNN-VC, FreeVC, OpenVoice, RVC, CosyVoice…) hinter einer einzigen VoiceCloner-API, plus einer CLI und INT8-Builds.

  • ONNX
  • voice conversion
  • zero-shot
  • multilingual
Selbst gehostetRepository ansehen
Aktivierungswörter

wakeforge

Ein Wake-Word-Modelltrainer, entwickelt im Rahmen eines NLnet-Zuschusses für OpenVoiceOS — erstellen Sie eigene, geräteinterne Wake-Words aus Ihren eigenen Aufnahmen.

  • NLnet
  • on-device
  • training
  • wake word
Selbst gehostetRepository ansehen
Aktivierungswörter

ww_tagger

Flask-Webanwendung zum manuellen Labeln von Wake-Word-Audio — spielen Sie jeden Clip ab und taggen Sie Wort, Sprechergeschlecht und Geräuschtyp, um einen für Training oder Evaluierung bereiten Korpus zu erstellen.

  • labeling
  • dataset
  • Flask
Selbst gehostetRepository ansehen
Medien & Musik

xazam

Modularer, asynchroner Python-Client für die Shazam-API — Audio-Fingerprinting über shazamio-core mit typisierten Track-/Artist-Modellen und einem Katalog-Scraper.

  • Shazam
  • async
  • audio fingerprinting
Selbst gehostetRepository ansehen
Entwicklerwerkzeuge

z85base91

Kompakte Binär-zu-Text-Kodierungsbibliothek (Base91, Z85B, Z85P) — schnelle C-Implementierungen mit Pure-Python-Fallbacks, alle kompakter als base64.

  • encoding
  • serialization
Selbst gehostetRepository ansehen