Portfolio

Open Source

Notre travail open source : bibliothèques et outils libres et auto-hébergeables couvrant l'IA vocale, l'extraction de données, les datasets, le NLP et les jeux, ainsi que l'écosystème OpenVoiceOS et HiveMind que nous aidons à construire. Aucun verrouillage, aucun cloud obligatoire.


Au-delà du code, nos datasets et modèles ouverts sont publiés surHugging Face,et nos notebooks d'entraînement se trouvent dans le dépôtml-notebooks.

Communauté

Travailler avec la communauté

Nous contribuons à des partenaires indépendants et faisons don du travail financé par des fonds publics à la fondation OpenVoiceOS.

Alpha Cephei

Un partenariat en reconnaissance vocale apportant des décennies d'expertise en reconnaissance automatique de la parole (ASR) — l'équipe derrière Vosk et les modèles basés sur Kaldi — à notre travail d'affinage de modèles vocaux et de jeux de données.

ILENIA

Programme espagnol faisant progresser les technologies du langage pour les langues officielles du pays (espagnol, catalan, basque, galicien). Finance le développement d'OVOS pour créer des assistants vocaux téléchargeables et respectueux de la vie privée qui fonctionnent sur Raspberry Pi et ordinateurs personnels. Financé par le ministère espagnol de la Transformation numérique et le Plan de relance de l'UE.

NGI0 Commons Fund / NLnet

Programme Next Generation Internet de la Commission européenne (avec cofinancement du SERI suisse) soutenant OpenVoiceOS comme alternative stable et axée sur la vie privée aux assistants vocaux des géants de la tech. Axes : prise en charge multilingue, intégration des utilisateurs, stabilisation de la plateforme et documentation.

OpenVoiceOS

Une fondation indépendante à but non lucratif qui construit une plateforme d'IA vocale open source, communautaire et respectueuse de la vie privée. TigreGótico est un contributeur central d'OpenVoiceOS, et son fondateur siège au conseil d'administration de la fondation.

Explorer

À la une

Filtrez par domaine pour en explorer davantage : tout est open source.

Outils pour développeurs

agentpipe

Wrapper Python asynchrone pour les CLI d'agents de codage (Claude Code, Gemini, opencode, Antigravity) derrière une seule API Provider — sessions ponctuelles ou multi-tours, événements typés en flux continu, et motifs de pipeline fan-out/délégation/réessai.

  • agents
  • async
  • CLI
  • orchestration
Auto-hébergéVoir le dépôt
NLP et langue

Ahocorasick NER

Reconnaissance d'entités nommées à l'aide de l'algorithme d'Aho-Corasick.

  • Aho-Corasick
  • gazetteer
  • named-entity recognition
Auto-hébergéVoir le dépôt
Phonétique et G2P

ahotts-g2p

Graphème-vers-phonème en Python pur, sans dépendances et sensible à la version, pour le basque et l'espagnol — reproduisant fidèlement le front-end d'AhoTTS et émettant la chaîne IPA à caractère unique utilisée pour entraîner les voix StyleTTS2/VITS.

  • G2P
  • Basque
  • Spanish
  • IPA
Auto-hébergéVoir le dépôt
Reconnaissance vocale

ALIGN

Un outil basé sur navigateur pour aligner l'audio avec les transcriptions textuelles et l'IPA au niveau du mot, du graphème et de la phrase. Fonctionne entièrement côté client, sans serveur, sans dépendances, sans étape de compilation.

  • IPA
  • audio-text alignment
  • browser-based
  • JavaScript
Auto-hébergéVoir le dépôt
Données et scraping

anon_requests

HTTP anonyme avec rotation d'IP ; se combine avec unblock_requests pour la rotation et le contournement des murs anti-bot.

  • HTTP
  • IP rotation
  • privacy
Auto-hébergéVoir le dépôt
Phonétique et G2P

arbtok

Conversion arabe (MSA) texte-vers-IPA à base de règles avec diacritisation tashkeel, construite sur orthography2ipa — un arbre de tokens sensible au contexte gère l'assimilation des lettres solaires, la hamzat al-waṣl, le tanwīn et le tāʾ marbūṭa, en diacritisant d'abord le texte nu via des modèles ONNX intégrés.

  • Arabic
  • G2P
  • IPA
  • diacritization
Auto-hébergéVoir le dépôt
Médias et musique

audiobooker

Rechercher et diffuser des livres audio du domaine public depuis LibriVox et des sources similaires.

  • LibriVox
  • audiobooks
  • scraper
Auto-hébergéVoir le dépôt
Synthèse vocale

audiosronnx

Restauration de la parole, débruitage et extension de bande passante en pur ONNX — élève la parole à bande étroite jusqu'à 48 kHz sans torch à l'exécution.

  • ONNX
  • audio super-resolution
  • speech enhancement
Auto-hébergéVoir le dépôt
Outils pour développeurs

baresipy

Bibliothèque cliente HTTP minimale pour Python — alternative légère à requests.

  • HTTP
  • Python
  • client
  • lightweight
Auto-hébergéVoir le dépôt
Phonétique et G2P

bifonia

Désambiguïsation des homographes hétérophones du portugais européen pour la TTS — choisit la bonne prononciation des mots écrits à l'identique mais lus différemment selon le sens (sede = soif ou siège, forma = moule ou forme). Règles en Python pur plus modèles appris, avec des jeux de données ouverts.

  • grapheme-to-phoneme
  • TTS
  • homographs
  • word-sense disambiguation
Auto-hébergéVoir le dépôt
NLP et langue

brill_postaggers

Étiqueteurs morphosyntaxiques de Brill pré-entraînés pour 11 langues, livrés sous forme de modèles picklés prêts à l'emploi sur NLTK — étiquetez du texte sans entraînement.

  • POS tagging
  • 11 languages
  • NLTK
Auto-hébergéVoir le dépôt
Synthèse vocale

Chatterbox ONNX

Moteur d'inférence basé sur ONNX pour l'IA conversationnelle.

  • ONNX inference
  • conversational TTS
  • on-device
Auto-hébergéVoir le dépôt
Médias et musique

classical-archives

Paquet Python pour récupérer des informations sur les compositeurs classiques depuis Classical Archives.

  • Classical music
  • API client
  • Music archives
Auto-hébergéVoir le dépôt
NLP et langue

crf_query_xtract

Extracteur multilingue de mots-clés/termes de recherche par CRF — extrait la requête d'une question en langage naturel à l'aide d'un CRF sur des caractéristiques POS et orthographiques, avec des modèles pré-entraînés par langue.

  • keyword extraction
  • CRF
  • multilingual
Auto-hébergéVoir le dépôt
Phonétique et G2P

desacordo_ortografico

Détecter et convertir entre sept normes orthographiques portugaises — l'écriture étymologique d'avant 1911, les réformes de 1911/1943/1945/1971/1973, et l'Acordo Ortográfico de 1990 avec ses sous-variantes européenne et brésilienne.

  • Portuguese
  • orthography
  • AO1990
  • text conversion
Auto-hébergéVoir le dépôt
Phonétique et G2P

espyak

Réimplémentation en Python pur, sans dépendances, du front-end graphème-vers-phonème d'espeak-ng — texte vers phonèmes uniquement, sans extension C. Reproduit le binaire espeak-ng octet pour octet sur un balayage de 86 langues au niveau des lemmes et un corpus de phrases en 31 langues ; 117 langues intégrées.

  • G2P
  • IPA
  • phonemization
  • espeak-ng
Auto-hébergéVoir le dépôt
Phonétique et G2P

euskaphone

Phonémiseur basque texte-vers-IPA sensible aux dialectes, bâti sur le treillis de prononciation partagé orthography2ipa — ouvert, inspectable et sourcé.

  • Basque
  • G2P
  • IPA
  • TTS frontend
Auto-hébergéVoir le dépôt
Voice PlatformsEn vedette

HiveMind

Un protocole pour bâtir des réseaux hiérarchiques d'agents — des appareils satellites légers se connectent via un maillage chiffré à n'importe quel agent conversationnel, d'OpenVoiceOS aux personas LLM et aux agents A2A arbitraires. L'écosystème couvre protocoles de transport, satellites vocaux, passerelles de chat, cryptographie et découverte sans configuration.

  • agent networks
  • distributed voice
  • protocol
Auto-hébergéVoir le dépôt
NLnet

hivemind-a2a-agent-plugin

Plugin de protocole d'agent A2A pour hivemind-core — relie la hive à des serveurs Agent-to-Agent (A2A) externes via JSON-RPC 2.0, avec réponses diffusées vers les satellites.

  • A2A
  • agent
  • interoperability
Auto-hébergéVoir le dépôt
NLP et langue

lingua-podre

Détecteur de langue en Python pur, d'une extrême simplicité, basé sur des listes de mots.

  • NLP
  • language detection
Auto-hébergéVoir le dépôt
Maison connectée

linux2mqtt

Publier la télémétrie électrique et système d'un Linux/SBC vers Home Assistant via MQTT — CPU/GPU/RAM/disque, températures, throttling, audio + MPRIS, WiFi/Bluetooth — le tout auto-découvert. Construit sur powerguess.

  • MQTT
  • Home Assistant
  • power
  • system monitoring
Auto-hébergéVoir le dépôt
NLP et langue

MarkovJSON

Génération de texte par chaîne de Markov à partir de données JSON.

  • JSON
  • Markov chains
  • text generation
Auto-hébergéVoir le dépôt
Médias et musique

media-archivist

Indexer, canonicaliser, dédupliquer et servir des catalogues média depuis YouTube et d'autres sources.

  • catalogue
  • homelab
  • indexing
  • media
Auto-hébergéVoir le dépôt
Médias et musiqueEn vedette

mediavocab

Un vocabulaire partagé de métadonnées média et une couche de normalisation qui unifient la façon dont les titres, artistes et identifiants sont mis en correspondance entre les clients média et les intégrations Music Assistant.

  • media metadata
  • normalization
  • vocabulary
Auto-hébergéVoir le dépôt
Médias et musique

metadatarr

Clients de métadonnées média propulsés par Pydantic et un résolveur d'entités inter-sources sans clé.

  • Pydantic
  • media metadata
  • resolver
Auto-hébergéVoir le dépôt
Outils pour développeurs

nupyml

Une bibliothèque d'apprentissage automatique et de réseaux de neurones façon scikit-learn, avec numpy et scipy pour seules dépendances — écrite pour être lue.

  • machine learning
  • numpy
  • education
Auto-hébergéVoir le dépôt
Médias et musique

nuvem_de_som

Client SoundCloud qui émet des publications de métadonnées média typées.

  • SoundCloud
  • music
  • scraper
Auto-hébergéVoir le dépôt
Voice PlatformsEn vedette

Open Voice OS

Plateforme d'assistant vocal open source, communautaire et respectueuse de la vie privée. TigreGótico est un contributeur central de tout l'écosystème — maintenant plugins vocaux, services STT/TTS, outillage développeur et travail de spécification formelle sur des dizaines de dépôts.

  • FOSS
  • privacy-first
  • voice platform
Auto-hébergéVoir le dépôt
Outils pour développeurs

OpenTone

Boîte à outils de transmission de données par le son en Python pur — transportez texte et données via un canal audio (DTMF et plus) à l'aide de primitives WAV/sinus/Goertzel partagées. Les schémas de base sont sans dépendances.

  • data-over-sound
  • DTMF
  • audio
  • signal processing
Auto-hébergéVoir le dépôt
Phonétique et G2PEn vedette

orthography2ipa

Correspondances graphème-vers-IPA et allophones pour plus de 350 langues réparties sur plus de 20 familles — un tokeniseur IPA à correspondance maximale, des métriques de distance phonologique et scripturale, des transformations dialectales et un moteur G2P enfichable.

  • 350+ languages
  • G2P
  • IPA
  • phonemization
Auto-hébergéVoir le dépôt
NLnet

OVOS Agentic Loop

Framework d'intégration d'agents pour OpenVoiceOS — activez des workflows agentiques pilotés par la voix.

  • OpenVoiceOS
  • agentic
  • agents
  • integration
Auto-hébergéVoir le dépôt
NLnet

ovos-busmon

Moniteur de messagebus pour OpenVoiceOS — observez le trafic du bus en direct pour déboguer skills, intents et services.

  • messagebus
  • debugging
  • monitoring
Auto-hébergéVoir le dépôt
NLnet

ovos-localize

Une plateforme de localisation native GitHub pour les skills et plugins OpenVoiceOS — gérez les traductions entièrement via Git, sans service externe à exécuter.

  • GitHub-native
  • i18n
  • localization
  • no-infra
Auto-hébergéVoir le dépôt
ILENIA

OVOS M2V Pipeline

Pipeline d'intentions Model2Vec pour la gestion des intentions dans OpenVoiceOS.

  • Model2Vec
  • ONNX models
  • intent classification
  • NLnet
Auto-hébergéVoir le dépôt
NLnet

ovos-messagebus-chat-plugin

Plugin ChatEngine d'OVOS qui relaie les tours de conversation via le messagebus d'OVOS — connectez des interfaces de chat directement à un assistant en cours d'exécution.

  • chat
  • messagebus
  • plugin
Auto-hébergéVoir le dépôt
ILENIA

ovos-opendata-server

Serveur de métriques en données ouvertes pour OpenVoiceOS — collecte des métriques d'usage anonymes et les publie en jeux de données ouverts ; développé dans le cadre du projet ILENIA.

  • metrics
  • open data
  • server
Auto-hébergéVoir le dépôt
NLnet

ovos-plugin-arena

Arène de benchmarking pour les plugins OVOS — duels directs avec classements ELO pour comparer les implémentations STT, TTS et autres sur des charges réelles.

  • benchmark
  • ELO
  • plugins
Auto-hébergéVoir le dépôt
NLnet

ovos-stt-server

Hébergez n'importe quel plugin STT d'OpenVoiceOS comme service réseau — un petit serveur exposant la reconnaissance vocale en HTTP pour satellites et clients tiers.

  • STT
  • server
  • self-hosted
Auto-hébergéVoir le dépôt
NLnet

ovos-tts-server

Hébergez n'importe quel plugin TTS d'OpenVoiceOS comme service — un simple serveur flask qui transforme tout plugin TTS en API de synthèse vocale auto-hébergée.

  • TTS
  • server
  • self-hosted
Auto-hébergéVoir le dépôt
NLnet

ovos_tts_transformer_FlashSR

Super-résolution audio pour la TTS d'OVOS — FlashSR élève la parole synthétisée de 16 kHz à 48 kHz via ONNX avant lecture, éclaircissant toute voix existante sans réentraînement.

  • TTS
  • super-resolution
  • ONNX
Auto-hébergéVoir le dépôt
NLnet

ovos_tts_transformer_NovaSR

Super-résolution audio pour la TTS d'OVOS — NovaSR élève la parole synthétisée de 16 kHz à 48 kHz avec le rapide upsampler FastSR, en ignorant l'audio déjà à 48 kHz.

  • TTS
  • super-resolution
  • ONNX
Auto-hébergéVoir le dépôt
NLnet

ovoscope

Framework de test de bout en bout pour les skills OVOS avec un runtime léger intégré au processus.

  • OVOS skills
  • end-to-end testing
  • in-process runtime
Auto-hébergéVoir le dépôt
NLnet, NLP et langue

palavreado

Parseur d'intentions par mots-clés on ne peut plus simple — remplaçant direct d'Adapt qui compare les énoncés à des slots de mots-clés requis/optionnels ; né chez TigreGótico et offert à OpenVoiceOS.

  • intent parsing
  • NLP
Auto-hébergéVoir le dépôt
Synthèse vocaleEn vedette

phoonnx

Une bibliothèque Python pour la phonémisation multilingue et la synthèse vocale (TTS) à l'aide de modèles ONNX.

  • ONNX models
  • multilingual TTS
  • phonemization
Auto-hébergéVoir le dépôt
Synthèse vocale

phoonnx-AddonNVDA

Add-on Windows pour le lecteur d'écran NVDA qui parle via les voix neuronales ONNX de phoonnx, démontrant phoonnx comme backend TTS d'accessibilité.

  • NVDA
  • accessibility
  • screen reader
  • ONNX
Auto-hébergéVoir le dépôt
Synthèse vocale

phoonnx.js

Inférence TTS VITS dans le navigateur avec onnxruntime-web. Chemins Unicode et espeak-ng. Sans serveur, sans API.

  • ONNX
  • TTS
  • browser
  • VITS
Auto-hébergéVoir le dépôt
Données et scraping

pombo_correio

Contrôleur de navigateur automatisé construit sur Selenium et Selenium Wire — sessions, gestion d'événements, interaction avec les éléments et gestion des extensions pour le scraping et les tests là où un navigateur complet est incontournable.

  • browser automation
  • Selenium
  • scraper
Auto-hébergéVoir le dépôt
Maison connectée

powerguess

Estimer ou mesurer la consommation électrique d'un appareil Linux — une bibliothèque Python à faibles dépendances avec une traçabilité sur chaque relevé (INA219, RAPL, PMIC Raspberry Pi, batterie, ou une estimation calibrée et bornée).

  • power
  • energy
  • RAPL
  • INA219
Auto-hébergéVoir le dépôt
Mots d'activation

precise-onnx-js

Portage navigateur/Node.js de la détection de mot d'activation precise-onnx. Extraction de caractéristiques MFCC et détection basée sur ONNX, compatible avec les modèles Precise .onnx.

  • ONNX
  • Wake words
  • Web
  • Audio
Auto-hébergéVoir le dépôt
NLP et langue

pronomial

Résolution de coréférence via les POS des pronoms et des heuristiques de genre des mots.

  • NLP
  • coreference
Auto-hébergéVoir le dépôt
Médias et musique

py_bandcamp

Scraper Bandcamp qui émet des publications de métadonnées média typées.

  • Bandcamp
  • music
  • scraper
Auto-hébergéVoir le dépôt
Maison connectée

py-music-assistant

Client HTTP Python et pont mediavocab pour un serveur Music Assistant — la couche partagée de transport et de conversion derrière l'intégration OVOS Music Assistant.

  • Music Assistant
  • media metadata
  • API client
Auto-hébergéVoir le dépôt
ILENIA

pyAhoTTS

Bibliothèque Python pour la synthèse vocale AhoTTS.

  • AhoTTS
  • ILENIA project
  • Python
  • TTS library
Auto-hébergéVoir le dépôt
ILENIA

pyAhoTTS-Iparrahotsa

Portage Python d'AhoTTS Iparrahotsa, un moteur de synthèse vocale pour le basque septentrional (continental) — le pendant du dialecte d'Iparralde de pyAhoTTS, avec hts_engine et le vocodeur AhoCoder. Développé avec Aholab (UPV/EHU).

  • AhoTTS
  • Basque
  • ILENIA
  • TTS library
Auto-hébergéVoir le dépôt
Phonétique et G2P

pycotovia

Portage en Python pur du front-end G2P Cotovia pour le galicien et l'espagnol. Reproduit la syllabification, l'accentuation et le pipeline de transcription du binaire C compilé, sans sous-processus.

  • G2P
  • Galician
  • Spanish
  • phonemization
Auto-hébergéVoir le dépôt
Médias et musique

pydiscogs

Client Python en flux continu pour les dumps de données mensuels de Discogs.

  • Discogs
  • Music metadata
  • Data dumps
  • API client
Auto-hébergéVoir le dépôt
Données et scraping

pyerowid

Client Python typé + exportateur de jeux de données markdown pour Erowid (erowid.org).

  • Erowid
  • Harm reduction
  • API client
  • Dataset
Auto-hébergéVoir le dépôt
Outils pour développeurs

pyeye

Portage en Python pur du moteur de raisonnement EYE N3 — fournissez-lui des faits et règles en Notation3 et il dérive de nouveaux faits par chaînage avant/arrière, entailment RDFS et OWL 2 RL, arbres de preuve et plus de 280 fonctions intégrées. Une seule dépendance (rdflib).

  • N3
  • reasoner
  • RDF
  • forward chaining
Auto-hébergéVoir le dépôt
Jeux

pyFrotz

Wrapper Python pour un moteur de fiction interactive.

  • Python
  • Z-machine
  • game
  • interactive fiction
Auto-hébergéVoir le dépôt
Médias et musique

pygutenberg

Client Python pour Project Gutenberg — métadonnées de livres via le catalogue ouvert.

  • Project Gutenberg
  • Books
  • API client
  • Literature
Auto-hébergéVoir le dépôt
Outils pour développeurs

pyhermit

Portage en Python pur de HermiT, le raisonneur OWL 2 DL d'Oxford — cohérence, classification et récupération d'instances via un tableau à hyperrésolution, sans JVM et sans dépendances à l'exécution.

  • OWL 2
  • reasoner
  • symbolic
  • logic
Auto-hébergéVoir le dépôt
Médias et musique

pyimdb

Client de métadonnées Python pour IMDb. Résout les requêtes en texte libre vers des titres IMDb canoniques.

  • IMDb
  • Movies
  • Metadata
  • API client
Auto-hébergéVoir le dépôt
Données et scraping

pyinfopedia

Client Python typé pour Infopédia, le dictionnaire de portugais européen de Porto Editora — analyse chaque entrée en prononciations IPA, syllabification, étymologie et sens, séparant correctement les homographes hétérophones pour le travail de G2P et de désambiguïsation.

  • Portuguese
  • dictionary
  • IPA
  • lexicon
Auto-hébergéVoir le dépôt
Données et scraping

pyinspirobot

Un paquet Python pour interagir avec InspiroBot (inspirobot.me).

  • InspiroBot
  • Quotes
  • API client
  • Fun
Auto-hébergéVoir le dépôt
Données et scraping

pyliveatc

Client Python pour LiveATC.net — découvrez, diffusez et archivez des flux audio de contrôle aérien en direct et historiques, avec export de jeux de données pour l'entraînement ASR.

  • API client
  • ATC
  • audio
  • scraper
Auto-hébergéVoir le dépôt
Médias et musique

pymal

Scraper / client d'API pour MyAnimeList — anime et manga.

  • anime
  • manga
  • scraper
Auto-hébergéVoir le dépôt
Médias et musique

pymetal

Client de l'API Encyclopaedia Metallum (Metal Archives).

  • API client
  • Metal Archives
  • metal
Auto-hébergéVoir le dépôt
Médias et musique

pymusicbrainz

Client de métadonnées Python pour MusicBrainz — l'encyclopédie musicale ouverte.

  • MusicBrainz
  • Music metadata
  • API client
Auto-hébergéVoir le dépôt
Données et scraping

pypsychonaut

Client Python typé + exportateur de jeux de données markdown pour PsychonautWiki (psychonautwiki.org).

  • PsychonautWiki
  • Harm reduction
  • API client
  • Dataset
Auto-hébergéVoir le dépôt
Données et scraping

pyromhacking

Scraper Python pour romhacking.net (RHDN) — la base de données communautaire de ROM hacks, traductions de fans, utilitaires de patch et documentation.

  • scraper
  • games
  • fan translation
Auto-hébergéVoir le dépôt
Médias et musique

pyshazam

Un client Python modulaire et asynchrone pour l'API Shazam, construit sur shazamio_core pour une empreinte audio robuste.

  • Shazam
  • Audio fingerprinting
  • Music recognition
  • API client
Auto-hébergéVoir le dépôt
Données et scraping

pysmwcentral

Client Python pour l'API JSON publique de smwcentral.net — accès paginé au catalogue de ROM-hacking Super Mario World / SM64 / Yoshi's Island.

  • API client
  • games
  • scraper
Auto-hébergéVoir le dépôt
Données et scraping

pytripsit

Client des fiches de drogues TripSit + matrice d'interactions (réduction des risques).

  • TripSit
  • Harm reduction
  • Drug interactions
  • API client
Auto-hébergéVoir le dépôt
Médias et musique

pytvtropes

Scraper HTML Python pour le PmWiki de tvtropes.org.

  • TV Tropes
  • Media analysis
  • Scraper
Auto-hébergéVoir le dépôt
Jeux

pyvndb

Client Python pour l'API JSON publique kana de VNDB (Visual Novel Database).

  • Visual Novels
  • Games
  • API client
  • VNDB
Auto-hébergéVoir le dépôt
Données et scraping

pywiktionary

Client Python typé pour l'API MediaWiki du Wiktionary anglais.

  • Wiktionary
  • Dictionary
  • API client
  • Language
Auto-hébergéVoir le dépôt
Données et scraping

pywod

Client agrégateur de mots du jour multilingue.

  • Word of the Day
  • Language
  • API client
  • Dictionary
Auto-hébergéVoir le dépôt
Médias et musique

radiosoma

Client SomaFM qui émet des publications de métadonnées média typées.

  • SomaFM
  • client
  • radio
Auto-hébergéVoir le dépôt
NLP et langue

RAKE Keywords

Implémentation de l'extraction rapide et automatique de mots-clés (Rapid Automatic Keyword Extraction).

  • NLP
  • RAKE
  • keyword extraction
Auto-hébergéVoir le dépôt
ILENIA

raspovos-audio-setup

Bibliothèque d'auto-configuration audio pour raspOVOS — détecte cartes son, HATs et périphériques USB sur Raspberry Pi et les configure pour l'assistant vocal ; développée dans le cadre du projet ILENIA.

  • Raspberry Pi
  • audio
  • raspOVOS
Auto-hébergéVoir le dépôt
Données et scraping

remailers

Client de remailer d'e-mails anonymes prenant en charge les protocoles Cypherpunk et Mixmaster.

  • anonymity
  • email
  • privacy
  • remailers
Auto-hébergéVoir le dépôt
Phonétique et G2P

scriptconv

Noyau sans dépendances pour écritures et notations phonémiques — détection ISO-15924, IPA ↔ ARPABET/X-SAMPA/Kirshenbaum/Cotovía, Buckwalter ↔ arabe, Hangul → jamo, kana.

  • IPA
  • transliteration
  • phoneme notation
  • zero dependencies
Auto-hébergéVoir le dépôt
Maison connectée

shazam2mqtt

Passerelle dockerisée qui identifie l'audio d'une pièce avec Shazam et publie les métadonnées des morceaux (titre, artiste, pochette, paroles, liens Apple Music / Spotify / Deezer) vers MQTT avec l'auto-découverte Home Assistant.

  • Shazam
  • MQTT
  • Home Assistant
  • music recognition
Auto-hébergéVoir le dépôt
Phonétique et G2P

Silabificador

Outil de syllabification de texte portugais.

  • Portuguese syllabification
  • text processing
  • Portuguese
Auto-hébergéVoir le dépôt
Données et scraping

sitemapper

Utilitaire de reconnaissance de sites pour apprendre la structure d'un site avant de construire des scrapers. Cartographie robots.txt, les sitemaps et les graphes de liens à l'aide du transport unblock_requests pour une exploration résiliente des sites protégés ou complexes.

  • web scraping
  • site mapping
  • robots.txt
  • sitemap
Auto-hébergéVoir le dépôt
Reconnaissance vocale

speakeronnx

Bibliothèque d'embeddings de locuteur en onnxruntime pur — extrayez des embeddings de locuteur, calculez la similarité cosinus et vérifiez l'identité d'un locuteur à partir de modèles ONNX, sans PyTorch à l'exécution.

  • ONNX
  • speaker embeddings
  • speaker verification
Auto-hébergéVoir le dépôt
Synthèse vocale, Reconnaissance vocale

speechonnxmetrics

Métriques unifiées d'évaluation de la parole — MOS neuronal (UTMOS, NISQA, SIGMOS, DNSMOS), intrusives (STOI, SI-SDR, MCD) et ASR (WER/CER) — avec uniquement numpy et onnxruntime.

  • ONNX
  • evaluation
  • MOS
  • WER
Auto-hébergéVoir le dépôt
Outils pour développeurs

sshfs-keeper

Un démon qui surveille les montages SSHFS/rclone et les remonte automatiquement lorsqu'ils tombent — avec un tableau de bord web en direct, une API REST, des métriques Prometheus, des webhooks et des tâches de synchronisation rsync/rclone planifiées.

  • SSHFS
  • homelab
  • monitoring
  • self-hosted
Auto-hébergéVoir le dépôt
Phonétique et G2P

stressonnx

Placement multilingue de l'accent lexical pour les front-ends TTS, avec uniquement onnxruntime et numpy.

  • ONNX
  • TTS frontend
  • word stress
Auto-hébergéVoir le dépôt
Données et scraping

temporalis

Bibliothèque Python unifiée d'abstraction météo multifournisseur. Interrogez OpenWeatherMap, Open-Meteo, MetNo, IPMA, NWS et d'autres via une seule API cohérente.

  • Weather
  • Multi-provider
  • API client
  • Open-Meteo
Auto-hébergéVoir le dépôt
Phonétique et G2P

text2tashkeel

Diacritisation arabe légère (tashkeel) — une unique API minuscule sur des modèles ONNX interchangeables qui restaurent les marques vocaliques manquantes, sans PyTorch et hors ligne par défaut. Propulse l'étape de diacritisation d'arbtok.

  • Arabic
  • diacritization
  • tashkeel
  • ONNX
Auto-hébergéVoir le dépôt
NLP et langue

tugalex

Un gestionnaire de lexique et un utilitaire linguistique pour les dialectes portugais.

  • NLP
  • Portuguese
  • lexicon
Auto-hébergéVoir le dépôt
NLP et langue

tugamorph

Analyseur morphologique à base de règles pour le portugais — segmente les mots en morphèmes.

  • NLP
  • Portuguese
  • morphology
Auto-hébergéVoir le dépôt
Phonétique et G2P

TugaPhone

Outils graphème-vers-phonème pour le portugais.

  • Portuguese phonemes
  • dataset
  • phonetics
  • Portuguese
Auto-hébergéVoir le dépôt
Médias et musique

tunein

Scraper radio TuneIn qui émet des publications de métadonnées média typées.

  • TuneIn
  • radio
  • scraper
Auto-hébergéVoir le dépôt
Médias et musique

tutubo

Scraper YouTube léger qui émet des publications de métadonnées média typées.

  • YouTube
  • scraper
  • video
Auto-hébergéVoir le dépôt
Données et scrapingEn vedette

unblock_requests

Une sous-classe de requests.Session qui contourne Cloudflare (impersonation curl_cffi, FlareSolverr, repli Wayback) — le transport anti-bot derrière nos scrapers.

  • HTTP
  • anti-bot
  • scraping
Auto-hébergéVoir le dépôt
Données et scraping

usenet

Lecteur USENET en direct et scraper d'articles pour la recherche et l'archivage de protocoles alternatifs.

  • USENET
  • privacy
  • protocols
  • scraping
Auto-hébergéVoir le dépôt
Maison connectée

vad2mqtt

Passerelle de détection d'activité vocale en temps réel utilisant ovos-plugin-manager. Publie la probabilité de parole (0–100 %), le niveau de bruit (dB) et un capteur binaire de parole détectée anti-rebond vers MQTT — avec auto-découverte Home Assistant.

  • VAD
  • MQTT
  • Home Assistant
  • OpenVoiceOS
Auto-hébergéVoir le dépôt
Reconnaissance vocale

vadonnx

La détection d'activité vocale façon ONNX — chargez n'importe quel modèle VAD derrière une seule API en flux continu avec un runtime minuscule (numpy + onnxruntime). Le pendant VAD de phoonnx ; la plupart des backends sont des données, pas du code.

  • ONNX
  • VAD
  • audio
  • streaming
Auto-hébergéVoir le dépôt
Synthèse vocale

voiceclonnx

Conversion de voix multi-moteurs en ONNX pur — transformez n'importe quelle parole vers la voix d'un locuteur de référence sans PyTorch à l'inférence. 14 moteurs (kNN-VC, FreeVC, OpenVoice, RVC, CosyVoice…) derrière une seule API VoiceCloner, plus une CLI et des builds INT8.

  • ONNX
  • voice conversion
  • zero-shot
  • multilingual
Auto-hébergéVoir le dépôt
Mots d'activation

wakeforge

Un entraîneur de modèles de mots d'activation développé dans le cadre d'une subvention NLnet pour OpenVoiceOS — créez des mots d'activation personnalisés et embarqués à partir de vos propres échantillons.

  • NLnet
  • on-device
  • training
  • wake word
Auto-hébergéVoir le dépôt
Mots d'activation

ww_tagger

Application web Flask pour l'étiquetage manuel d'audio de mots d'activation — jouez chaque extrait et étiquetez le mot, le genre du locuteur et le type de bruit, en constituant un corpus prêt pour l'entraînement ou l'évaluation.

  • labeling
  • dataset
  • Flask
Auto-hébergéVoir le dépôt
NLnet

Wyoming OVOS ASR

Service ASR OpenVoiceOS pour le protocole Wyoming — reconnaissance vocale légère.

  • Home Assistant
  • ASR
  • Wyoming
  • protocol
Auto-hébergéVoir le dépôt
Médias et musique

xazam

Client Python modulaire et asynchrone pour l'API Shazam — empreinte audio via shazamio-core avec des modèles Track/Artist typés et un scraper de catalogue.

  • Shazam
  • async
  • audio fingerprinting
Auto-hébergéVoir le dépôt
Outils pour développeurs

z85base91

Bibliothèque compacte d'encodage binaire-vers-texte (Base91, Z85B, Z85P) — implémentations C rapides avec replis en pur Python, toutes plus compactes que base64.

  • encoding
  • serialization
Auto-hébergéVoir le dépôt