Portfolio

Open Source

Il nostro lavoro open source — librerie e strumenti FOSS e auto-ospitabili che spaziano dall'IA vocale all'estrazione dati, dataset, NLP e giochi, oltre all'ecosistema OpenVoiceOS e HiveMind che aiutiamo a costruire. Nessun lock-in, nessun cloud obbligatorio.


Oltre al codice, i nostri dataset e modelli aperti sono pubblicati suHugging Face,e i nostri notebook di addestramento risiedono nel repositoryml-notebooks.

Comunità

Lavorare con la comunità

Contribuiamo a partner indipendenti e doniamo il lavoro finanziato con fondi pubblici alla fondazione OpenVoiceOS.

Alpha Cephei

Una partnership sul riconoscimento vocale che porta decenni di competenza nel riconoscimento vocale automatico (ASR) — il team dietro Vosk e i modelli basati su Kaldi — al nostro lavoro di fine-tuning dei modelli vocali e sui dataset.

ILENIA

Programma spagnolo che promuove la tecnologia linguistica per le lingue ufficiali del paese (spagnolo, catalano, basco, galiziano). Finanzia lo sviluppo di OVOS per creare assistenti vocali scaricabili e rispettosi della privacy che funzionano su Raspberry Pi e personal computer. Finanziato dal Ministero spagnolo della Trasformazione Digitale e dal Piano di Ripresa dell'UE.

NGI0 Commons Fund / NLnet

Programma Next Generation Internet della Commissione Europea (con cofinanziamento svizzero SERI) che supporta OpenVoiceOS come alternativa stabile e attenta alla privacy agli assistenti vocali delle Big Tech. Obiettivo: supporto multilingue, onboarding degli utenti, stabilizzazione della piattaforma e documentazione.

OpenVoiceOS

Una fondazione indipendente senza scopo di lucro che costruisce una piattaforma di IA vocale open source, guidata dalla comunità e rispettosa della privacy. TigreGótico è un contributore fondamentale di OpenVoiceOS e il suo fondatore fa parte del consiglio della fondazione.

Esplora

In primo piano

Filtra per area per esplorare di più — tutto è open source.

Strumenti per sviluppatori

agentpipe

Wrapper Python asincrono per le CLI di agenti di coding (Claude Code, Gemini, opencode, Antigravity) dietro un'unica Provider API — sessioni one-shot e multi-turno, eventi di streaming tipizzati e pattern di pipeline fan-out/delegate/retry.

  • agents
  • async
  • CLI
  • orchestration
Fonetica e G2P

ahotts-g2p

Grafema-fonema in puro Python, senza dipendenze e consapevole della versione per il basco e lo spagnolo — riproduce fedelmente il front-end di AhoTTS ed emette la stringa IPA a carattere singolo usata per addestrare le voci StyleTTS2/VITS.

  • G2P
  • Basque
  • Spanish
  • IPA
Riconoscimento vocale

ALIGN

Uno strumento basato su browser per allineare audio con trascrizioni testuali e IPA a livello di parola, grafema e frase. Funziona interamente lato client, senza server, senza dipendenze, senza fase di build.

  • IPA
  • audio-text alignment
  • browser-based
  • JavaScript
Dati e Scraping

anon_requests

HTTP anonimo con rotazione degli IP; si combina con unblock_requests per unire rotazione e aggiramento dei muri anti-bot.

  • HTTP
  • IP rotation
  • privacy
Fonetica e G2P

arbtok

Conversione testo-IPA per l'arabo (MSA) basata su regole con diacritizzazione tashkeel, costruita su orthography2ipa — un albero di token sensibile al contesto gestisce l'assimilazione delle lettere solari, la hamzat al-waṣl, il tanwīn e la tāʾ marbūṭa, diacritizzando prima il testo nudo tramite modelli ONNX inclusi.

  • Arabic
  • G2P
  • IPA
  • diacritization
Sintesi vocale

audiosronnx

Restauro vocale, riduzione del rumore ed estensione di banda in puro ONNX — porta il parlato a banda stretta a 48 kHz senza torch a runtime.

  • ONNX
  • audio super-resolution
  • speech enhancement
Strumenti per sviluppatori

baresipy

Libreria client HTTP minimale per Python — alternativa leggera a requests.

  • HTTP
  • Python
  • client
  • lightweight
Fonetica e G2P

bifonia

Disambiguazione degli omografi eterofonici per il portoghese europeo nel TTS — sceglie la pronuncia corretta di parole scritte allo stesso modo ma lette diversamente a seconda del significato (sede = sete vs sede aziendale, forma = stampo vs forma). Regole in puro Python più modelli addestrati, con dataset aperti.

  • grapheme-to-phoneme
  • TTS
  • homographs
  • word-sense disambiguation
NLP e Lingua

brill_postaggers

Etichettatori delle parti del discorso di Brill pre-addestrati per 11 lingue, forniti come modelli pickle pronti all'uso su NLTK — etichetta il testo senza addestramento.

  • POS tagging
  • 11 languages
  • NLTK
Media e Musica

classical-archives

Pacchetto Python per recuperare informazioni sui compositori classici da Classical Archives.

  • Classical music
  • API client
  • Music archives
NLP e Lingua

crf_query_xtract

Estrattore multilingue di parole chiave/termini di ricerca basato su CRF — estrae la query da una domanda in linguaggio naturale tramite un CRF su feature POS e ortografiche, con modelli pre-addestrati per lingua.

  • keyword extraction
  • CRF
  • multilingual
Fonetica e G2P

desacordo_ortografico

Rileva e converte tra sette norme ortografiche portoghesi — la scrittura etimologica pre-1911, le riforme del 1911/1943/1945/1971/1973 e l'Acordo Ortográfico del 1990 con le sue sotto-varianti europea e brasiliana.

  • Portuguese
  • orthography
  • AO1990
  • text conversion
Fonetica e G2P

espyak

Reimplementazione in puro Python e priva di dipendenze del front-end grafema-fonema di espeak-ng — solo da testo a fonemi, senza estensione C. Riproduce il binario di espeak-ng byte per byte su una sweep di headword in 86 lingue e un corpus di frasi in 31 lingue; 117 lingue incluse.

  • G2P
  • IPA
  • phonemization
  • espeak-ng
Fonetica e G2P

euskaphone

Fonemizzatore basco testo-IPA sensibile ai dialetti, costruito sul reticolo di pronuncia condiviso orthography2ipa — aperto, ispezionabile e con fonti citate.

  • Basque
  • G2P
  • IPA
  • TTS frontend
Voice PlatformsIn evidenza

HiveMind

Un protocollo per costruire reti gerarchiche di agenti — dispositivi satellite leggeri si collegano tramite una mesh cifrata a qualsiasi agente conversazionale, da OpenVoiceOS alle persona LLM fino ad agenti A2A arbitrari. L'ecosistema comprende protocolli di trasporto, satelliti vocali, bridge di chat, crittografia e discovery a zero configurazione.

  • agent networks
  • distributed voice
  • protocol
NLnet

hivemind-a2a-agent-plugin

Plugin di protocollo agente A2A per hivemind-core — collega la hive a server esterni Agent-to-Agent (A2A) via JSON-RPC 2.0, trasmettendo le risposte ai satelliti.

  • A2A
  • agent
  • interoperability
Casa intelligente

linux2mqtt

Pubblica la telemetria di potenza e di sistema di un Linux/SBC su Home Assistant tramite MQTT — CPU/GPU/RAM/disco, temperature, throttling, audio + MPRIS, WiFi/Bluetooth — tutto con auto-discovery. Costruito su powerguess.

  • MQTT
  • Home Assistant
  • power
  • system monitoring
Media e Musica

media-archivist

Indicizza, canonicalizza, deduplica e distribuisce cataloghi multimediali da YouTube e altre fonti.

  • catalogue
  • homelab
  • indexing
  • media
Media e MusicaIn evidenza

mediavocab

Un vocabolario condiviso di metadati multimediali e uno strato di normalizzazione che unifica il modo in cui titoli, artisti e identificatori vengono mappati tra i client multimediali e le integrazioni con Music Assistant.

  • media metadata
  • normalization
  • vocabulary
Media e Musica

metadatarr

Client di metadati multimediali basati su Pydantic e un risolutore di entità cross-source senza chiavi.

  • Pydantic
  • media metadata
  • resolver
Strumenti per sviluppatori

nupyml

Una libreria di machine learning e reti neurali in stile scikit-learn, con solo numpy e scipy come dipendenze — scritta per essere letta.

  • machine learning
  • numpy
  • education
Voice PlatformsIn evidenza

Open Voice OS

Piattaforma di assistente vocale open source, guidata dalla community e attenta alla privacy. TigreGótico è un contributore centrale dell'intero ecosistema — mantenendo plugin vocali, servizi STT/TTS, strumenti per sviluppatori e lavoro di specifica formale su decine di repository.

  • FOSS
  • privacy-first
  • voice platform
Strumenti per sviluppatori

OpenTone

Toolkit di trasmissione dati tramite suono in puro Python — trasporta testo e dati attraverso un canale audio (DTMF e altro) usando primitive condivise WAV/sinusoide/Goertzel. Gli schemi principali sono privi di dipendenze.

  • data-over-sound
  • DTMF
  • audio
  • signal processing
Fonetica e G2PIn evidenza

orthography2ipa

Mappature grafema-IPA e allofoniche per oltre 350 lingue di più di 20 famiglie — un tokenizzatore IPA a maximal munch, metriche di distanza fonologica e tra sistemi di scrittura, trasformazioni dialettali e un backend G2P a plugin.

  • 350+ languages
  • G2P
  • IPA
  • phonemization
NLnet

OVOS Agentic Loop

Framework di integrazione di agenti per OpenVoiceOS — abilita flussi di lavoro agentici guidati dalla voce.

  • OpenVoiceOS
  • agentic
  • agents
  • integration
NLnet

ovos-busmon

Monitor del messagebus per OpenVoiceOS — osserva il traffico del bus dal vivo per fare debug di skill, intent e servizi.

  • messagebus
  • debugging
  • monitoring
NLnet

ovos-localize

Una piattaforma di localizzazione GitHub-native per skill e plugin OpenVoiceOS — gestisci le traduzioni interamente tramite Git, senza servizi esterni da eseguire.

  • GitHub-native
  • i18n
  • localization
  • no-infra
NLnet

ovos-messagebus-chat-plugin

Plugin ChatEngine di OVOS che inoltra i turni di conversazione attraverso il messagebus di OVOS — collega interfacce di chat direttamente a un assistente in esecuzione.

  • chat
  • messagebus
  • plugin
ILENIA

ovos-opendata-server

Server di metriche open-data per OpenVoiceOS — raccoglie metriche d'uso anonime e le pubblica come dataset aperti; sviluppato nell'ambito del progetto ILENIA.

  • metrics
  • open data
  • server
NLnet

ovos-plugin-arena

Arena di benchmarking per i plugin OVOS — sfide dirette con classifiche ELO per confrontare implementazioni STT, TTS e altri plugin su carichi reali.

  • benchmark
  • ELO
  • plugins
NLnet

ovos-stt-server

Ospita qualsiasi plugin STT di OpenVoiceOS come servizio di rete — un piccolo server che espone il riconoscimento vocale via HTTP per satelliti e client di terze parti.

  • STT
  • server
  • self-hosted
NLnet

ovos-tts-server

Ospita qualsiasi plugin TTS di OpenVoiceOS come servizio — un semplice server flask che trasforma qualunque plugin TTS in un'API di sintesi vocale self-hosted.

  • TTS
  • server
  • self-hosted
NLnet

ovos_tts_transformer_FlashSR

Super-risoluzione audio per il TTS di OVOS — FlashSR porta il parlato sintetizzato da 16 kHz a 48 kHz via ONNX prima della riproduzione, rendendo più brillante qualsiasi voce esistente senza riaddestramento.

  • TTS
  • super-resolution
  • ONNX
NLnet

ovos_tts_transformer_NovaSR

Super-risoluzione audio per il TTS di OVOS — NovaSR porta il parlato sintetizzato da 16 kHz a 48 kHz con il veloce upsampler FastSR, saltando l'audio già a 48 kHz.

  • TTS
  • super-resolution
  • ONNX
NLnet

ovoscope

Framework di test end-to-end per skill OVOS con un runtime in-process leggero.

  • OVOS skills
  • end-to-end testing
  • in-process runtime
NLnet, NLP e Lingua

palavreado

Parser di intent basato su parole chiave, semplicissimo — sostituto diretto di Adapt che confronta gli enunciati con slot di parole chiave obbligatorie/opzionali; nato in TigreGótico e donato a OpenVoiceOS.

  • intent parsing
  • NLP
Sintesi vocaleIn evidenza

phoonnx

Una libreria Python per la fonemizzazione multilingue e la sintesi vocale (TTS) tramite modelli ONNX.

  • ONNX models
  • multilingual TTS
  • phonemization
Sintesi vocale

phoonnx-AddonNVDA

Add-on per lo screen reader Windows NVDA che parla tramite le voci neurali ONNX di phoonnx, dimostrando phoonnx come backend TTS per l'accessibilità.

  • NVDA
  • accessibility
  • screen reader
  • ONNX
Sintesi vocale

phoonnx.js

Inferenza TTS VITS nel browser con onnxruntime-web. Percorsi Unicode ed espeak-ng. Nessun server, nessuna API.

  • ONNX
  • TTS
  • browser
  • VITS
Dati e Scraping

pombo_correio

Controller automatizzato del browser costruito su Selenium e Selenium Wire — sessioni, gestione degli eventi, interazione con gli elementi e gestione delle estensioni per lo scraping e i test dove un browser completo è inevitabile.

  • browser automation
  • Selenium
  • scraper
Casa intelligente

powerguess

Stima o misura l'assorbimento di potenza di un dispositivo Linux — una libreria Python con poche dipendenze e provenienza su ogni lettura (INA219, RAPL, PMIC Raspberry Pi, batteria o una stima calibrata e delimitata).

  • power
  • energy
  • RAPL
  • INA219
Parole di attivazione

precise-onnx-js

Port per Browser/Node.js del rilevamento di wake word precise-onnx. Estrazione di feature MFCC e rilevamento basato su ONNX compatibile con i modelli Precise .onnx.

  • ONNX
  • Wake words
  • Web
  • Audio
NLP e Lingua

pronomial

Risoluzione della coreferenza tramite POS dei pronomi ed euristiche sul genere delle parole.

  • NLP
  • coreference
Casa intelligente

py-music-assistant

Client HTTP Python e bridge mediavocab per un server Music Assistant — lo strato condiviso di transport e conversione alla base dell'integrazione OVOS con Music Assistant.

  • Music Assistant
  • media metadata
  • API client
ILENIA

pyAhoTTS-Iparrahotsa

Port in Python di AhoTTS Iparrahotsa, un motore di sintesi vocale per il basco settentrionale (continentale) — il corrispettivo in dialetto iparralde di pyAhoTTS, con hts_engine e il vocoder AhoCoder. Sviluppato con Aholab (UPV/EHU).

  • AhoTTS
  • Basque
  • ILENIA
  • TTS library
Fonetica e G2P

pycotovia

Port in puro Python del front-end G2P Cotovia per il galiziano e lo spagnolo. Riproduce la pipeline di sillabazione, accento e trascrizione del binario C compilato senza subprocess.

  • G2P
  • Galician
  • Spanish
  • phonemization
Media e Musica

pydiscogs

Client Python in streaming per i dump di dati mensili di Discogs.

  • Discogs
  • Music metadata
  • Data dumps
  • API client
Dati e Scraping

pyerowid

Client Python tipizzato + esportatore di dataset in markdown per Erowid (erowid.org).

  • Erowid
  • Harm reduction
  • API client
  • Dataset
Strumenti per sviluppatori

pyeye

Port in puro Python del motore di ragionamento EYE N3 — forniscigli fatti e regole in Notation3 e deriva nuovi fatti tramite forward/backward chaining, entailment RDFS e OWL 2 RL, alberi di dimostrazione e oltre 280 built-in. Una sola dipendenza (rdflib).

  • N3
  • reasoner
  • RDF
  • forward chaining
Media e Musica

pygutenberg

Client Python per Project Gutenberg — metadati dei libri tramite il catalogo aperto.

  • Project Gutenberg
  • Books
  • API client
  • Literature
Strumenti per sviluppatori

pyhermit

Port in puro Python di HermiT, il ragionatore OWL 2 DL di Oxford — coerenza, classificazione e recupero di istanze tramite un tableau a iperrisoluzione, senza JVM e con zero dipendenze a runtime.

  • OWL 2
  • reasoner
  • symbolic
  • logic
Media e Musica

pyimdb

Client Python di metadati per IMDb. Risolve query in testo libero in titoli IMDb canonici.

  • IMDb
  • Movies
  • Metadata
  • API client
Dati e Scraping

pyinfopedia

Client Python tipizzato per Infopédia, il dizionario di portoghese europeo di Porto Editora — analizza ogni voce in pronunce IPA, sillabazione, etimologia e accezioni, separando correttamente gli omografi eterofonici per il lavoro di G2P e disambiguazione.

  • Portuguese
  • dictionary
  • IPA
  • lexicon
Dati e Scraping

pyliveatc

Client Python per LiveATC.net — scopri, riproduci in streaming e archivia feed audio di controllo del traffico aereo dal vivo e storici, con esportazione di dataset per l'addestramento ASR.

  • API client
  • ATC
  • audio
  • scraper
Media e Musica

pymusicbrainz

Client Python di metadati per MusicBrainz — l'enciclopedia musicale aperta.

  • MusicBrainz
  • Music metadata
  • API client
Dati e Scraping

pypsychonaut

Client Python tipizzato + esportatore di dataset in markdown per PsychonautWiki (psychonautwiki.org).

  • PsychonautWiki
  • Harm reduction
  • API client
  • Dataset
Dati e Scraping

pyromhacking

Scraper Python per romhacking.net (RHDN) — il database della comunità di ROM hack, traduzioni amatoriali, utilità di patching e documentazione.

  • scraper
  • games
  • fan translation
Media e Musica

pyshazam

Un client Python modulare e asincrono per l'API di Shazam, costruito su shazamio_core per un robusto fingerprinting audio.

  • Shazam
  • Audio fingerprinting
  • Music recognition
  • API client
Dati e Scraping

pysmwcentral

Client Python per l'API JSON pubblica di smwcentral.net — accesso paginato al catalogo di ROM hacking di Super Mario World / SM64 / Yoshi's Island.

  • API client
  • games
  • scraper
Dati e Scraping

pytripsit

Client per schede informative sulle sostanze e matrice di interazioni di TripSit (riduzione del danno).

  • TripSit
  • Harm reduction
  • Drug interactions
  • API client
Giochi

pyvndb

Client Python per l'API JSON pubblica kana di VNDB (Visual Novel Database).

  • Visual Novels
  • Games
  • API client
  • VNDB
Dati e Scraping

pywod

Client aggregatore multilingue di Word-of-the-Day.

  • Word of the Day
  • Language
  • API client
  • Dictionary
ILENIA

raspovos-audio-setup

Libreria di auto-configurazione audio per raspOVOS — rileva schede audio, HAT e dispositivi USB su Raspberry Pi e li configura per l'assistente vocale; sviluppata nell'ambito del progetto ILENIA.

  • Raspberry Pi
  • audio
  • raspOVOS
Dati e Scraping

remailers

Client di remailer email anonimi con supporto per i protocolli Cypherpunk e Mixmaster.

  • anonymity
  • email
  • privacy
  • remailers
Fonetica e G2P

scriptconv

Nucleo senza dipendenze per scritture e notazioni fonemiche — rilevamento ISO-15924, IPA ↔ ARPABET/X-SAMPA/Kirshenbaum/Cotovía, Buckwalter ↔ arabo, Hangul → jamo, kana.

  • IPA
  • transliteration
  • phoneme notation
  • zero dependencies
Casa intelligente

shazam2mqtt

Bridge containerizzato che identifica l'audio ambientale con Shazam e pubblica i metadati dei brani (titolo, artista, copertina, testo, link Apple Music / Spotify / Deezer) su MQTT con auto-discovery di Home Assistant.

  • Shazam
  • MQTT
  • Home Assistant
  • music recognition
Dati e Scraping

sitemapper

Utilità di ricognizione dei siti per apprenderne la struttura prima di costruire scraper. Mappa robots.txt, sitemap e grafi di collegamenti usando il transport unblock_requests per un'esplorazione resiliente di siti protetti o complessi.

  • web scraping
  • site mapping
  • robots.txt
  • sitemap
Riconoscimento vocale

speakeronnx

Libreria di embedding del parlante in puro onnxruntime — estrai embedding del parlante, calcola la similarità coseno e verifica l'identità del parlante da modelli ONNX, senza alcun PyTorch a runtime.

  • ONNX
  • speaker embeddings
  • speaker verification
Sintesi vocale, Riconoscimento vocale

speechonnxmetrics

Metriche unificate di valutazione del parlato — MOS neurale (UTMOS, NISQA, SIGMOS, DNSMOS), intrusive (STOI, SI-SDR, MCD) e ASR (WER/CER) — solo con numpy e onnxruntime.

  • ONNX
  • evaluation
  • MOS
  • WER
Strumenti per sviluppatori

sshfs-keeper

Un daemon che monitora i mount SSHFS/rclone e li rimonta automaticamente quando cadono — con dashboard web in tempo reale, API REST, metriche Prometheus, webhook e processi programmati di sincronizzazione rsync/rclone.

  • SSHFS
  • homelab
  • monitoring
  • self-hosted
Fonetica e G2P

stressonnx

Posizionamento multilingue dell'accento lessicale per front-end TTS, usando solo onnxruntime e numpy.

  • ONNX
  • TTS frontend
  • word stress
Dati e Scraping

temporalis

Libreria unificata di astrazione meteo multi-provider per Python. Interroga OpenWeatherMap, Open-Meteo, MetNo, IPMA, NWS e altri tramite un'unica API coerente.

  • Weather
  • Multi-provider
  • API client
  • Open-Meteo
Fonetica e G2P

text2tashkeel

Diacritizzazione leggera dell'arabo (tashkeel) — un'unica API minimale su modelli ONNX intercambiabili che ripristinano i segni vocalici mancanti, senza PyTorch e offline per impostazione predefinita. Alimenta la fase di diacritizzazione di arbtok.

  • Arabic
  • diacritization
  • tashkeel
  • ONNX
NLP e Lingua

tugalex

Un gestore di lessico e utilità linguistica per i dialetti portoghesi.

  • NLP
  • Portuguese
  • lexicon
NLP e Lingua

tugamorph

Analizzatore morfologico basato su regole per il portoghese — segmenta le parole in morfemi.

  • NLP
  • Portuguese
  • morphology
Media e Musica

tunein

Scraper radio TuneIn che emette rilasci tipizzati di metadati multimediali.

  • TuneIn
  • radio
  • scraper
Media e Musica

tutubo

Scraper YouTube leggero che emette rilasci tipizzati di metadati multimediali.

  • YouTube
  • scraper
  • video
Dati e ScrapingIn evidenza

unblock_requests

Una sottoclasse di requests.Session che aggira Cloudflare (impersonation con curl_cffi, FlareSolverr, fallback su Wayback) — il transport anti-bot alla base dei nostri scraper.

  • HTTP
  • anti-bot
  • scraping
Dati e Scraping

usenet

Lettore USENET in tempo reale e scraper di articoli per la ricerca su protocolli alternativi e l'archiviazione.

  • USENET
  • privacy
  • protocols
  • scraping
Casa intelligente

vad2mqtt

Bridge di rilevamento dell'attività vocale in tempo reale basato su ovos-plugin-manager. Pubblica la probabilità di parlato (0–100 %), il livello di rumore (dB) e un sensore binario di parlato con debounce su MQTT — con auto-discovery di Home Assistant.

  • VAD
  • MQTT
  • Home Assistant
  • OpenVoiceOS
Riconoscimento vocale

vadonnx

Rilevamento dell'attività vocale alla maniera di ONNX — carica qualsiasi modello VAD dietro un'unica API di streaming con un runtime minimale (numpy + onnxruntime). Il corrispettivo VAD di phoonnx; la maggior parte dei backend sono dati, non codice.

  • ONNX
  • VAD
  • audio
  • streaming
Sintesi vocale

voiceclonnx

Conversione vocale multi-motore in puro ONNX — trasforma qualsiasi voce in quella di un parlante di riferimento senza alcun PyTorch in inferenza. 14 motori (kNN-VC, FreeVC, OpenVoice, RVC, CosyVoice…) dietro un'unica API VoiceCloner, più una CLI e build INT8.

  • ONNX
  • voice conversion
  • zero-shot
  • multilingual
Parole di attivazione

wakeforge

Un addestratore di modelli di wake word sviluppato nell'ambito di un finanziamento NLnet per OpenVoiceOS — crea wake word personalizzate e on-device dai tuoi campioni.

  • NLnet
  • on-device
  • training
  • wake word
Parole di attivazione

ww_tagger

Web app Flask per l'etichettatura manuale di audio di wake word — riproduci ogni clip ed etichetta parola, genere del parlante e tipo di rumore, costruendo un corpus pronto per l'addestramento o la valutazione.

  • labeling
  • dataset
  • Flask
Media e Musica

xazam

Client Python modulare e asincrono per l'API di Shazam — fingerprinting audio tramite shazamio-core con modelli tipizzati Track/Artist e uno scraper di catalogo.

  • Shazam
  • async
  • audio fingerprinting
Strumenti per sviluppatori

z85base91

Libreria compatta di codifica binario-testo (Base91, Z85B, Z85P) — implementazioni C veloci con fallback in puro Python, tutte più compatte di base64.

  • encoding
  • serialization