Siamo specialisti FOSS di voce, IA e dati. Come creatori dello stack HiveMind e contributori centrali di OpenVoiceOS, costruiamo tecnologia vocale che mette la privacy al primo posto e conforme al GDPR, che mantiene i tuoi dati sul tuo hardware — e siamo altrettanto a nostro agio nel trasformare dati pubblici difficili da raggiungere in API pulite e dataset curati.
Come lavoriamo
L’ingaggio standard è un abbonamento mensile per accesso e supporto continuativi, con consegne distinte — dataset, modelli addestrati, plugin personalizzati, integrazioni — definite e fatturate separatamente man mano che vengono delineate. Questo mantiene la relazione prevedibile da entrambe le parti: hai accesso diretto al team e ogni output concreto ha il proprio ambito e prezzo.
Ci occupiamo anche di progetti autonomi in cui l’ambito è ben definito fin dall’inizio.
Abilitiamo la voce su qualsiasi cosa
Creiamo interfacce vocali per qualsiasi cosa. Qualunque cosa tu voglia far parlare — un dispositivo, un’app, un servizio o un’intera linea di prodotti — costruiamo il livello vocale per essa, riutilizzando la competenza e lo stack collaudato che abbiamo costruito attorno all’Open Voice Operating System e a HiveMind. Wake word personalizzate, collegamento di Text-to-Speech (TTS) e Speech-to-Text (ASR), gestione degli intent e componenti su misura — assemblati a partire da una comprovata base open source anziché da zero, e in esecuzione sul tuo hardware.
Addestramento di voci TTS offline personalizzate
Vuoi una voce unica per il tuo progetto? Addestriamo voci Text-to-Speech personalizzate, di alta qualità e completamente offline. Porta un dataset per una lingua specifica, oppure clona una voce di riferimento — il risultato è un modello TTS veloce e privato che gira localmente sul tuo dispositivo e si integra direttamente in OpenVoiceOS o Home Assistant. Mantieni il pieno controllo dei tuoi dati.
Curioso di sapere come suonano le nostre voci? Prova la demo delle voci — le nostre voci Miro e Dii sintetizzano dal vivo nel tuo browser, in oltre 20 lingue.
Riconoscimento vocale ottimizzato per la tua lingua e il tuo dominio
Facciamo il fine-tuning di modelli speech-to-text all’avanguardia — Zipformer, Parakeet, Whisper e altri — per la tua lingua, il tuo accento e il vocabolario del tuo dominio specifici, così il riconoscimento regge sulle parole e nelle condizioni che contano davvero per te. Quando i dati di addestramento non esistono ancora, li troviamo — e li sintetizziamo dove opportuno — usando la nostra toolchain di costruzione dataset. Questo lavoro è sostenuto dalla nostra collaborazione con Alpha Cephei, che porta al tuo progetto decenni di competenza nel riconoscimento vocale automatico.
Tecnologia vocale per lingue minoritarie e lusofone
Costruiamo tecnologia vocale per lingue che gli strumenti mainstream ignorano — comprese le varianti del portoghese e altre lingue lusofone e minoritarie. Dalla fonemizzazione allo ASR e al TTS, aiutiamo le comunità linguistiche sotto-servite a ottenere un supporto vocale moderno e rispettoso della privacy.
Estrazione dati, API pulite e dataset
Una grande quantità di dati preziosi vive sul web pubblico ma è di fatto irraggiungibile — bloccata in pagine non strutturate, dietro difese anti-bot, esposta solo tramite endpoint non documentati, o in formati che nessun motore di ricerca indicizza. Noi li tiriamo fuori e li rendiamo utilizzabili:
- Scraper e parser resilienti per fonti che resistono all’automazione, progettati per continuare a funzionare man mano che pagine e difese cambiano.
- Reverse-engineering di API — mappiamo endpoint non documentati o privati e li ri-esponiamo come librerie client pulite, tipizzate e documentate.
- Un’unica API pulita su fonti disordinate — un’unica interfaccia coerente invece di scraping su misura per ogni consumatore.
- Costruzione di dataset — curiamo i dati estratti in dataset strutturati, versionati e pronti per il ML con provenienza chiara, e possiamo pubblicare dataset aperti dove ha senso.
È la stessa toolchain che sta dietro le nostre librerie client e i dataset che rilasciamo — e alimenta tutto, dall’arricchimento dei metadati multimediali ai corpora di addestramento per modelli vocali e linguistici.
Siti web accessibili e abilitati alla voce
Lo stesso stack vocale che rilasciamo sui dispositivi gira anche nel browser. Con phoonnx.js, le nostre voci TTS sintetizzano lato client — nessuna API cloud, nessun costo per richiesta, niente che lasci la macchina del visitatore. La demo delle voci su questo stesso sito ne è la prova: una pagina statica che parla.
Costruiamo siti web e applicazioni web attorno a questa capacità — siti che possono leggersi ad alta voce, interfacce voice-first e pagine accessibili per progettazione per gli utenti che navigano con l’udito. Prestazioni, accessibilità e privacy sono l’impostazione predefinita, non un extra. Sviluppiamo e manteniamo anche il sito ufficiale di OpenVoiceOS.