Incarichi

Servizi

Incarichi di ingegneria: estrazione dati, API pulite e costruzione di dataset; interfacce vocali; addestramento di voci TTS offline personalizzate e fine-tuning di modelli di riconoscimento vocale (ASR); e siti web accessibili e abilitati alla voce.


Siamo specialisti FOSS di voce, IA e dati. Come creatori dello stack HiveMind e contributori centrali di OpenVoiceOS, costruiamo tecnologia vocale che mette la privacy al primo posto e conforme al GDPR, che mantiene i tuoi dati sul tuo hardware — e siamo altrettanto a nostro agio nel trasformare dati pubblici difficili da raggiungere in API pulite e dataset curati.

Come lavoriamo

L’ingaggio standard è un abbonamento mensile per accesso e supporto continuativi, con consegne distinte — dataset, modelli addestrati, plugin personalizzati, integrazioni — definite e fatturate separatamente man mano che vengono delineate. Questo mantiene la relazione prevedibile da entrambe le parti: hai accesso diretto al team e ogni output concreto ha il proprio ambito e prezzo.

Ci occupiamo anche di progetti autonomi in cui l’ambito è ben definito fin dall’inizio.

Abilitiamo la voce su qualsiasi cosa

Creiamo interfacce vocali per qualsiasi cosa. Qualunque cosa tu voglia far parlare — un dispositivo, un’app, un servizio o un’intera linea di prodotti — costruiamo il livello vocale per essa, riutilizzando la competenza e lo stack collaudato che abbiamo costruito attorno all’Open Voice Operating System e a HiveMind. Wake word personalizzate, collegamento di Text-to-Speech (TTS) e Speech-to-Text (ASR), gestione degli intent e componenti su misura — assemblati a partire da una comprovata base open source anziché da zero, e in esecuzione sul tuo hardware.

Addestramento di voci TTS offline personalizzate

Vuoi una voce unica per il tuo progetto? Addestriamo voci Text-to-Speech personalizzate, di alta qualità e completamente offline. Porta un dataset per una lingua specifica, oppure clona una voce di riferimento — il risultato è un modello TTS veloce e privato che gira localmente sul tuo dispositivo e si integra direttamente in OpenVoiceOS o Home Assistant. Mantieni il pieno controllo dei tuoi dati.

Curioso di sapere come suonano le nostre voci? Prova la demo delle voci — le nostre voci Miro e Dii sintetizzano dal vivo nel tuo browser, in oltre 20 lingue.

Riconoscimento vocale ottimizzato per la tua lingua e il tuo dominio

Facciamo il fine-tuning di modelli speech-to-text all’avanguardia — Zipformer, Parakeet, Whisper e altri — per la tua lingua, il tuo accento e il vocabolario del tuo dominio specifici, così il riconoscimento regge sulle parole e nelle condizioni che contano davvero per te. Quando i dati di addestramento non esistono ancora, li troviamo — e li sintetizziamo dove opportuno — usando la nostra toolchain di costruzione dataset. Questo lavoro è sostenuto dalla nostra collaborazione con Alpha Cephei, che porta al tuo progetto decenni di competenza nel riconoscimento vocale automatico.

Tecnologia vocale per lingue minoritarie e lusofone

Costruiamo tecnologia vocale per lingue che gli strumenti mainstream ignorano — comprese le varianti del portoghese e altre lingue lusofone e minoritarie. Dalla fonemizzazione allo ASR e al TTS, aiutiamo le comunità linguistiche sotto-servite a ottenere un supporto vocale moderno e rispettoso della privacy.

Estrazione dati, API pulite e dataset

Una grande quantità di dati preziosi vive sul web pubblico ma è di fatto irraggiungibile — bloccata in pagine non strutturate, dietro difese anti-bot, esposta solo tramite endpoint non documentati, o in formati che nessun motore di ricerca indicizza. Noi li tiriamo fuori e li rendiamo utilizzabili:

È la stessa toolchain che sta dietro le nostre librerie client e i dataset che rilasciamo — e alimenta tutto, dall’arricchimento dei metadati multimediali ai corpora di addestramento per modelli vocali e linguistici.

Siti web accessibili e abilitati alla voce

Lo stesso stack vocale che rilasciamo sui dispositivi gira anche nel browser. Con phoonnx.js, le nostre voci TTS sintetizzano lato client — nessuna API cloud, nessun costo per richiesta, niente che lasci la macchina del visitatore. La demo delle voci su questo stesso sito ne è la prova: una pagina statica che parla.

Costruiamo siti web e applicazioni web attorno a questa capacità — siti che possono leggersi ad alta voce, interfacce voice-first e pagine accessibili per progettazione per gli utenti che navigano con l’udito. Prestazioni, accessibilità e privacy sono l’impostazione predefinita, non un extra. Sviluppiamo e manteniamo anche il sito ufficiale di OpenVoiceOS.

Pronto a definire un progetto?

Contattacicontact@tigregotico.pt

Questo sito è un esempio vivo del nostro sviluppo web statico: pagine pre-generate, nessun server da gestire, nessun database da mantenere. Il selettore di palette nell'intestazione ne fa parte — cambia lo schema di colori e la scelta persiste, tutto nel browser.