Wij zijn specialisten in FOSS-spraak, AI en data. Als makers van de HiveMind-stack en kernbijdragers aan OpenVoiceOS bouwen wij privacyvriendelijke, AVG-conforme spraaktechnologie die uw gegevens op uw eigen hardware houdt — en wij voelen ons evenzeer thuis in het omzetten van moeilijk bereikbare openbare data in schone API’s en samengestelde datasets.
Hoe wij werken
De standaardopdracht is een maandelijkse retainer voor doorlopende toegang en ondersteuning, met afzonderlijke deliverables — datasets, getrainde modellen, aangepaste plug-ins, integraties — die apart worden afgebakend en gefactureerd zodra ze zijn gedefinieerd. Dit houdt de relatie aan beide kanten voorspelbaar: u hebt directe toegang tot het team, en elk concreet resultaat heeft zijn eigen omvang en prijs.
Wij nemen ook losstaand projectwerk aan waar de omvang vanaf het begin duidelijk is gedefinieerd.
Wij maken alles spraakgestuurd
Wij creëren spraakinterfaces voor alles. Waarmee u ook wilt praten — een apparaat, een app, een dienst of een hele productlijn — wij bouwen de spraaklaag ervoor, waarbij wij de expertise en de in de praktijk beproefde stack hergebruiken die wij hebben opgebouwd rond het Open Voice Operating System en HiveMind. Aangepaste wake words, bedrading voor Text-to-Speech (TTS) en Speech-to-Text (ASR), intentieafhandeling en op maat gemaakte componenten — samengesteld uit een bewezen open-source-fundament in plaats van vanaf nul, en draaiend op uw eigen hardware.
Op maat gemaakte offline TTS-stemtraining
Wilt u een unieke stem voor uw project? Wij trainen op maat gemaakte, hoogwaardige, volledig offline Text-to-Speech-stemmen. Breng een dataset voor een specifieke taal, of kloon een referentiestem — het resultaat is een snel, privé TTS-model dat lokaal op uw apparaat draait en naadloos in OpenVoiceOS of Home Assistant past. U behoudt de volledige controle over uw gegevens.
Benieuwd hoe onze stemmen klinken? Probeer de stemmendemo — onze Miro- en Dii-stemmen synthetiseren live in uw browser, in meer dan 20 talen.
Fijnafgestemde spraakherkenning voor uw taal en domein
Wij stemmen state-of-the-art speech-to-text-modellen fijn af — Zipformer, Parakeet, Whisper en andere — voor uw specifieke taal, accent en domeinvocabulaire, zodat de herkenning standhoudt op de woorden en omstandigheden die er voor u echt toe doen. Wanneer de trainingsdata nog niet bestaat, vinden wij die — en synthetiseren die waar passend — met onze toolchain voor datasetopbouw. Dit werk wordt ondersteund door ons partnerschap met Alpha Cephei, dat tientallen jaren aan expertise in automatische spraakherkenning naar uw project brengt.
Spraaktechnologie voor minderheids- en Lusofone talen
Wij bouwen spraaktechnologie voor talen die reguliere tools negeren — waaronder Portugese varianten en andere Lusofone en minderheidstalen. Van fonemisatie tot ASR en TTS helpen wij ondervertegenwoordigde taalgemeenschappen aan moderne, privacyrespecterende spraakondersteuning.
Data-extractie, schone API’s en datasets
Een grote hoeveelheid waardevolle data staat op het openbare web maar is feitelijk onbereikbaar — opgesloten in ongestructureerde pagina’s, achter antibotverdedigingen, alleen blootgesteld via ongedocumenteerde endpoints, of in formaten die geen enkele zoekmachine indexeert. Wij halen die eruit en maken die bruikbaar:
- Robuuste scrapers en parsers voor bronnen die zich tegen automatisering verzetten, ontworpen om te blijven werken naarmate pagina’s en verdedigingen veranderen.
- API-reverse-engineering — wij brengen ongedocumenteerde of privé-endpoints in kaart en stellen die opnieuw beschikbaar als schone, getypeerde, gedocumenteerde clientbibliotheken.
- Eén schone API over rommelige bronnen — één consistente interface in plaats van op maat gemaakt scrapen voor elke afnemer.
- Datasetopbouw — wij stellen de geëxtraheerde data samen tot gestructureerde, geversioneerde, ML-klare datasets met duidelijke herkomst, en waar het zinvol is kunnen wij open datasets publiceren.
Het is dezelfde toolchain achter onze eigen clientbibliotheken en de datasets die wij uitbrengen — en die voedt alles van verrijking van media-metadata tot trainingscorpora voor spraak- en taalmodellen.
Spraakgestuurde, toegankelijke websites
Dezelfde spraakstack die wij op apparaten leveren, draait ook in de browser. Met phoonnx.js synthetiseren onze TTS-stemmen aan de clientzijde — geen cloud-API, geen kosten per verzoek, niets dat het apparaat van de bezoeker verlaat. De stemmendemo op precies deze site is het bewijs: een statische pagina die spreekt.
Wij bouwen websites en webapplicaties rond die mogelijkheid — sites die zichzelf hardop kunnen voorlezen, voice-first-interfaces en pagina’s die toegankelijk-by-design zijn voor gebruikers die op het gehoor surfen. Prestaties, toegankelijkheid en privacy zijn de standaard, geen extra’s. Wij ontwikkelen en onderhouden ook de officiële OpenVoiceOS-website.