Somos especialistas em voz, IA e dados em código aberto. Como criadores da stack HiveMind e contribuidores centrais do OpenVoiceOS, construímos tecnologia de voz privada e conforme com o RGPD, que mantém os dados no seu próprio hardware — e sentimo-nos igualmente em casa a transformar dados públicos de difícil acesso em APIs limpas e conjuntos de dados curados.
Como Trabalhamos
O contrato típico é uma avença mensal que garante acesso contínuo à equipa e suporte, com entregáveis concretos — datasets, modelos treinados, plugins à medida, integrações — orçamentados à parte à medida que são definidos. Isto mantém a relação previsível para ambos os lados: o cliente tem acesso direto à equipa e cada resultado concreto tem o seu próprio âmbito e preço.
Também aceitamos projetos pontuais quando o âmbito está bem definido à partida.
Damos Voz ao Que Quiser
Criamos interfaces de voz para qualquer coisa. Seja o que for com que quer falar — um dispositivo, uma aplicação, um serviço ou uma linha de produtos inteira — construímos a camada de voz, reutilizando a experiência e a stack comprovada que desenvolvemos à volta do Open Voice Operating System e do HiveMind. Palavras de ativação personalizadas, ligação de síntese de fala (TTS) e reconhecimento de fala (ASR), tratamento de intenções e componentes à medida — montados sobre uma base de código aberto testada em produção, e a correr no seu próprio hardware.
Treino de Vozes TTS Offline à Medida
Quer uma voz única para o seu projeto? Treinamos vozes de síntese de fala totalmente offline e de alta qualidade. Traga um conjunto de dados numa língua específica, ou clone uma voz de referência — o resultado é um modelo TTS rápido e privado, que corre localmente no seu dispositivo e encaixa diretamente no OpenVoiceOS ou no Home Assistant. O controlo dos dados é sempre seu.
Curioso sobre como soam as nossas vozes? Experimente a Demo de Vozes — as vozes Miro e Dii sintetizam ao vivo no seu navegador, em mais de 20 línguas.
Reconhecimento de Fala Afinado para a Sua Língua e Domínio
Afinamos modelos de reconhecimento de fala de última geração — Zipformer, Parakeet, Whisper e outros — para a sua língua, sotaque e vocabulário de domínio, para que o reconhecimento se aguente nas palavras e condições que realmente lhe importam. Quando os dados de treino ainda não existem, vamos buscá-los — e sintetizamo-los quando apropriado — com a nossa cadeia de construção de datasets. Este trabalho é apoiado pela nossa parceria com a Alpha Cephei, que traz décadas de experiência em reconhecimento automático de fala para o seu projeto.
Tecnologia de Fala para Línguas Minoritárias e Lusófonas
Construímos tecnologia de fala para línguas que as ferramentas convencionais ignoram — incluindo variantes do português e outras línguas lusófonas e minoritárias. Da fonemização ao ASR e TTS, ajudamos comunidades linguísticas mal servidas a ter apoio de voz moderno e respeitador da privacidade.
Extração de Dados, APIs Limpas e Datasets
Há imenso valor em dados que vivem na web pública mas estão, na prática, inacessíveis — presos em páginas sem estrutura, atrás de defesas anti-bot, expostos apenas por endpoints não documentados, ou em formatos que nenhum motor de busca indexa. Nós tiramo-los de lá e tornamo-los utilizáveis:
- Scrapers e parsers resilientes para fontes que resistem à automação, desenhados para continuar a funcionar quando as páginas e as defesas mudam.
- Engenharia inversa de APIs — mapeamos endpoints não documentados ou privados e voltamos a expô-los como bibliotecas cliente limpas, tipadas e documentadas.
- Uma API limpa sobre fontes caóticas — uma única interface consistente em vez de scraping feito à medida por cada consumidor.
- Construção de datasets — organizamos os dados extraídos em conjuntos estruturados, versionados e prontos para ML, com proveniência clara, e publicamos datasets abertos quando faz sentido.
É a mesma cadeia de ferramentas por detrás das nossas próprias bibliotecas cliente e dos datasets que publicamos — e alimenta tudo, do enriquecimento de metadados de media aos corpora de treino para modelos de fala e de linguagem.
Sítios Web com Voz e Acessíveis
A mesma stack de voz que instalamos em dispositivos também corre no navegador. Com o phoonnx.js, as nossas vozes TTS sintetizam do lado do cliente — sem API na nuvem, sem custo por pedido, sem nada sair da máquina do visitante. A Demo de Vozes neste próprio sítio é a prova: uma página estática que fala.
Construímos sítios e aplicações web à volta dessa capacidade — páginas que se leem a si mesmas em voz alta, interfaces voz-primeiro e desenho acessível de raiz para quem navega de ouvido. Desempenho, acessibilidade e privacidade são a base, não extras. Também desenvolvemos e mantemos o sítio oficial do OpenVoiceOS.