Голосовой ИИ с приоритетом конфиденциальности

Голосовые технологии, которые уважают ваши данные.

В мире голосовых ассистентов, жадных до данных, есть лучший путь. TigreGótico создаёт голосовые технологии, основанные на приватности, открытом исходном коде и суверенитете данных. Как создатели стека HiveMind и ключевые участники OpenVoiceOS, мы помогаем внедрять безопасные, соответствующие GDPR голосовые решения, работающие на вашем собственном оборудовании — без отправки данных в чужое облако.

СоздателиHiveMindи ключевые участникиOpenVoiceOS

Чем мы занимаемся

Голосовые технологии — и инженерия данных, стоящая за ними

Мы создаём голосовые технологии с приоритетом конфиденциальности на всём стеке открытого кода и превращаем труднодоступные публичные данные в чистые API и наборы данных.

Извлечение данных, чистые API и наборы данных

Наша ведущая специализация: мы открываем доступ к публичным данным, до которых иначе трудно добраться — за неструктурированными страницами, антибот-барьерами или недокументированными эндпойнтами — с помощью устойчивых скрейперов и API, восстановленных обратной разработкой, а затем заново публикуем их в виде чистых, типизированных клиентских библиотек и строим на их основе курируемые, готовые к ML наборы данных.

Услуги по работе с данными

Голосовые ассистенты с приоритетом конфиденциальности

Локальные развёртывания OpenVoiceOS, которые хранят аудио и данные на вашем собственном оборудовании — соответствуют GDPR по своей архитектуре.

Индивидуальные голосовые модели — TTS и ASR

Офлайн-голоса синтеза речи для вашего языка или бренда и дообученное распознавание речи (Zipformer, Parakeet, Whisper) для вашей области — при поддержке нашего партнёрства по ASR с Alpha Cephei.

Речевые технологии для миноритарных и лузофонных языков

Фонемизация, ASR и TTS для недостаточно обеспеченных языков, которые упускают из виду массовые инструменты.

Сети устройств HiveMind

Распределённый голос между спутниками и узлами с тонко настраиваемыми правами доступа и без центрального облака.

СоздателиHiveMindи ключевые участникиOpenVoiceOS.


Стек, на котором мы строим

OpenVoiceOSHiveMind

Вместе с OpenVoiceOS

Два голоса. Все языки.

Miro и Dii — это две голосовые идентичности, которые звучат одинаково, на каком бы языке ни говорил ваш ассистент — по-настоящему универсальный фирменный голос для OpenVoiceOS. Мы обучаем одноязычную модель для каждого языка с помощью нашего конвейера клонирования голоса, попутно проводя исследования преобразования графем в фонемы — и охватываем языки под угрозой исчезновения, которые игнорируют массовые инструменты, такие как фризский, астурийский и арагонский. Каждый голос — этокрошечная модель на ~15,6 млн параметров которая работает на Raspberry Pi, телефоне или прямо в вашем браузере — без GPU, без облака.

В центре внимания

Что мы создаём и публикуем

Всё, что мы создаём, — это FOSS с возможностью самостоятельного размещения — без привязки к поставщику, без обязательного облака.

Наша работа охватывает весь голосовой стек — синтез речи, распознавание речи и обнаружение слов активации, а также плагины OpenVoiceOS, связывающие их воедино, и сеть HiveMind, запускающую ассистентов на множестве устройств. Со стороны данных семейство библиотек для скрейпинга, антибот-транспорта и разрешения сущностей превращает труднодоступные публичные веб-данные в чистые, типизированные API и воспроизводимые наборы данных. Каждый элемент — это небольшая, компонуемая библиотека, которую можно запустить на собственном оборудовании, а наборы данных и модели, стоящие за ними, включая наши многоязычные голоса Miro и Dii и инструменты для португальского языка, открыто публикуются на Hugging Face.

Смотреть весь открытый код Наборы данных и модели

Играть

Текстовые и голосовые игры

От классической интерактивной художественной литературы до генеративных миров на основе LLM — играбельны в командной строке или полностью голосом, с приоритетом звука для каждого.

Из блога

Последние публикации

Читать блог

Отзывы

Что говорят партнёры и пользователи

Слова людей и проектов, с которыми мы работаем.

“Если вам нужны решения в области голоса и ИИ, ориентированные на конфиденциальность, TigreGotico — наш главный выбор в качестве партнёра. Конфиденциальность заложена в их ДНК. Вы не найдёте другой организации, столь же преданной тому, чтобы ваши данные оставались локальными и защищёнными.”
Mike J. GrayOscillate Labs
“Касимиро проделал отличную работу над транскрипцией ATC для PilotGPT. Он был вдумчивым, технически сильным и способным быстро и творчески решить сложную реальную задачу с обработкой звука. Он неизменно выполнял работу высокого качества, и сотрудничать с ним было прекрасно. Я настоятельно рекомендую его на любую должность в области ИИ- и аудиоинженерии.”
Murti Hussain, Founder @ PilotGPTPilotGPT
“Касимиро был одной из движущих сил, благодаря которым голосовые ассистенты, ориентированные на конфиденциальность, стали практичными, а не просто желаемыми. Его работа над HiveMind и OpenVoiceOS сочетает сильную инженерию с глубоким уважением к конфиденциальности, открытости и долгосрочной сопровождаемости. Когда он создаёт инфраструктуру, она спроектирована так, чтобы расширять возможности разработчиков и пользователей, а не привязывать их к чужой экосистеме.”
Gaëtan Trellu, Founder @ ThalovantThalovant
“Касимиро — уникальный Python-разработчик и специалист по ИИ. Что делает его особенным, так это его творческая способность создавать индивидуальные решения в пространстве открытого кода в сочетании со здоровым, критическим подходом к решению задач, а не простым выполнением того, о чём его просят. Добавьте к этому глубокое понимание того, как работают его продукты — он сам создаёт наборы данных, модели и рабочие процессы — и вы всегда получите решение, соответствующее самым современным стандартам.”
Timon van Hasselt, VisioLabKoninklijke Visio

Давайте создавать

Есть идея голосового проекта?

Поговорите с теми, кто строит этот стек. Никаких брокеров данных, никакой привязки к поставщику — только приватные, открытые голосовые технологии, созданные, чтобы служить долго.