隐私优先的语音 AI
尊重你数据的语音技术。
在这个语音助手对数据贪得无厌的世界里,还有一条更好的路。TigreGótico 以隐私、开源和数据主权为基石构建语音技术。作为 HiveMind 技术栈的创造者以及 OpenVoiceOS 的核心贡献者,我们帮助您交付安全、符合 GDPR 的语音解决方案,让它们运行在您自己的硬件上——不会把任何数据发送到别人的云端。
我们的工作
语音技术——以及支撑它的数据工程
我们在整个开源技术栈上构建隐私优先的语音技术,并将难以获取的公开数据转化为整洁的 API 和数据集。
数据提取、整洁的 API 与数据集
这是我们的首要专长:我们解锁原本难以获取的公开数据——它们藏在无结构的页面、抗封锁的壁垒或未公开的接口之后——凭借稳健的抓取器和逆向工程得到的 API,再将其重新以整洁、类型化的客户端库呈现,并由此构建经过精选、可用于机器学习的数据集。
数据服务隐私优先的语音助手
在设备本地运行的 OpenVoiceOS 部署,将音频和数据保留在你自己的硬件上——从设计上即符合 GDPR。
定制语音模型——TTS 与 ASR
面向你的语言或品牌的离线文本转语音声音,以及针对你所在领域微调的语音识别(Zipformer、Parakeet、Whisper)——由我们与 Alpha Cephei 的 ASR 合作提供支持。
少数族群与葡语系语音技术
为主流工具所忽视、服务不足的语言提供音素化、ASR 与 TTS。
HiveMind 设备网状架构
在卫星节点与中枢之间分布的语音,具备细粒度权限,且无需中心云端。
以下项目的创建者:HiveMind及核心贡献者:OpenVoiceOS.
我们构建所依托的技术栈
携手 OpenVoiceOS
两种声音。所有语言。
Miro 与 Dii 是两种声音身份,无论你的助手使用哪种语言,听起来都别无二致——这是为 OpenVoiceOS 打造的真正通用的品牌之声。我们用自研的语音克隆流水线为每种语言训练一个单语模型,并在此过程中开展字素到音素的研究——我们还覆盖主流工具忽视的濒危语言,如弗里斯兰语、阿斯图里亚斯语和阿拉贡语。每个声音都是一个仅约 1560 万参数的微型模型 可运行在树莓派、手机上,或直接在你的浏览器中运行——无需 GPU,无需云端。
精选
我们构建与发布的成果
我们构建的一切都是自由开源软件,可自托管——不锁定、不强制上云。
我们的工作覆盖整个语音技术栈——文本转语音、语音识别和唤醒词检测,以及将它们串联起来的 OpenVoiceOS 插件,还有让助手在众多设备上运行的 HiveMind 网状架构。在数据侧,一系列用于抓取、抗封锁传输和实体消解的库,将难以获取的公开网络数据转化为整洁、类型化的 API 和可复现的数据集。每个组件都是小巧、可组合的库,你可以在自己的硬件上运行——而支撑它们的数据集和模型,包括我们的 Miro 与 Dii 多语种声音以及葡萄牙语工具,都在 Hugging Face 上公开发布。
游玩
文字与语音游戏
从经典交互式小说到由 LLM 驱动的生成式世界——可在命令行中游玩,也可完全通过语音游玩,以音频优先为所有人而设计。
来自博客
最新文章
用户评价
合作伙伴与用户怎么说
来自与我们共同构建的人与项目的话语。
“如果你需要隐私优先的语音和人工智能解决方案,TigreGotico 是我们首选的合作伙伴。隐私是他们与生俱来的基因。你找不到另一家像他们这样,如此致力于将你的数据保存在本地并保障其安全的机构。”
“Casimiro 在 PilotGPT 的 ATC 转录工作上表现出色。他思虑周全、技术过硬,能够以速度和创造力攻克一个棘手的真实世界音频难题。他始终交付高质量的成果,并且是极佳的合作伙伴。我强烈推荐他胜任任何人工智能/音频工程的岗位。”
“Casimiro 一直是推动隐私优先语音助手从空想走向实用的核心力量之一。他在 HiveMind 和 OpenVoiceOS 上的工作,将强大的工程能力与对隐私、开放性和长期可维护性的深切尊重相平衡。当他构建基础设施时,其设计是为了赋能开发者和用户——而不是把他们锁死在别人的生态系统里。”
“Casimiro 是一位独一无二的 Python 开发者和人工智能专家。他的独特之处在于能够在开源领域创造性地构建定制解决方案,并且拥有一种健康、批判性、以解决问题为导向的态度,而不是仅仅照着要求去做。再加上他对自己产品运作原理的深刻理解——数据集、模型和工作流程都由他亲手打造——你总能获得最先进的解决方案。”
一起构建
心中有个语音项目?
与构建这套技术栈的人对话。没有数据经纪商,没有锁定——只有为长久而生的私密、开放的语音技术。