Alpha Cephei
数十年にわたる自動音声認識(ASR)の専門知識を、当社の音声モデルのファインチューニングとデータセット作業にもたらす音声認識パートナーシップ。VoskおよびKaldiベースモデルを手がけたチーム。
ポートフォリオ
私たちのオープンソースの取り組み — 音声AI、データ抽出、データセット、NLP、ゲーム、そして私たちが構築を支援するOpenVoiceOSとHiveMindのエコシステムにまたがる、FOSSでセルフホスト可能なライブラリとツール。ロックインなし、必須のクラウドなし。
コードにとどまらず、私たちのオープンなデータセットとモデルはHugging Face,で公開されており、訓練用ノートブックはml-notebooksリポジトリにあります。
コミュニティ
私たちは独立したパートナーに貢献し、公的資金による成果をOpenVoiceOS財団に寄贈しています。
数十年にわたる自動音声認識(ASR)の専門知識を、当社の音声モデルのファインチューニングとデータセット作業にもたらす音声認識パートナーシップ。VoskおよびKaldiベースモデルを手がけたチーム。
国の公用語(スペイン語、カタルーニャ語、バスク語、ガリシア語)にわたる言語技術を推進するスペインのプログラム。Raspberry Piやパソコンで動作するダウンロード可能でプライバシーを尊重する音声アシスタントを作るため、OVOSの開発に資金を提供している。スペインのデジタル変革省とEU復興計画による資金提供。
欧州委員会のNext Generation Internetプログラム(スイスSERIの共同出資を伴う)で、大手テック企業の音声アシスタントに代わる、安定してプライバシーを最優先するOpenVoiceOSを支援する。重点は多言語対応、ユーザーオンボーディング、プラットフォームの安定化、ドキュメント整備。
コミュニティ主導でプライバシーを尊重するオープンソースの音声AIプラットフォームを構築する、独立した非営利財団。TigreGóticoはOpenVoiceOSの中核的な貢献者であり、その創設者は財団の理事を務めている。
探す
分野で絞り込んでさらに探索できます — すべてオープンソースです。
コーディングエージェントCLI(Claude Code、Gemini、opencode、Antigravity)を単一のProvider APIの背後にまとめた非同期Pythonラッパー。ワンショット、マルチターンセッション、型付きストリーミングイベント、およびファンアウト/委譲/リトライのパイプラインパターンに対応する。
Aho-Corasickアルゴリズムを用いた固有表現抽出。
バスク語およびスペイン語向けの、純Python・依存関係ゼロ・バージョン対応の書記素から音素への変換。AhoTTSフロントエンドを忠実に再現し、StyleTTS2/VITS音声の学習に使う単一文字のIPA文字列を出力する。
音声をテキストの文字起こしおよびIPAと、単語・書記素・文レベルで整合させるブラウザベースのツール。完全にクライアントサイドで動作し、サーバー・依存関係・ビルド手順は不要。
IPローテーションを備えた匿名HTTP。unblock_requestsと組み合わせることで、ローテーションとボット壁の回避を両立する。
orthography2ipa上に構築された、タシュキール(母音記号付与)を伴うルールベースのアラビア語(MSA)テキストからIPAへの変換。文脈依存のトークンツリーが太陽文字の同化、ハムザ・アルワスル、タンウィーン、ター・マルブータを処理し、まず付属のONNXモデルで無記号テキストに母音記号を付与する。
LibriVoxなどのソースからパブリックドメインのオーディオブックを検索・ストリーミングする。
純ONNXによる音声修復・ノイズ除去・帯域拡張。実行時にtorch不要で、狭帯域音声を48 kHzへアップスケールします。
Python向けの最小限のHTTPクライアントライブラリ。requestsの軽量な代替。
TTS向けのヨーロッパポルトガル語における異音同綴語の曖昧性解消。綴りは同じでも意味によって読み方が異なる語(sede=渇き対本部、forma=型対形)の正しい発音を選択する。純Python製のルールと学習モデルを備え、オープンデータセットを伴う。
11言語向けの事前学習済みBrill品詞タガー。NLTK上でそのまま使えるpickle化モデルとして提供され、学習なしでテキストにタグ付けできる。
会話型AIのためのONNXベース推論エンジン。
Classical Archivesからクラシック作曲家の情報を取得するPythonパッケージ。
多言語対応のCRFキーワード/検索語抽出器。品詞と正書法的特徴に対するCRFを用いて自然言語の質問からクエリを抽出し、言語ごとの事前学習済みモデルを備える。
ONNXによるDeepMojiの感情/絵文字予測。
7つのポルトガル語正書法規範の検出と相互変換。1911年以前の語源的表記、1911/1943/1945/1971/1973年の改革、およびそのヨーロッパ・ブラジル両下位変種を伴う1990年正書法協定(Acordo Ortográfico de 1990)に対応する。
会話を目的へと導くためのツール群。
人間の感情を扱うための構造化データと演算。
espeak-ngの書記素から音素へのフロントエンドを、依存関係なしで純Pythonに再実装したもの。C拡張なしでテキストを音素へ変換するのみ。86言語の見出し語スイープと31言語の文コーパスにわたりespeak-ngバイナリをバイト単位で再現し、117言語を同梱する。
共有のorthography2ipa発音ラティス上に構築された方言対応バスク語テキスト→IPA音素化ツール。オープンで検証可能、出典明記。
バランケーニョ語向けの書記素から音素への変換。
階層的なエージェントネットワークを構築するためのプロトコル。軽量なサテライトデバイスが暗号化メッシュを介して、OpenVoiceOSからLLMペルソナ、任意のA2Aエージェントまで、あらゆる対話エージェントに接続します。エコシステムはトランスポートプロトコル、音声サテライト、チャットブリッジ、暗号、ゼロコンフィグ発見を網羅します。
hivemind-core向けA2Aエージェントプロトコルプラグイン。JSON-RPC 2.0で外部のAgent-to-Agent(A2A)サーバーにハイブを橋渡しし、応答をサテライトへストリーミングします。
Python向けのシンプルなJSONファイルデータベース。
インテント認識のためのキーワードテンプレートマッチングエンジン。
単語リストに基づく、きわめてシンプルな純Python製の言語検出器。
Linux/SBCの電力とシステムテレメトリをMQTT経由でHome Assistantに配信する。CPU/GPU/RAM/ディスク、温度、スロットリング、音声+MPRIS、WiFi/Bluetoothを、すべて自動検出付きで。powerguessを基盤とする。
質問の解析と分類。
JSONデータからのマルコフ連鎖によるテキスト生成。
ONNXにエクスポートされたマルコフ連鎖モデル。
YouTubeなどのソースからメディアカタログをインデックス化・正規化・重複排除し、配信する。
タイトル、アーティスト、識別子が各種メディアクライアントやMusic Assistant連携間でどうマッピングされるかを統一する、共有メディアメタデータ語彙と正規化レイヤー。
Pydantic駆動のメディアメタデータクライアントと、キー不要のクロスソース・エンティティリゾルバー。
ミランダ語のためのルールベース音素化器。
numpyとscipyのみに依存するscikit-learn風の機械学習・ニューラルネットワークライブラリ。読まれるために書かれたコード。
型付きのメディアメタデータリリースを出力するSoundCloudクライアント。
コミュニティ主導でプライバシー第一のオープンソース音声アシスタントプラットフォーム。TigreGóticoはエコシステム全体の中核コントリビューターとして、数十のリポジトリで音声プラグイン、STT/TTSサービス、開発者ツール、正式仕様の策定を担っています。
純Pythonのデータ・オーバー・サウンドツールキット。共有のWAV/サイン波/Goertzelプリミティブを用いて、音声チャネルを介してテキストやデータ(DTMFほか)を伝送する。コアの方式は依存関係なしで動作する。
20以上の語族にわたる350以上の言語に対応した書記素からIPAへの変換と異音マッピング。最長一致IPAトークナイザー、音韻・文字距離指標、方言変換、プラガブルなG2Pバックエンドを備える。
OpenVoiceOSのためのエージェント統合フレームワーク。音声駆動のエージェント的ワークフローを実現する。
OpenVoiceOS向けメッセージバスモニター。バスのトラフィックをライブで観察し、スキル・インテント・サービスをデバッグできます。
OpenVoiceOSのためのChromaDBベクトル埋め込みプラグイン。
TTS合成の前にダイアログテキストを正規化するOVOSプラグイン(数値展開、略語処理)。
OpenVoiceOSにおける検索/RAG向けのドキュメントチャンク分割。
OVOSクエリ結果のための高速な意味的リランキングプラグイン。
OpenVoiceOSのためのローカルGGUF埋め込みプラグイン。
OpenVoiceOSのためのローカルLLM(GGUF)プラグイン。
OpenVoiceOSでGGUFモデルを用いるローカルLLMソルバー。
OpenVoiceOSのスキルとプラグインのためのGitHubネイティブなローカライズプラットフォーム。外部サービスを運用することなく、Gitだけで翻訳を管理できる。
OpenVoiceOSのインテント処理のためのModel2Vecインテントパイプライン。
会話ターンをOVOSメッセージバス経由で中継するOVOS ChatEngineプラグイン。チャットインターフェースを稼働中のアシスタントへ直結できます。
OpenVoiceOS向けオープンデータ・メトリクスサーバー。匿名の利用メトリクスを収集しオープンデータセットとして公開します。ILENIAプロジェクトの下で開発。
OVOSプラグインのベンチマーク・アリーナ。実ワークロード上でSTT・TTSなどのプラグイン実装を一対一で対戦させ、ELOレーティングで比較します。
OpenVoiceOSのためのQdrantベクトルデータベース埋め込みプラグイン。
ILENIA音声データで学習されたCitrinet音響モデルを用いるOVOS ASRプラグイン。
バスク語向けにZuazoがファインチューニングしたFaster-Whisperモデルを用いるOVOS ASRプラグイン。
HiTZバスク語音声認識のためのOVOS ASRプラグイン。
Meta MMSの大規模多言語音声認識を用いるOVOS ASRプラグイン。
NVIDIA NeMo ASRモデルを用いるOVOS ASRプラグイン。
NOSガリシア語音声認識のためのOVOS ASRプラグイン。
onnx-asrをラップしたOVOS音声認識プラグイン。torch不要でONNXモデルによる軽量ASRを実現します。
スペイン語および共同公用語向けにwav2vec 2.0モデルを用いるOVOS ASRプラグイン。
精度向上のためWhisperと言語モデルを組み合わせたOVOS ASRプラグイン。
任意のOpenVoiceOS STTプラグインをネットワークサービスとしてホスト。サテライトやサードパーティクライアント向けにHTTPで音声認識を提供する小さなサーバーです。
ILENIAのもとで開発されたバスク語音声合成システムAhoTTS向けのOVOS TTSプラグイン。
スペイン語音声向けにCoqui TTSをラップするOVOS TTSプラグイン。
ガリシア語音声合成エンジンCotovia向けのOVOS TTSプラグイン。
Matxaマルチスピーカーによるカタルーニャ語合成のためのOVOS TTSプラグイン。
NOSガリシア語音声合成のためのOVOS TTSプラグイン。
任意のOpenVoiceOS TTSプラグインをサービスとしてホスト。シンプルなflaskサーバーで、あらゆるTTSプラグインをセルフホスト型音声合成APIに変えます。
OVOS TTS向けオーディオ超解像。FlashSRが再生前にONNXで合成音声を16 kHzから48 kHzへアップサンプリングし、再学習なしで既存の声をより明瞭にします。
OVOS TTS向けオーディオ超解像。NovaSRが高速なFastSRアップサンプラーで合成音声を16 kHzから48 kHzへ引き上げ、既に48 kHzの音声はスキップします。
WyomingサービスとともにOpenVoiceOSを動かすDocker構成。
軽量なインプロセスランタイムを備えたOVOSスキル向けのエンドツーエンドテストフレームワーク。
きわめてシンプルなキーワードベースのインテントパーサー。必須/任意キーワードスロットで発話をマッチングするAdaptの代替品。TigreGóticoで生まれ、OpenVoiceOSに寄贈されました。
音声的あいまい検索とセグメント間距離の算出。
ONNXモデルを用いた多言語の音素化と音声合成(TTS)のためのPythonライブラリ。
phoonnxのニューラルONNX音声で読み上げるWindows NVDAスクリーンリーダーアドオン。アクセシビリティTTSバックエンドとしてのphoonnxを実演する。
onnxruntime-webによるブラウザ内VITS TTS推論。Unicodeおよびespeak-ngの経路に対応。サーバー不要、API不要。
SeleniumおよびSelenium Wire上に構築された自動ブラウザ制御ツール。セッション、イベント処理、要素操作、拡張機能の管理に対応し、フルブラウザが避けられないスクレイピングやテストに用いる。
Linuxデバイスの消費電力を推定または測定する、依存関係の少ないPythonライブラリ。各測定値に来歴(INA219、RAPL、Raspberry Pi PMIC、バッテリー、または校正済みの有界推定)を付与する。
precise-onnxウェイクワード検出のブラウザ/Node.js移植版。MFCC特徴抽出とONNXベースの検出により、Precise .onnxモデルと互換。
型付きのメディアメタデータリリースを出力するBandcampスクレイパー。
Music Assistantサーバー向けのPython HTTPクライアント兼mediavocabブリッジ。OVOS Music Assistant連携の背後にある共有トランスポートおよび変換レイヤー。
北部(大陸)バスク語向け音声合成エンジンAhoTTS Iparrahotsaの Python移植版。pyAhoTTSのイパラルデ方言版で、hts_engineとAhoCoderボコーダーを備える。Aholab(UPV/EHU)と共同開発。
Classical Archives向けの型付きPythonクライアント。
ガリシア語およびスペイン語向けのCotovia G2Pフロントエンドの純Python移植版。サブプロセスを用いず、コンパイル済みCバイナリの音節分割、強勢、転写のパイプラインを再現する。
Discogsの月次データダンプ向けのストリーミングPythonクライアント。
Erowid(erowid.org)向けの型付きPythonクライアント兼markdownデータセットダンパー。
EYE N3推論エンジンの純Python移植版。Notation3の事実と規則を与えると、前向き/後ろ向き連鎖、RDFSおよびOWL 2 RL含意、証明木、280以上の組み込み関数を通じて新たな事実を導出する。依存関係はrdflibの一つのみ。
Project Gutenberg向けのPythonクライアント。オープンカタログを介した書籍メタデータ。
iHeartRadio APIクライアント。
OxfordのOWL 2 DL推論器HermiTの純Python移植版。ハイパー導出タブローによる整合性検査、分類、インスタンス検索を、JVM不要・実行時依存ゼロで実現する。
IMDb向けのPythonメタデータクライアント。自由文のクエリを正規のIMDbタイトルへ解決する。
Porto Editoraのヨーロッパポルトガル語辞書Infopédia向けの型付きPythonクライアント。各項目をIPA発音、音節分割、語源、語義に解析し、G2Pと曖昧性解消の作業のために異音同綴語を正しく分離する。
InspiroBot(inspirobot.me)と連携するPythonパッケージ。
Jazz Music Archives向けの型付きPythonクライアント。
LiveATC.net向けのPythonクライアント。ライブおよび過去の航空管制(ATC)音声フィードを発見・ストリーミング・アーカイブし、ASR学習用のデータセットエクスポートに対応する。
Encyclopaedia Metallum(Metal Archives)APIクライアント。
オープンな音楽百科事典MusicBrainz向けのPythonメタデータクライアント。
Portal da Lingua Portuguesa向けの型付きPythonクライアント。
Prog Archives向けの型付きPythonクライアント。
PsychonautWiki(psychonautwiki.org)向けの型付きPythonクライアント兼markdownデータセットダンパー。
rateyourmusic.com向けのPython HTMLスクレイパー。
romhacking.net(RHDN)向けのPythonスクレイパー。ROMハック、ファン翻訳、パッチ適用ユーティリティ、ドキュメントのコミュニティデータベース。
堅牢な音声フィンガープリンティングのためshazamio_coreの上に構築された、モジュール型で非同期のShazam API Pythonクライアント。
smwcentral.netの公開JSON API向けPythonクライアント。Super Mario World/SM64/Yoshi's IslandのROMハッキングカタログにページ単位でアクセスする。
TripSitの薬物ファクトシート+相互作用マトリクスクライアント(ハームリダクション)。
tvtropes.orgのPmWiki向けPython HTMLスクレイパー。
VNDB(Visual Novel Database)のkana公開JSON API向けPythonクライアント。
英語WiktionaryのMediaWiki API向け型付きPythonクライアント。
多言語対応の「今日の単語(Word-of-the-Day)」アグリゲータークライアント。
Rapid Automatic Keyword Extractionの実装。
raspOVOS向けオーディオ自動設定ライブラリ。Raspberry Pi上のサウンドカード・HAT・USBデバイスを検出し、音声アシスタント用に自動設定します。ILENIAプロジェクトの下で開発。
CypherpunkおよびMixmasterプロトコルに対応した匿名メールリメーラークライアント。
依存関係ゼロの文字体系・音素表記コア — ISO-15924判定、IPA ↔ ARPABET/X-SAMPA/Kirshenbaum/Cotovía、Buckwalter ↔ アラビア文字、ハングル → 字母、かな。
室内音声をShazamでフィンガープリントし、トラックのメタデータ(タイトル、アーティスト、アートワーク、歌詞、Apple Music/Spotify/Deezerのリンク)をHome Assistant自動検出付きでMQTTに配信するDocker化ブリッジ。
ポルトガル語テキストの音節分割ツール。
シンプルなルールベースの固有表現抽出。
スクレイパー構築前にサイト構造を把握するためのサイト偵察ユーティリティ。unblock_requestsトランスポートを用いてrobots.txt、サイトマップ、リンクグラフをマッピングし、保護された複雑なサイトも堅牢に探索する。
ヨーロッパポルトガル語の地域アクセント向け音素化器。
純onnxruntime製の話者埋め込みライブラリ。ONNXモデルから話者埋め込みを抽出し、コサイン類似度を計算し、話者の同一性を検証する。実行時にPyTorchを使わない。
統一された音声評価メトリクス — ニューラルMOS(UTMOS・NISQA・SIGMOS・DNSMOS)、侵入型(STOI・SI-SDR・MCD)、ASR(WER/CER)— numpyとonnxruntimeのみで動作。
SSHFS/rcloneマウントを監視し、切断時に自動で再マウントするデーモン。ライブWebダッシュボード、REST API、Prometheusメトリクス、Webhook、スケジュール実行のrsync/rclone同期ジョブを備える。
TTSフロントエンド向けの多言語語アクセント配置。onnxruntimeとnumpyのみで動作します。
Python向けの複数プロバイダー統合天気抽象化ライブラリ。OpenWeatherMap、Open-Meteo、MetNo、IPMA、NWSなどを一貫した単一APIで照会できる。
軽量なアラビア語の母音記号付与(タシュキール)。欠落した母音記号を復元する交換可能なONNXモデル群を、単一の小さなAPIで扱う。PyTorch不要で、既定でオフライン動作。arbtokの母音記号付与ステップを支える。
ポルトガル語の書記素から音素への変換ツール。
軽量なポルトガル語の品詞(POS)タガー。
Cloudflareを回避するrequests.Sessionのサブクラス(curl_cffiによるなりすまし、FlareSolverr、Waybackフォールバック)。当社スクレイパーの基盤となるアンチボット向けトランスポート。
代替プロトコルの研究とアーカイブのためのライブUSENETリーダー兼記事スクレイパー。
ovos-plugin-managerを用いたリアルタイム音声区間検出(VAD)ブリッジ。発話確率(0〜100%)、ノイズレベル(dB)、およびデバウンス処理された発話検出バイナリセンサーを、Home Assistant自動検出付きでMQTTに配信する。
ONNX流の音声区間検出。小さなランタイム(numpy+onnxruntime)を備えた単一のストリーミングAPIの背後に、あらゆるVADモデルを読み込む。phoonnxのVAD版であり、ほとんどのバックエンドはコードではなくデータである。
純ONNX・マルチエンジンの音声変換。推論時にPyTorchを一切使わず、あらゆる音声を参照話者の声に変換する。単一のVoiceCloner APIの背後に14のエンジン(kNN-VC、FreeVC、OpenVoice、RVC、CosyVoiceなど)を備え、CLIとINT8ビルドも提供する。
OpenVoiceOSのためにNLnet助成のもとで開発されたウェイクワードモデル学習ツール。自分のサンプルからカスタムのオンデバイスウェイクワードを構築できる。
ウェイクワード音声を手作業でラベル付けするためのFlask Webアプリ。各クリップを再生し、単語、話者の性別、ノイズの種類をタグ付けして、学習や評価に使えるコーパスとして保存する。
Wyomingプロトコル向けのOpenVoiceOS ASRサービス。軽量な音声認識。
Wyomingプロトコル向けのOpenVoiceOS TTSサービス。軽量な音声合成。
Wyomingプロトコル向けのOpenVoiceOSウェイクワード検出サービス。