Portafolio

Código Abierto

Nuestro trabajo de código abierto: bibliotecas y herramientas libres y autoalojables que abarcan IA de voz, extracción de datos, datasets, NLP y juegos, además del ecosistema OpenVoiceOS y HiveMind que ayudamos a construir. Sin dependencias forzadas, sin nube obligatoria.


Más allá del código, nuestros datasets y modelos abiertos están publicados enHugging Face,y nuestros notebooks de entrenamiento viven en el repositorioml-notebooks.

Comunidad

Trabajando con la comunidad

Contribuimos a socios independientes y donamos el trabajo con financiación pública a la fundación OpenVoiceOS.

Alpha Cephei

Una colaboración en reconocimiento de voz que aporta décadas de experiencia en reconocimiento automático del habla (ASR) —el equipo tras Vosk y los modelos basados en Kaldi— a nuestro trabajo de ajuste de modelos de voz y de conjuntos de datos.

ILENIA

Programa español que impulsa la tecnología del lenguaje en las lenguas oficiales del país (español, catalán, euskera, gallego). Financia el desarrollo de OVOS para crear asistentes de voz descargables y respetuosos con la privacidad que funcionan en Raspberry Pi y ordenadores personales. Financiado por el Ministerio de Transformación Digital de España y el Plan de Recuperación de la UE.

NGI0 Commons Fund / NLnet

Programa Next Generation Internet de la Comisión Europea (con cofinanciación del SERI suizo) que apoya a OpenVoiceOS como una alternativa estable y centrada en la privacidad a los asistentes de voz de las grandes tecnológicas. Enfoque: soporte multilingüe, incorporación de usuarios, estabilización de la plataforma y documentación.

OpenVoiceOS

Una fundación independiente sin ánimo de lucro que construye una plataforma de IA de voz de código abierto, impulsada por la comunidad y respetuosa con la privacidad. TigreGótico es un contribuidor principal de OpenVoiceOS, y su fundador forma parte de la junta de la fundación.

Explorar

Destacados

Filtre por área para explorar más: todo es código abierto.

Herramientas para Desarrolladores

agentpipe

Envoltorio asíncrono de Python para CLIs de agentes de programación (Claude Code, Gemini, opencode, Antigravity) tras una única API Provider: sesiones de un solo turno o multiturno, eventos tipados en streaming y patrones de pipeline de fan-out/delegación/reintento.

  • agents
  • async
  • CLI
  • orchestration
NLP y Lenguaje

Ahocorasick NER

Reconocimiento de entidades nombradas mediante el algoritmo de Aho-Corasick.

  • Aho-Corasick
  • gazetteer
  • named-entity recognition
Fonética y G2P

ahotts-g2p

Grafema a fonema en Python puro, sin dependencias y consciente de la versión para euskera y español: reproduce fielmente el front-end de AhoTTS y emite la cadena IPA de un solo carácter usada para entrenar voces StyleTTS2/VITS.

  • G2P
  • Basque
  • Spanish
  • IPA
Reconocimiento de Voz

ALIGN

Herramienta en el navegador para alinear audio con transcripciones de texto e IPA a nivel de palabra, grafema y oración. Se ejecuta enteramente en el cliente, sin servidor, sin dependencias y sin paso de compilación.

  • IPA
  • audio-text alignment
  • browser-based
  • JavaScript
Datos y Scraping

anon_requests

HTTP anónimo con rotación de IP; se combina con unblock_requests para sumar rotación y elusión de muros antibots.

  • HTTP
  • IP rotation
  • privacy
Fonética y G2P

arbtok

Conversión de texto árabe (MSA) a IPA basada en reglas con diacritización tashkeel, construida sobre orthography2ipa: un árbol de tokens sensible al contexto gestiona la asimilación de las letras solares, la hamzat al-waṣl, el tanwīn y la tāʾ marbūṭa, diacritizando primero el texto sin vocalizar mediante modelos ONNX incluidos.

  • Arabic
  • G2P
  • IPA
  • diacritization
Medios y Música

audiobooker

Busca y reproduce audiolibros de dominio público de LibriVox y fuentes similares.

  • LibriVox
  • audiobooks
  • scraper
Síntesis de Voz

audiosronnx

Restauración de voz, eliminación de ruido y extensión de ancho de banda en ONNX puro: escala voz de banda estrecha a 48 kHz sin torch en ejecución.

  • ONNX
  • audio super-resolution
  • speech enhancement
Herramientas para Desarrolladores

baresipy

Biblioteca cliente HTTP mínima para Python: alternativa ligera a requests.

  • HTTP
  • Python
  • client
  • lightweight
Fonética y G2P

bifonia

Desambiguación de homógrafos heterófonos para TTS en portugués europeo: elige la pronunciación correcta de palabras que se escriben igual pero se leen distinto según el significado (sede = sed frente a sede central, forma = molde frente a forma). Reglas en Python puro más modelos aprendidos, con conjuntos de datos abiertos.

  • grapheme-to-phoneme
  • TTS
  • homographs
  • word-sense disambiguation
NLP y Lenguaje

brill_postaggers

Etiquetadores gramaticales de Brill preentrenados para 11 lenguas, distribuidos como modelos serializados listos para usar sobre NLTK: etiqueta texto sin entrenar.

  • POS tagging
  • 11 languages
  • NLTK
Medios y Música

classical-archives

Paquete de Python para obtener información sobre compositores clásicos de Classical Archives.

  • Classical music
  • API client
  • Music archives
NLP y Lenguaje

crf_query_xtract

Extractor multilingüe de palabras clave/términos de búsqueda con CRF: extrae la consulta de una pregunta en lenguaje natural mediante un CRF sobre características de POS y ortográficas, con modelos preentrenados por lengua.

  • keyword extraction
  • CRF
  • multilingual
Fonética y G2P

desacordo_ortografico

Detecta y convierte entre siete normas ortográficas del portugués: la escritura etimológica anterior a 1911, las reformas de 1911/1943/1945/1971/1973 y el Acordo Ortográfico de 1990 con sus subvariantes europea y brasileña.

  • Portuguese
  • orthography
  • AO1990
  • text conversion
Fonética y G2P

espyak

Reimplementación en Python puro y sin dependencias del front-end de grafema a fonema de espeak-ng: solo de texto a fonemas, sin extensión en C. Reproduce el binario de espeak-ng byte a byte en un barrido de palabras de entrada en 86 lenguas y un corpus de oraciones en 31 lenguas; 117 lenguas incluidas.

  • G2P
  • IPA
  • phonemization
  • espeak-ng
Fonética y G2P

euskaphone

Fonemizador vasco de texto a IPA sensible a dialectos, construido sobre la red de pronunciación compartida orthography2ipa: abierto, inspeccionable y con fuentes citadas.

  • Basque
  • G2P
  • IPA
  • TTS frontend
Voice PlatformsDestacado

HiveMind

Un protocolo para construir redes jerárquicas de agentes: dispositivos satélite ligeros se conectan por una malla cifrada a cualquier agente conversacional, desde OpenVoiceOS hasta personas LLM y agentes A2A arbitrarios. El ecosistema abarca protocolos de transporte, satélites de voz, puentes de chat, criptografía y descubrimiento sin configuración.

  • agent networks
  • distributed voice
  • protocol
NLnet

hivemind-a2a-agent-plugin

Plugin de protocolo de agente A2A para hivemind-core: conecta la hive con servidores externos Agent-to-Agent (A2A) mediante JSON-RPC 2.0, transmitiendo las respuestas a los satélites.

  • A2A
  • agent
  • interoperability
NLP y Lenguaje

lingua-podre

Detector de idiomas en Python puro, sencillísimo y basado en listas de palabras.

  • NLP
  • language detection
Hogar Inteligente

linux2mqtt

Publica la telemetría de energía y de sistema de un Linux/SBC en Home Assistant a través de MQTT: CPU/GPU/RAM/disco, temperaturas, limitación térmica, audio + MPRIS, WiFi/Bluetooth, todo autodescubierto. Construido sobre powerguess.

  • MQTT
  • Home Assistant
  • power
  • system monitoring
NLP y Lenguaje

MarkovJSON

Generación de texto con cadenas de Markov a partir de datos JSON.

  • JSON
  • Markov chains
  • text generation
Medios y Música

media-archivist

Indexa, canonicaliza, deduplica y sirve catálogos multimedia de YouTube y otras fuentes.

  • catalogue
  • homelab
  • indexing
  • media
Medios y MúsicaDestacado

mediavocab

Un vocabulario compartido de metadatos multimedia y una capa de normalización que unifica cómo se corresponden títulos, artistas e identificadores entre clientes multimedia e integraciones de Music Assistant.

  • media metadata
  • normalization
  • vocabulary
Medios y Música

metadatarr

Clientes de metadatos multimedia impulsados por Pydantic y un resolvedor de entidades entre fuentes sin claves.

  • Pydantic
  • media metadata
  • resolver
Herramientas para Desarrolladores

nupyml

Biblioteca de aprendizaje automático y redes neuronales al estilo scikit-learn, con solo numpy y scipy como dependencias: escrita para ser leída.

  • machine learning
  • numpy
  • education
Medios y Música

nuvem_de_som

Cliente de SoundCloud que emite publicaciones tipadas de metadatos multimedia.

  • SoundCloud
  • music
  • scraper
Voice PlatformsDestacado

Open Voice OS

Plataforma de asistente de voz de código abierto, comunitaria y centrada en la privacidad. TigreGótico es contribuidor central de todo el ecosistema: mantiene plugins de voz, servicios STT/TTS, herramientas de desarrollo y trabajo formal de especificación en decenas de repositorios.

  • FOSS
  • privacy-first
  • voice platform
Herramientas para Desarrolladores

OpenTone

Kit de herramientas de datos por sonido en Python puro: transmite texto y datos por un canal de audio (DTMF y más) usando primitivas compartidas de WAV/seno/Goertzel. Los esquemas básicos no tienen dependencias.

  • data-over-sound
  • DTMF
  • audio
  • signal processing
Fonética y G2PDestacado

orthography2ipa

Correspondencias de grafema a IPA y de alófonos para más de 350 lenguas de más de 20 familias: tokenizador de IPA por máxima coincidencia, métricas de distancia fonológica y de escritura, transformaciones dialectales y un backend de G2P conectable.

  • 350+ languages
  • G2P
  • IPA
  • phonemization
NLnet

OVOS Agentic Loop

Framework de integración de agentes para OpenVoiceOS: habilita flujos de trabajo agénticos controlados por voz.

  • OpenVoiceOS
  • agentic
  • agents
  • integration
NLnet

ovos-busmon

Monitor del messagebus para OpenVoiceOS: observa el tráfico del bus en vivo para depurar skills, intents y servicios.

  • messagebus
  • debugging
  • monitoring
NLnet

ovos-localize

Plataforma de localización nativa de GitHub para skills y plugins de OpenVoiceOS: gestiona las traducciones íntegramente a través de Git, sin ningún servicio externo que ejecutar.

  • GitHub-native
  • i18n
  • localization
  • no-infra
ILENIA

OVOS M2V Pipeline

Pipeline de intenciones Model2Vec para la gestión de intenciones en OpenVoiceOS.

  • Model2Vec
  • ONNX models
  • intent classification
  • NLnet
NLnet

ovos-messagebus-chat-plugin

Plugin ChatEngine de OVOS que canaliza los turnos de conversación a través del messagebus de OVOS: conecta interfaces de chat directamente con un asistente en ejecución.

  • chat
  • messagebus
  • plugin
ILENIA

ovos-opendata-server

Servidor de métricas en datos abiertos para OpenVoiceOS: recopila métricas de uso anónimas y las publica como datasets abiertos; desarrollado en el marco del proyecto ILENIA.

  • metrics
  • open data
  • server
NLnet

ovos-plugin-arena

Arena de benchmarking para plugins de OVOS: enfrentamientos directos con rankings ELO para comparar implementaciones de STT, TTS y otros plugins con cargas reales.

  • benchmark
  • ELO
  • plugins
NLnet

ovos-stt-server

Sirve cualquier plugin STT de OpenVoiceOS como servicio de red: un pequeño servidor que expone el reconocimiento de voz por HTTP para satélites y clientes de terceros.

  • STT
  • server
  • self-hosted
NLnet

ovos-tts-server

Sirve cualquier plugin TTS de OpenVoiceOS como servicio: un servidor flask sencillo que convierte cualquier plugin TTS en una API de síntesis de voz autoalojada.

  • TTS
  • server
  • self-hosted
NLnet

ovos_tts_transformer_FlashSR

Superresolución de audio para TTS en OVOS: FlashSR eleva la voz sintetizada de 16 kHz a 48 kHz vía ONNX antes de la reproducción, aclarando cualquier voz existente sin reentrenar.

  • TTS
  • super-resolution
  • ONNX
NLnet

ovos_tts_transformer_NovaSR

Superresolución de audio para TTS en OVOS: NovaSR eleva la voz sintetizada de 16 kHz a 48 kHz con el veloz upsampler FastSR, omitiendo el audio que ya esté a 48 kHz.

  • TTS
  • super-resolution
  • ONNX
NLnet

ovoscope

Framework de pruebas de extremo a extremo para skills de OVOS con un entorno de ejecución ligero en el propio proceso.

  • OVOS skills
  • end-to-end testing
  • in-process runtime
NLnet, NLP y Lenguaje

palavreado

Parser de intents por palabras clave, simple y directo: sustituto inmediato de Adapt que compara enunciados con slots de palabras clave obligatorias/opcionales; nacido en TigreGótico y donado a OpenVoiceOS.

  • intent parsing
  • NLP
Síntesis de VozDestacado

phoonnx

Biblioteca de Python para fonemización multilingüe y síntesis de voz (TTS) mediante modelos ONNX.

  • ONNX models
  • multilingual TTS
  • phonemization
Síntesis de Voz

phoonnx-AddonNVDA

Complemento del lector de pantalla NVDA para Windows que habla mediante las voces neuronales ONNX de phoonnx, demostrando phoonnx como backend de TTS de accesibilidad.

  • NVDA
  • accessibility
  • screen reader
  • ONNX
Síntesis de Voz

phoonnx.js

Inferencia TTS con VITS en el navegador usando onnxruntime-web. Rutas Unicode y espeak-ng. Sin servidor, sin API.

  • ONNX
  • TTS
  • browser
  • VITS
Datos y Scraping

pombo_correio

Controlador de navegador automatizado construido sobre Selenium y Selenium Wire: sesiones, gestión de eventos, interacción con elementos y gestión de extensiones para scraping y pruebas donde un navegador completo es inevitable.

  • browser automation
  • Selenium
  • scraper
Hogar Inteligente

powerguess

Estima o mide el consumo de energía de un dispositivo Linux: una biblioteca de Python con pocas dependencias y con trazabilidad en cada lectura (INA219, RAPL, PMIC de Raspberry Pi, batería o una estimación acotada y calibrada).

  • power
  • energy
  • RAPL
  • INA219
Palabras de Activación

precise-onnx-js

Adaptación para navegador/Node.js de la detección de palabra de activación precise-onnx. Extracción de características MFCC + detección basada en ONNX compatible con modelos .onnx de Precise.

  • ONNX
  • Wake words
  • Web
  • Audio
NLP y Lenguaje

pronomial

Resolución de correferencias mediante heurísticas de POS de pronombres y género de las palabras.

  • NLP
  • coreference
Medios y Música

py_bandcamp

Scraper de Bandcamp que emite publicaciones tipadas de metadatos multimedia.

  • Bandcamp
  • music
  • scraper
Hogar Inteligente

py-music-assistant

Cliente HTTP de Python y puente mediavocab para un servidor de Music Assistant: la capa compartida de transporte y conversión que hay detrás de la integración de Music Assistant en OVOS.

  • Music Assistant
  • media metadata
  • API client
ILENIA

pyAhoTTS

Biblioteca de Python para la síntesis de voz AhoTTS.

  • AhoTTS
  • ILENIA project
  • Python
  • TTS library
ILENIA

pyAhoTTS-Iparrahotsa

Adaptación en Python de AhoTTS Iparrahotsa, un motor de síntesis de voz para el euskera septentrional (continental): el equivalente en dialecto de Iparralde de pyAhoTTS, con hts_engine y el vocoder AhoCoder. Desarrollado con Aholab (UPV/EHU).

  • AhoTTS
  • Basque
  • ILENIA
  • TTS library
Fonética y G2P

pycotovia

Adaptación en Python puro del front-end de G2P de Cotovia para gallego y español. Reproduce la silabificación, la acentuación y el pipeline de transcripción del binario C compilado sin subprocesos.

  • G2P
  • Galician
  • Spanish
  • phonemization
Medios y Música

pydiscogs

Cliente de Python en streaming para los volcados de datos mensuales de Discogs.

  • Discogs
  • Music metadata
  • Data dumps
  • API client
Datos y Scraping

pyerowid

Cliente de Python tipado + volcador de conjuntos de datos en markdown para Erowid (erowid.org).

  • Erowid
  • Harm reduction
  • API client
  • Dataset
Herramientas para Desarrolladores

pyeye

Adaptación en Python puro del motor de razonamiento EYE N3: aliméntalo con hechos y reglas en Notation3 y deriva nuevos hechos mediante encadenamiento hacia delante/atrás, entailment de RDFS y OWL 2 RL, árboles de prueba y más de 280 built-ins. Una sola dependencia (rdflib).

  • N3
  • reasoner
  • RDF
  • forward chaining
Juegos

pyFrotz

Envoltorio de Python para un motor de ficción interactiva.

  • Python
  • Z-machine
  • game
  • interactive fiction
Medios y Música

pygutenberg

Cliente de Python para Project Gutenberg: metadatos de libros a través del catálogo abierto.

  • Project Gutenberg
  • Books
  • API client
  • Literature
Herramientas para Desarrolladores

pyhermit

Adaptación en Python puro de HermiT, el razonador OWL 2 DL de Oxford: consistencia, clasificación y recuperación de instancias mediante un tableau de hiperresolución, sin JVM y sin dependencias en tiempo de ejecución.

  • OWL 2
  • reasoner
  • symbolic
  • logic
Medios y Música

pyimdb

Cliente de metadatos en Python para IMDb. Resuelve consultas de texto libre a títulos canónicos de IMDb.

  • IMDb
  • Movies
  • Metadata
  • API client
Datos y Scraping

pyinfopedia

Cliente de Python tipado para Infopédia, el diccionario de portugués europeo de Porto Editora: analiza cada entrada en pronunciaciones IPA, silabificación, etimología y acepciones, separando correctamente los homógrafos heterófonos para el trabajo de G2P y desambiguación.

  • Portuguese
  • dictionary
  • IPA
  • lexicon
Datos y Scraping

pyinspirobot

Un paquete de Python para interactuar con InspiroBot (inspirobot.me).

  • InspiroBot
  • Quotes
  • API client
  • Fun
Datos y Scraping

pyliveatc

Cliente de Python para LiveATC.net: descubre, transmite y archiva emisiones de audio de control de tráfico aéreo en vivo e históricas, con exportación de conjuntos de datos para el entrenamiento de ASR.

  • API client
  • ATC
  • audio
  • scraper
Medios y Música

pymal

Scraper / cliente de API para MyAnimeList: anime y manga.

  • anime
  • manga
  • scraper
Medios y Música

pymetal

Cliente de la API de Encyclopaedia Metallum (Metal Archives).

  • API client
  • Metal Archives
  • metal
Medios y Música

pymusicbrainz

Cliente de metadatos en Python para MusicBrainz, la enciclopedia musical abierta.

  • MusicBrainz
  • Music metadata
  • API client
Datos y Scraping

pypsychonaut

Cliente de Python tipado + volcador de conjuntos de datos en markdown para PsychonautWiki (psychonautwiki.org).

  • PsychonautWiki
  • Harm reduction
  • API client
  • Dataset
Datos y Scraping

pyromhacking

Scraper de Python para romhacking.net (RHDN): la base de datos comunitaria de romhacks, traducciones de fans, utilidades de parcheo y documentación.

  • scraper
  • games
  • fan translation
Medios y Música

pyshazam

Un cliente de Python modular y asíncrono para la API de Shazam, construido sobre shazamio_core para una identificación de audio robusta.

  • Shazam
  • Audio fingerprinting
  • Music recognition
  • API client
Datos y Scraping

pysmwcentral

Cliente de Python para la API pública JSON de smwcentral.net: acceso paginado al catálogo de romhacking de Super Mario World / SM64 / Yoshi's Island.

  • API client
  • games
  • scraper
Datos y Scraping

pytripsit

Cliente de las fichas informativas de drogas y la matriz de interacciones de TripSit (reducción de daños).

  • TripSit
  • Harm reduction
  • Drug interactions
  • API client
Medios y Música

pytvtropes

Scraper de HTML en Python para el PmWiki de tvtropes.org.

  • TV Tropes
  • Media analysis
  • Scraper
Juegos

pyvndb

Cliente de Python para la API pública JSON kana de VNDB (Visual Novel Database).

  • Visual Novels
  • Games
  • API client
  • VNDB
Datos y Scraping

pywiktionary

Cliente de Python tipado para la API de MediaWiki del Wiktionary en inglés.

  • Wiktionary
  • Dictionary
  • API client
  • Language
Datos y Scraping

pywod

Cliente agregador multilingüe de palabra del día.

  • Word of the Day
  • Language
  • API client
  • Dictionary
Medios y Música

radiosoma

Cliente de SomaFM que emite publicaciones tipadas de metadatos multimedia.

  • SomaFM
  • client
  • radio
ILENIA

raspovos-audio-setup

Biblioteca de autoconfiguración de audio para raspOVOS: detecta tarjetas de sonido, HATs y dispositivos USB en la Raspberry Pi y los configura para asistentes de voz; desarrollada en el marco del proyecto ILENIA.

  • Raspberry Pi
  • audio
  • raspOVOS
Datos y Scraping

remailers

Cliente de reenvío anónimo de correo con soporte para los protocolos Cypherpunk y Mixmaster.

  • anonymity
  • email
  • privacy
  • remailers
Fonética y G2P

scriptconv

Núcleo de escrituras y notación fonémica sin dependencias — detección ISO-15924, IPA ↔ ARPABET/X-SAMPA/Kirshenbaum/Cotovía, Buckwalter ↔ árabe, Hangul → jamo, kana.

  • IPA
  • transliteration
  • phoneme notation
  • zero dependencies
Hogar Inteligente

shazam2mqtt

Puente en Docker que identifica el audio de la sala con Shazam y publica los metadatos de la pista (título, artista, carátula, letra, enlaces de Apple Music / Spotify / Deezer) en MQTT con autodescubrimiento de Home Assistant.

  • Shazam
  • MQTT
  • Home Assistant
  • music recognition
Fonética y G2P

Silabificador

Herramienta de silabificación de texto en portugués.

  • Portuguese syllabification
  • text processing
  • Portuguese
Datos y Scraping

sitemapper

Utilidad de reconocimiento de sitios para conocer la estructura de un sitio antes de construir scrapers. Mapea robots.txt, sitemaps y grafos de enlaces usando el transporte unblock_requests para una exploración resiliente de sitios protegidos o complejos.

  • web scraping
  • site mapping
  • robots.txt
  • sitemap
Reconocimiento de Voz

speakeronnx

Biblioteca de embeddings de locutor en onnxruntime puro: extrae embeddings de locutor, calcula la similitud del coseno y verifica la identidad del locutor a partir de modelos ONNX, sin PyTorch en tiempo de ejecución.

  • ONNX
  • speaker embeddings
  • speaker verification
Síntesis de Voz, Reconocimiento de Voz

speechonnxmetrics

Métricas unificadas de evaluación de voz — MOS neuronal (UTMOS, NISQA, SIGMOS, DNSMOS), intrusivas (STOI, SI-SDR, MCD) y ASR (WER/CER) — solo con numpy y onnxruntime.

  • ONNX
  • evaluation
  • MOS
  • WER
Herramientas para Desarrolladores

sshfs-keeper

Un demonio que supervisa los montajes SSHFS/rclone y los vuelve a montar automáticamente cuando se caen, con un panel web en vivo, API REST, métricas de Prometheus, webhooks y tareas programadas de sincronización rsync/rclone.

  • SSHFS
  • homelab
  • monitoring
  • self-hosted
Fonética y G2P

stressonnx

Colocación multilingüe del acento léxico para front-ends de TTS, usando solo onnxruntime y numpy.

  • ONNX
  • TTS frontend
  • word stress
Datos y Scraping

temporalis

Biblioteca de Python de abstracción meteorológica unificada y multiproveedor. Consulta OpenWeatherMap, Open-Meteo, MetNo, IPMA, NWS y más a través de una API coherente.

  • Weather
  • Multi-provider
  • API client
  • Open-Meteo
Fonética y G2P

text2tashkeel

Diacritización ligera del árabe (tashkeel): una única API pequeña sobre modelos ONNX intercambiables que restauran las marcas vocálicas ausentes, sin PyTorch y sin conexión por defecto. Impulsa el paso de diacritización de arbtok.

  • Arabic
  • diacritization
  • tashkeel
  • ONNX
NLP y Lenguaje

tugalex

Gestor de léxico y utilidad lingüística para los dialectos del portugués.

  • NLP
  • Portuguese
  • lexicon
NLP y Lenguaje

tugamorph

Analizador morfológico basado en reglas para portugués: segmenta las palabras en morfemas.

  • NLP
  • Portuguese
  • morphology
Fonética y G2P

TugaPhone

Herramientas de grafema a fonema para portugués.

  • Portuguese phonemes
  • dataset
  • phonetics
  • Portuguese
Medios y Música

tunein

Scraper de radio TuneIn que emite publicaciones tipadas de metadatos multimedia.

  • TuneIn
  • radio
  • scraper
Medios y Música

tutubo

Scraper ligero de YouTube que emite publicaciones tipadas de metadatos multimedia.

  • YouTube
  • scraper
  • video
Datos y ScrapingDestacado

unblock_requests

Una subclase de requests.Session que sortea Cloudflare (impersonación con curl_cffi, FlareSolverr, respaldo con Wayback): el transporte antibots que hay detrás de nuestros scrapers.

  • HTTP
  • anti-bot
  • scraping
Datos y Scraping

usenet

Lector de USENET en vivo y scraper de artículos para investigación y archivo de protocolos alternativos.

  • USENET
  • privacy
  • protocols
  • scraping
Hogar Inteligente

vad2mqtt

Puente de detección de actividad de voz en tiempo real basado en ovos-plugin-manager. Publica la probabilidad de habla (0–100 %), el nivel de ruido (dB) y un sensor binario de habla detectada con antirrebote en MQTT, con autodescubrimiento de Home Assistant.

  • VAD
  • MQTT
  • Home Assistant
  • OpenVoiceOS
Reconocimiento de Voz

vadonnx

Detección de actividad de voz a la manera de ONNX: carga cualquier modelo de VAD tras una única API de streaming con un entorno de ejecución minúsculo (numpy + onnxruntime). El equivalente de phoonnx para VAD; la mayoría de los backends son datos, no código.

  • ONNX
  • VAD
  • audio
  • streaming
Síntesis de Voz

voiceclonnx

Conversión de voz multimotor en ONNX puro: transforma cualquier habla a la voz de un locutor de referencia sin PyTorch en la inferencia. 14 motores (kNN-VC, FreeVC, OpenVoice, RVC, CosyVoice…) tras una única API VoiceCloner, más una CLI y compilaciones INT8.

  • ONNX
  • voice conversion
  • zero-shot
  • multilingual
Palabras de Activación

wakeforge

Entrenador de modelos de palabra de activación desarrollado bajo una subvención de NLnet para OpenVoiceOS: crea palabras de activación personalizadas y en el dispositivo a partir de tus propias muestras.

  • NLnet
  • on-device
  • training
  • wake word
Palabras de Activación

ww_tagger

Aplicación web en Flask para etiquetar a mano audio de palabras de activación: reproduce cada clip y etiqueta la palabra, el género del locutor y el tipo de ruido, persistiendo un corpus listo para entrenar o evaluar.

  • labeling
  • dataset
  • Flask
Medios y Música

xazam

Cliente de Python modular y asíncrono para la API de Shazam: identificación de audio mediante shazamio-core con modelos tipados Track/Artist y un scraper de catálogo.

  • Shazam
  • async
  • audio fingerprinting
Herramientas para Desarrolladores

z85base91

Biblioteca compacta de codificación binario-a-texto (Base91, Z85B, Z85P): implementaciones rápidas en C con alternativas en Python puro, todas más compactas que base64.

  • encoding
  • serialization