Wav2letter
flashlight
Facebook AI Research's Automatic Speech Recognition Toolkit
OPENAGENTSKILL / DIRECTORY
Find a skill for your next task. Explore tools for Codex, Claude Code, Cursor and more.
97–112 / 414
Candidates in this shortlist, not the full registry. GitHub stars belong to repositories, not individual skills.
Results: 414
flashlight
Facebook AI Research's Automatic Speech Recognition Toolkit
Tencent-Hunyuan
HunyuanVideo-1.5: A leading lightweight video generation model
elevenlabs
The official Python SDK for the ElevenLabs API.
netease-youdao
EmotiVoice 😊: a Multi-Voice and Prompt-Controlled TTS Engine
carson-katri
Stable Diffusion built-in to Blender
PaddlePaddle
PaddlePaddle GAN library, including lots of interesting applications like First-Order motion transfer, Wav2Lip, picture repair, image editing, photo2cartoon, image style…
jaywalnut310
VITS: Conditional Variational Autoencoder with Adversarial Learning for End-to-End Text-to-Speech
myshell-ai
High-quality multi-lingual text-to-speech library by MyShell.ai. Support English, Spanish, French, Chinese, Japanese and Korean.
open-mmlab
OpenMMLab Multimodal Advanced, Generative, and Intelligent Creation Toolbox. Unlock the magic 🪄: Generative-AI (AIGC), easy-to-use APIs, awsome model zoo, diffusion mod…
6drf21e
🚀 一键部署(含离线整合包)!基于 ChatTTS ,支持流式输出、音色抽卡、长音频生成和分角色朗读。简单易用,无需复杂安装。
AILab-CVC
VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models
nateshmbhat
Offline Text To Speech synthesis for python
thu-ml
TurboDiffusion: 100–200× Acceleration for Video Diffusion Models