VideoCrafter
AILab-CVC
VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models
OPENAGENTSKILL / DIRECTORY
Find a skill for your next task. Explore tools for Codex, Claude Code, Cursor and more.
129–144 / 446
Candidates in this shortlist, not the full registry. GitHub stars belong to repositories, not individual skills.
Results: 446
AILab-CVC
VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models
nateshmbhat
Offline Text To Speech synthesis for python
thu-ml
TurboDiffusion: 100–200× Acceleration for Video Diffusion Models
ModelTC
Lightweight Image Video Action Generation Inference Framework
GVCLab
[CVPR 2026] PersonaLive! : Expressive Portrait Image Animation for Live Streaming
HanaokaYuzu
✨ Reverse-engineered Python API for Google Gemini web app
antgroup
[CVPR 2025] EchoMimicV2: Towards Striking, Simplified, and Semi-Body Human Animation
jianchang512
Voice Recognition to Text Tool / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式
rsxdalv
A single Gradio + React WebUI with extensions for ACE-Step, OmniVoice, Kimi Audio, Piper TTS, GPT-SoVITS, CosyVoice, XTTSv2, DIA, Kokoro, OpenVoice, ParlerTTS, Stable Au…
yl4579
StyleTTS 2: Towards Human-Level Text-to-Speech through Style Diffusion and Adversarial Training with Large Speech Language Models
lucidrains
Implementation of Recurrent Interface Network (RIN), for highly efficient generation of images and video without cascading networks, in Pytorch
Djdefrag
QualityScaler - image/video AI upscaler app
AlekPet
Custom nodes that extend the capabilities of Comfyui