暂未收录效果图
查看技能说明Wav2letter
flashlight
OPENAGENTSKILL / DIRECTORY
为下一项任务找到合适的技能。探索适用于 Codex、Claude Code、Cursor 等 Agent 的工具。
107 Skills
搜索结果: 107
暂未收录效果图
查看技能说明flashlight
暂未收录效果图
查看技能说明jianchang512
Voice Recognition to Text Tool / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式
暂未收录效果图
查看技能说明mkiol
Speech Note Linux app. Note taking, reading and translating with offline Speech to Text, Text to Speech and Machine translation.
暂未收录效果图
查看技能说明huggingface
Distilled variant of Whisper for speech recognition. 6x faster, 50% smaller, within 1% word error rate.
暂未收录效果图
查看技能说明FireRedTeam
Open-source industrial-grade ASR models supporting Mandarin, Chinese dialects and English, achieving a new SOTA on public Mandarin ASR benchmarks, while also offering ou…
暂未收录效果图
查看技能说明FunAudioLLM
End-to-end speech recognition large model: 31 languages, dialects, accents, lyrics, hotwords, timestamps, speaker diarization. Trained on tens of millions of hours.
暂未收录效果图
查看技能说明royshil
暂未收录效果图
查看技能说明k2-fsa
Real-time speech recognition and voice activity detection (VAD) using next-gen Kaldi with ncnn without Internet connection. Support iOS, Android, Linux, macOS, Windows,…
暂未收录效果图
查看技能说明yeyupiaoling
Fine-tune the Whisper speech recognition model to support training without timestamp data, training with timestamp data, and training without speech data. Accelerate inf…
暂未收录效果图
查看技能说明GauravSingh9356
Personal Assistant built using python libraries. It does almost anything which includes sending emails, Optical Text Recognition, Dynamic News Reporting at any time with…
暂未收录效果图
查看技能说明sooftware
[Unofficial] PyTorch implementation of "Conformer: Convolution-augmented Transformer for Speech Recognition" (INTERSPEECH 2020)
暂未收录效果图
查看技能说明alphacep
暂未收录效果图
查看技能说明k2-fsa
暂未收录效果图
查看技能说明BinWang28
The hub for audio AI research: papers, open models, benchmarks & datasets across audio LLMs, speech recognition, TTS, music & audio generation.
暂未收录效果图
查看技能说明sandrohanea
暂未收录效果图
查看技能说明ageitgey
The world's simplest facial recognition api for Python and the command line