End-to-end Automatic Speech Recognition for Madarian and English in Tensorflow
$ npx skills add zzw922cn/Automatic_Speech_RecognitionScenario Multimodal media · I need my agent to process images, video, or audio and extract useful information.
CLI + Codex · 4 targets