PyTorch code of my ICDAR 2021 paper Vision Transformer for Fast and Efficient Scene Text Recognition (ViTSTR)
$ npx skills add roatienza/deep-text-recognition-benchmarkScenario Document processing · I need my agent to read PDFs, extract tables, and turn documents into structured data.
CLI + Codex · 4 targets